{"id":"W4406882769","doi":"10.1609/aies.v7i2.31896","title":"Model Multiplicity for Responsible AI","year":2025,"lang":"en","type":"article","venue":"Proceedings of the AAAI/ACM Conference on AI Ethics and Society","topic":"Fault Detection and Control Systems","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Multiplicity (mathematics); Computer science; Mathematics; Geometry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008082599,0.0001430304,0.0002172638,0.00003089509,0.0002852826,0.00009338129,0.00031959,0.0002927479,0.000002069023],"category_scores_gemma":[0.0005116865,0.0001113054,0.0001680079,0.0001565774,0.00009875253,0.00008604363,0.00008955624,0.0008001397,7.784868e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003918692,"about_ca_system_score_gemma":0.0001082007,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001610298,"about_ca_topic_score_gemma":0.000008102641,"domain_scores_codex":[0.9992282,0.000008276751,0.0002163913,0.0001894549,0.0001752305,0.0001824946],"domain_scores_gemma":[0.9991362,0.0001990795,0.00005275548,0.0001506357,0.000420465,0.00004086265],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001560878,0.00005378418,0.0005222058,0.001778049,0.0002337813,2.664124e-8,0.008492367,0.002813748,0.2714602,0.6794281,0.03285731,0.002204324],"study_design_scores_gemma":[0.0005978381,0.00003138231,0.0001960466,0.0002107059,0.00002571515,4.160251e-7,0.000843276,0.9376231,0.0193362,0.03855661,0.002447886,0.0001308408],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8271893,0.0005070199,0.02700259,0.09794792,0.001915951,0.002991518,0.0001473412,0.0008701308,0.04142825],"genre_scores_gemma":[0.9949998,0.0002042186,0.000890335,0.002171464,0.00002669163,0.0000726576,4.116661e-7,0.0000133244,0.001621049],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9348093,"threshold_uncertainty_score":0.4538902,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04764815443537723,"score_gpt":0.3124607424466821,"score_spread":0.2648125880113049,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}