{"id":"W3183015861","doi":"10.1126/science.abg1834","title":"Beware explanations from AI in health care","year":2021,"lang":"en","type":"article","venue":"Science","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":231,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Novo Nordisk Fonden","keywords":"Psychology; Data science; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001810976,0.00003475208,0.00007621244,0.00009349272,0.0001663821,0.00002171637,0.00006520276,0.00002126618,0.0001389624],"category_scores_gemma":[0.0003783822,0.00003367253,0.00001318136,0.0007819217,0.00009009134,0.0001210561,0.00001781857,0.0001035201,0.0000626878],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002567122,"about_ca_system_score_gemma":0.003320624,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003483974,"about_ca_topic_score_gemma":0.00396581,"domain_scores_codex":[0.9991922,0.00001921897,0.00017736,0.0002119558,0.0002161844,0.0001831211],"domain_scores_gemma":[0.9993554,0.00004197893,0.0000252677,0.0001864313,0.0002651069,0.0001258427],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000021149,0.0002324732,0.5118186,0.0001506728,0.000003511015,0.00006099901,0.09106305,0.00008561297,0.009782297,0.002403682,0.003067302,0.3813107],"study_design_scores_gemma":[0.0001136941,0.0002075176,0.6741903,0.000599018,0.000007330124,0.00002792064,0.1414144,0.001407029,0.1326305,0.005937252,0.04323456,0.0002304679],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9592912,0.001630267,0.0002518274,0.03699573,0.000613861,0.000119621,0.000007079856,0.00002096468,0.001069428],"genre_scores_gemma":[0.9936402,0.0000661739,0.001144146,0.004863374,0.0001026979,0.00000800742,0.00003497757,0.000002479361,0.0001379806],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3810802,"threshold_uncertainty_score":0.5890644,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.158082964882692,"score_gpt":0.5025488631789206,"score_spread":0.3444658982962286,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}