{"id":"W3130937151","doi":"10.1038/s41746-021-00385-9","title":"Do as AI say: susceptibility in deployment of clinical decision-aids","year":2021,"lang":"en","type":"article","venue":"npj Digital Medicine","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":447,"is_retracted":false,"has_abstract":true,"ca_institutions":"Vector Institute; University of Toronto; St. Michael's Hospital","funders":"Natural Sciences and Engineering Research Council of Canada; Government of Canada; Canadian Institute for Advanced Research; Vector Institute; Microsoft Research","keywords":"Advice (programming); Medical diagnosis; Decision aids; Software deployment; Task (project management); Quality (philosophy); Work (physics); Psychology; Medicine; Medical education; Computer science; Medical physics; Pathology; Engineering; Alternative medicine","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01991329,0.0003214065,0.0002994673,0.001529546,0.001201586,0.00403766,0.001005364,0.002025181,0.002105201],"category_scores_gemma":[0.3260712,0.0004593536,0.0003185372,0.0008877914,0.002196962,0.004139461,0.002982843,0.002705958,0.0005128596],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001198964,"about_ca_system_score_gemma":0.001490212,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00318278,"about_ca_topic_score_gemma":0.003168172,"domain_scores_codex":[0.9700431,0.01730226,0.003213873,0.002115594,0.005962155,0.001363009],"domain_scores_gemma":[0.7144342,0.2121711,0.03574082,0.01520204,0.01346256,0.008989287],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001138684,0.0005790077,0.7891816,0.0003917497,0.0001852234,0.001280096,0.09511815,0.000878612,0.002716959,0.003418827,0.002891551,0.1022194],"study_design_scores_gemma":[0.000137208,0.001773916,0.780813,0.001239243,0.0002175531,0.006373979,0.1469381,0.01098824,0.004053374,0.01778445,0.02941383,0.0002671969],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9855345,0.0006416184,0.003350154,0.004505832,0.0001254887,0.00007660504,0.00006091554,0.0001011514,0.005603642],"genre_scores_gemma":[0.9976459,0.000125568,0.001195092,0.0005941269,0.00003721891,0.00001757094,0.00004404891,0.00003013806,0.0003102675],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01991329,"threshold_uncertainty_score":0.1053129,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2054665387131868,"score_gpt":0.527046304125125,"score_spread":0.3215797654119381,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}