{"id":"W4411056120","doi":"10.1371/journal.pdig.0000866","title":"The illusion of safety: A report to the FDA on AI healthcare product approvals","year":2025,"lang":"en","type":"article","venue":"PLOS Digital Health","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":29,"is_retracted":false,"has_abstract":true,"ca_institutions":"North York General Hospital; University of Toronto","funders":"National Science Foundation","keywords":"Transparency (behavior); Health care; Accountability; Compromise; Risk analysis (engineering); Food and drug administration; Business; Computer science; Knowledge management; Computer security; Economics; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03888018,0.001310094,0.001104649,0.003195614,0.00479289,0.01409416,0.003150741,0.02697458,0.007802308],"category_scores_gemma":[0.07418705,0.0009052343,0.003597752,0.002342622,0.005546089,0.007178448,0.003951588,0.02104792,0.003973053],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00823176,"about_ca_system_score_gemma":0.03001365,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0112169,"about_ca_topic_score_gemma":0.01390281,"domain_scores_codex":[0.933794,0.01114909,0.004412754,0.003454108,0.04336842,0.003821774],"domain_scores_gemma":[0.9211611,0.04064843,0.005985375,0.002858819,0.0246665,0.00467978],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.0001256044,0.0001433364,0.001368055,0.0003690427,0.00006596933,0.001054049,0.0005450209,0.0002997609,0.001723444,0.03428546,0.8622571,0.09776321],"study_design_scores_gemma":[0.00005480408,0.0001223995,0.001447066,0.0006519561,0.00008695732,0.0005808173,0.0002686942,0.000376652,0.001494962,0.005503475,0.9893519,0.00006023449],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"empirical","genre_scores_codex":[0.00638867,0.0318051,0.007799753,0.7704724,0.02994245,0.0005335768,0.001065025,0.001292084,0.1507009],"genre_scores_gemma":[0.07866737,0.04044245,0.0119031,0.7488636,0.01758815,0.0007064472,0.001370871,0.0005742121,0.09988385],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9611198,"threshold_uncertainty_score":0.2056205,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1083778962169385,"score_gpt":0.4385085710193857,"score_spread":0.3301306748024473,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}