{"id":"W4406384062","doi":"10.1186/s41747-024-00547-w","title":"Can ChatGPT4-vision identify radiologic progression of multiple sclerosis on brain MRI?","year":2025,"lang":"en","type":"article","venue":"European Radiology Experimental","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Science Foundation Ireland; Health Service Executive; Royal College of Surgeons in Ireland; Wellcome Trust; Canadian Institute for Theoretical Astrophysics","keywords":"Multiple sclerosis; Neuroradiology; Medicine; Neurology; Neuroscience; Radiology; Psychology; Psychiatry","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002316778,0.0009718224,0.0005845231,0.0006191343,0.0002278008,0.000963798,0.00188302,0.001273099,0.004138464],"category_scores_gemma":[0.00656188,0.0004012989,0.0009659229,0.000308281,0.0003721417,0.001376681,0.0009865199,0.001004935,0.001498203],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009838842,"about_ca_system_score_gemma":0.0009357677,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009395305,"about_ca_topic_score_gemma":0.009835556,"domain_scores_codex":[0.9995023,0.0001594416,0.0000255931,0.0001796929,0.00007827022,0.00005470372],"domain_scores_gemma":[0.998454,0.0009359549,0.0001045634,0.000174694,0.0002505654,0.00008036831],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.004063296,0.0005570348,0.04381873,0.0006419284,0.0009543939,0.0006282835,0.0002300805,0.2817442,0.01924088,0.001561067,0.02356027,0.6229999],"study_design_scores_gemma":[0.0001261679,0.0006594298,0.005334311,0.00004880414,0.0001470249,0.0004453395,0.00005856776,0.9745208,0.01338796,0.002727034,0.002500035,0.00004444871],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.663138,0.002396599,0.2727445,0.001945902,0.0004852835,0.0005607769,0.00362347,0.04540098,0.009704508],"genre_scores_gemma":[0.9252324,0.000274719,0.0675958,0.0005339848,0.00005533862,0.0002136959,0.002484282,0.000514944,0.0030949],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.009395305,"threshold_uncertainty_score":0.01868123,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1282998897865956,"score_gpt":0.4370250659856302,"score_spread":0.3087251761990346,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}