{"id":"W4402297886","doi":"10.1016/j.xcrm.2024.101713","title":"Reconstruction of patient-specific confounders in AI-based radiologic image interpretation using generative pretraining","year":2024,"lang":"en","type":"article","venue":"Cell Reports Medicine","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"Leeds Biomedical Research Centre; HORIZON EUROPE Framework Programme; National Cancer Institute; National Institutes of Health; Gemeinsame Bundesausschuss; Bundesministerium für Gesundheit; Deutscher Akademischer Austauschdienst; Deutsche Krebshilfe; European Commission; Bundesministerium für Bildung und Forschung; National Institute for Health and Care Research","keywords":"Confounding; Robustness (evolution); Reliability (semiconductor); Artificial intelligence; Medicine; Computer science; Machine learning; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003502233,0.0008516289,0.0007478356,0.0008804901,0.0004043575,0.001079986,0.001332287,0.001347335,0.00126368],"category_scores_gemma":[0.01327111,0.0009290932,0.001063223,0.0005328706,0.0009715919,0.0009035759,0.001252673,0.001928444,0.0003820813],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001174807,"about_ca_system_score_gemma":0.001246474,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009923915,"about_ca_topic_score_gemma":0.01101936,"domain_scores_codex":[0.9993187,0.0003058375,0.00004036233,0.0001926261,0.00006914912,0.00007332468],"domain_scores_gemma":[0.9934015,0.005112117,0.0004572353,0.0004984172,0.00039985,0.0001309802],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004157662,0.0001186883,0.03583708,0.00009300827,0.0001676608,0.0002757681,0.0003734272,0.8372921,0.005087117,0.004788167,0.001182872,0.1143684],"study_design_scores_gemma":[0.00001005274,0.00002902696,0.002017409,0.00001156978,0.00001353999,0.00004671452,0.00001328865,0.9932812,0.001195849,0.003207915,0.0001634927,0.000009805557],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.278415,0.0004445287,0.7166955,0.001118115,0.00007107764,0.0001321868,0.0002379285,0.001704639,0.001180915],"genre_scores_gemma":[0.9342043,0.0001336163,0.06386284,0.000278594,0.00003866768,0.00009097965,0.0003730891,0.00007029276,0.0009476265],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009923915,"threshold_uncertainty_score":0.0197323,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02527191272522262,"score_gpt":0.3063805279896156,"score_spread":0.281108615264393,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}