{"id":"W4417257955","doi":"10.1016/j.surg.2025.109971","title":"Dual-center external validation of the ARCH score: Predictive accuracy and calibration for hypothermic circulatory arrest aortic arch surgery","year":2025,"lang":"en","type":"article","venue":"Surgery","topic":"Aortic Disease and Treatment Approaches","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Sunnybrook Health Science Centre","funders":"","keywords":"Arch; Aortic arch; Calibration; Circulatory system; Deep hypothermic circulatory arrest; Aortic surgery; Simplicity","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000294361,0.0001246228,0.0002887641,0.0001459006,0.00007544437,0.00001577496,0.00003133071,0.00005675161,0.00001345146],"category_scores_gemma":[0.0004323098,0.00008857306,0.0002133036,0.0001690562,0.0001272361,0.0001217277,0.00003201262,0.00006918889,8.078129e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005188008,"about_ca_system_score_gemma":0.0003635029,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003657252,"about_ca_topic_score_gemma":0.000002163719,"domain_scores_codex":[0.9989547,0.00007989928,0.0003538334,0.0002315865,0.0002028312,0.0001771418],"domain_scores_gemma":[0.9981503,0.001317003,0.0001489574,0.0002588074,0.00006418094,0.0000607105],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003267186,0.0002835446,0.9888376,0.0003312339,0.0001956198,0.000004342467,0.00008349154,0.000006106104,0.001706843,0.0001454993,0.0005764232,0.007502557],"study_design_scores_gemma":[0.000540867,0.00001767241,0.9815846,0.0005814755,0.0003159909,0.000007279829,0.00005235488,0.0009224978,0.01501611,0.0008098065,0.00006935606,0.00008195682],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9971617,0.0004179289,0.0008716547,0.0003653691,0.0003181272,0.0006607724,0.00003328956,0.00002573483,0.0001453602],"genre_scores_gemma":[0.9992496,0.00005509432,0.00002693358,0.0001521269,0.0001027338,0.0001379131,0.00008031451,0.00001569394,0.0001796213],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01330926,"threshold_uncertainty_score":0.3611905,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04402025035807931,"score_gpt":0.2870923305347299,"score_spread":0.2430720801766506,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}