{"id":"W3157562392","doi":"10.1111/jocs.15589","title":"The jungle of risk scores and their inability to predict long‐term survival. The truth behind the mirror","year":2021,"lang":"en","type":"article","venue":"Journal of Cardiac Surgery","topic":"Cardiac, Anesthesia and Surgical Outcomes","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; St. Michael's Hospital","funders":"","keywords":"Jungle; Medicine; Term (time); Astronomy; Archaeology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006752793,0.0001994187,0.001303148,0.00007150981,0.0002422423,0.00007927624,0.0001668008,0.0000852551,0.00001967634],"category_scores_gemma":[0.007205982,0.00007662666,0.001898446,0.0002678443,0.0003444017,0.00007977195,0.00009383649,0.0004577985,0.000001603024],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004465319,"about_ca_system_score_gemma":0.0003879351,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003347039,"about_ca_topic_score_gemma":0.00002206057,"domain_scores_codex":[0.9966683,0.001395783,0.000783119,0.0001743003,0.0006919816,0.0002865286],"domain_scores_gemma":[0.9696476,0.02854991,0.000416367,0.0006293263,0.0005379325,0.0002188591],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004934011,0.00006401771,0.9716178,0.00004261703,0.0007454864,0.0000879982,0.001237486,0.000002393436,0.000144727,0.00006499449,0.001260162,0.02423891],"study_design_scores_gemma":[0.0002152819,0.00005945349,0.9673106,0.0001063972,0.0004388673,0.0003284741,0.00149225,0.000001237973,0.001520772,0.00006160157,0.0283809,0.00008416488],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9787876,0.01208069,0.00001150122,0.006353461,0.001867906,0.0002180802,0.00003177443,0.000007166666,0.0006418168],"genre_scores_gemma":[0.9950788,0.004059018,0.00001428078,0.0002036365,0.0004514044,0.000005040058,0.000002329085,0.00001987483,0.0001656208],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02715413,"threshold_uncertainty_score":0.8626754,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01710384939522337,"score_gpt":0.2629821660641201,"score_spread":0.2458783166688968,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}