{"id":"W4206809756","doi":"10.1186/s12967-022-03228-7","title":"Ground truth labels challenge the validity of sepsis consensus definitions in critical illness","year":2022,"lang":"en","type":"article","venue":"Journal of Translational Medicine","topic":"Sepsis Diagnosis and Treatment","field":"Medicine","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Manitoba","funders":"Klaus Tschira Stiftung; Universität Heidelberg","keywords":"Sepsis; Medicine; SOFA score; Intensive care unit; Organ dysfunction; Intensive care medicine; Severity of illness; Systemic inflammatory response syndrome; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0009819879,0.0001090726,0.0004496974,0.000228745,0.0001336563,0.000002761834,0.00009247669,0.00003554714,0.001293742],"category_scores_gemma":[0.0005581009,0.00006747685,0.0001468792,0.0002907647,0.0002424192,0.00003539655,0.00001102398,0.000378204,0.000001093498],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00008038464,"about_ca_system_score_gemma":0.0001812559,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003241401,"about_ca_topic_score_gemma":0.00001294036,"domain_scores_codex":[0.9979207,0.0002267443,0.0007367876,0.0001071728,0.0008707556,0.0001378709],"domain_scores_gemma":[0.9959866,0.003346152,0.0001973002,0.0001275457,0.0002448382,0.00009756473],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.005178062,0.02355832,0.3762073,0.001044882,0.002983032,0.004200222,0.0288478,0.003204637,0.002448328,0.5093612,0.01550778,0.02745839],"study_design_scores_gemma":[0.01882903,0.006329276,0.8807039,0.0009967544,0.001897033,0.002812936,0.007688115,0.0003980283,0.0003098861,0.07221267,0.007568727,0.0002536536],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8058763,0.004257336,0.00008177928,0.1871828,0.0005977587,0.0002196852,0.00007442339,0.000005065747,0.001704936],"genre_scores_gemma":[0.9982463,0.0004299309,0.0003636884,0.0006620054,0.0002417651,0.00002121317,0.00001674701,0.00001069748,0.0000076858],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5044966,"threshold_uncertainty_score":0.9996192,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3343211877175216,"score_gpt":0.4160001521152731,"score_spread":0.08167896439775146,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}