{"id":"W2085441932","doi":"10.1016/j.jclinepi.2003.01.002","title":"Assessing accuracy of diagnosis-type indicators for flagging complications in administrative data","year":2004,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Sepsis Diagnosis and Treatment","field":"Medicine","cited_by":102,"is_retracted":false,"has_abstract":false,"ca_institutions":"Alberta Health Services; University of Calgary","funders":"","keywords":"Flagging; Medical diagnosis; Medicine; Complication; Medical record; Kappa; Chart; Emergency medicine; Statistics; Surgery; Radiology; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008558291,0.0001219657,0.001880803,0.000203834,0.00003567166,0.000005558286,0.0002949414,0.0002032443,0.00002566656],"category_scores_gemma":[0.1347207,0.00008642951,0.0003196607,0.0002319079,0.0002141485,0.0002039455,0.00006554465,0.0004709442,0.000002988767],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007226134,"about_ca_system_score_gemma":0.0008398317,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002802359,"about_ca_topic_score_gemma":0.00002262977,"domain_scores_codex":[0.995001,0.0006475541,0.00373492,0.0002701099,0.0001252721,0.0002211238],"domain_scores_gemma":[0.9298316,0.06514534,0.003893388,0.0005678274,0.0002880532,0.0002738528],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002082626,0.00174371,0.9683807,0.00003926652,0.0002461778,0.00002458675,0.0000433421,0.000100753,0.00001027986,0.002462859,0.001222168,0.02551787],"study_design_scores_gemma":[0.003777474,0.001723996,0.9831955,0.0005891685,0.0002439505,0.00006500457,0.0001513946,0.000104572,0.0001472869,0.006419641,0.003518302,0.00006366277],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9619344,0.001280637,0.002865645,0.03295444,0.0003942362,0.0003749852,0.0000204026,0.000005286573,0.0001699849],"genre_scores_gemma":[0.9548663,0.001676061,0.04059487,0.002521236,0.0002726378,0.00001697206,0.00003952512,0.00001066189,0.000001659936],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1261624,"threshold_uncertainty_score":0.872568,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8122389124184975,"score_gpt":0.6703794114465711,"score_spread":0.1418595009719265,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}