{"id":"W4416754215","doi":"10.1101/2025.11.25.25341018","title":"An Integrated Data-Driven Model for Clinical Phenotyping of Tuberculosis Disease Severity","year":2025,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Tuberculosis Research and Epidemiology","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; National Institute of General Medical Sciences","keywords":"Tuberculosis; Disease; Cohort; Clinical trial; Observational study; Regimen; Severity of illness; Proxy (statistics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006331393,0.001413476,0.001495518,0.001229414,0.0004574129,0.002009705,0.002271759,0.002264875,0.003607169],"category_scores_gemma":[0.01544163,0.0008403171,0.001420286,0.001225718,0.001406654,0.001463978,0.001619873,0.003011587,0.0006013236],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001950178,"about_ca_system_score_gemma":0.00191454,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01652677,"about_ca_topic_score_gemma":0.01073906,"domain_scores_codex":[0.9976153,0.001099871,0.0001231958,0.0006172747,0.0002833751,0.0002608854],"domain_scores_gemma":[0.9890717,0.008520746,0.0008329338,0.0003692012,0.0007692054,0.0004361775],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002627968,0.0000913523,0.009432146,0.00006553726,0.000114562,0.0001870073,0.0001558962,0.9473183,0.0006012491,0.03185107,0.001175438,0.008744578],"study_design_scores_gemma":[0.00003175385,0.00003678989,0.0006001528,0.000008756568,0.00001623606,0.00002388905,0.000009815368,0.9885002,0.0000675946,0.01031965,0.0003723151,0.00001269905],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1081004,0.0006849586,0.8773761,0.003747135,0.0001809528,0.0003910858,0.004947476,0.0007483372,0.003823616],"genre_scores_gemma":[0.8879284,0.0005786398,0.09737971,0.0007056483,0.0001605065,0.001106025,0.003607123,0.0001088514,0.008425063],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01652677,"threshold_uncertainty_score":0.03348404,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1905553683357812,"score_gpt":0.4673699636263872,"score_spread":0.276814595290606,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}