{"id":"W4416011851","doi":"10.1371/journal.pgph.0004674","title":"Predicting and improving diagnosis of tuberculosis outcomes in South Africa using machine learning techniques","year":2025,"lang":"en","type":"article","venue":"PLOS Global Public Health","topic":"Tuberculosis Research and Epidemiology","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Trent University","funders":"","keywords":"Random forest; Support vector machine; Gradient boosting; Decision tree; Logistic regression; Ensemble learning; Artificial neural network; Tuberculosis","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001910778,0.0001931774,0.0008697782,0.0004214522,0.0001423896,0.00002670743,0.0001193476,0.0001582527,0.00001663632],"category_scores_gemma":[0.00723258,0.0001622967,0.00008886319,0.000843464,0.0001163845,0.0001438027,0.000242478,0.0005100819,8.653254e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005800197,"about_ca_system_score_gemma":0.0006488129,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007665314,"about_ca_topic_score_gemma":0.0004197604,"domain_scores_codex":[0.9972013,0.0005043393,0.000749908,0.000412127,0.0002953464,0.0008370345],"domain_scores_gemma":[0.998634,0.000414423,0.0001960979,0.0002371748,0.0001324103,0.0003859279],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00003120691,0.000244674,0.9831738,0.0006620229,0.0001141265,0.000004959346,0.0004587565,0.000002670115,0.0001883238,0.0002614574,0.00003798611,0.01481999],"study_design_scores_gemma":[0.001622213,0.0008987218,0.9549849,0.0009128397,0.00008301106,0.00001940304,0.00119288,0.03772519,0.000486058,0.0002559688,0.001573521,0.0002453041],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9740274,0.002902733,0.000238932,0.02088252,0.00003370752,0.0006814449,0.00005640498,0.0001421668,0.001034674],"genre_scores_gemma":[0.9937196,0.0004624275,0.00427112,0.00139963,0.0000304653,0.00006654907,0.00001565485,0.00001319205,0.00002135716],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03772252,"threshold_uncertainty_score":0.9989427,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06052174444721369,"score_gpt":0.3636104007877995,"score_spread":0.3030886563405858,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}