{"id":"W3193276240","doi":"10.2196/29241","title":"A Semiautomated Chart Review for Assessing the Development of Radiation Pneumonitis Using Natural Language Processing: Diagnostic Accuracy and Feasibility Study","year":2021,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Effects of Radiation Exposure","field":"Medicine","cited_by":11,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary; University of Northern British Columbia; Kelowna General Hospital; University of British Columbia","funders":"University of British Columbia; Faculty of Medicine, University of British Columbia","keywords":"Python (programming language); Computer science; Chart; Terminology; Grading (engineering); Data extraction; Natural language processing; Medicine; Medical physics; Artificial intelligence; MEDLINE; Statistics; Programming language","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.001181097,0.0001347287,0.0003855094,0.00004709938,0.0001461824,0.00004852588,0.00008990406,0.00008525763,0.00002239593],"category_scores_gemma":[0.009478585,0.00009011362,0.0000480522,0.0002932054,0.00006679341,0.0003265436,0.00006346224,0.0002502372,0.000001258229],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0000979641,"about_ca_system_score_gemma":0.0009989436,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000001398574,"about_ca_topic_score_gemma":0.000004135294,"domain_scores_codex":[0.9980975,0.00009868784,0.0008575121,0.0001056901,0.0006664089,0.0001742268],"domain_scores_gemma":[0.9977867,0.001170992,0.0003997948,0.000218365,0.0002883763,0.0001357546],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00002518423,0.0007843765,0.06032855,0.02668062,0.000159453,0.00003917678,0.048241,0.000002911522,0.0006844482,0.000005687156,0.00065633,0.8623922],"study_design_scores_gemma":[0.008631174,0.00044876,0.7084303,0.02261401,0.000885267,0.0007131486,0.04158213,0.2088662,0.005521633,0.00001167356,0.001684061,0.0006115728],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9875191,0.008410675,0.0006725817,0.0008201249,0.00007677875,0.002403119,0.000004350183,0.00005412225,0.00003916248],"genre_scores_gemma":[0.9936467,0.0001995734,0.004768944,0.00107651,0.0000582012,0.0001333957,0.00009578613,0.00001185577,0.000009054914],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8617807,"threshold_uncertainty_score":0.998865,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0320228652613023,"score_gpt":0.4114338877952491,"score_spread":0.3794110225339468,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}