{"id":"W4411373796","doi":"10.2196/70967","title":"Leveraging GPT-4o for Automated Extraction and Categorization of CAD-RADS Features From Free-Text Coronary CT Angiography Reports: Diagnostic Study","year":2025,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Categorization; BI-RADS; Coronary angiography; CAD; Preprint; Feature (linguistics); Computer science; Medicine; Radiology; Artificial intelligence; Feature extraction; Internal medicine; Mammography; Engineering; World Wide Web","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005724748,0.0009785052,0.0003968063,0.002438647,0.0002786852,0.001661043,0.001056358,0.0006538542,0.002363538],"category_scores_gemma":[0.02281376,0.0004081701,0.001260859,0.0009123263,0.0004937153,0.001705629,0.002293062,0.0007813448,0.001829972],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001024231,"about_ca_system_score_gemma":0.001664119,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004884256,"about_ca_topic_score_gemma":0.00518324,"domain_scores_codex":[0.9981665,0.0007646229,0.0001695339,0.0005412399,0.0002612497,0.00009679858],"domain_scores_gemma":[0.9910649,0.006137248,0.0006509597,0.0009653341,0.0009443174,0.0002372666],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001916823,0.0009869081,0.3089849,0.0007552676,0.000544599,0.00126859,0.001541773,0.05734159,0.01623595,0.002376883,0.01441697,0.5936297],"study_design_scores_gemma":[0.0001633929,0.0006744546,0.06548222,0.0001656485,0.0002616378,0.001714411,0.0005550145,0.8994934,0.01644168,0.005345597,0.009597789,0.000104767],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5675769,0.0006608638,0.3943503,0.001642091,0.0001973295,0.001427621,0.00701375,0.02268348,0.004447747],"genre_scores_gemma":[0.812548,0.0002816124,0.1747361,0.0002961513,0.00007484799,0.0005900614,0.009448886,0.0006377554,0.00138648],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005724748,"threshold_uncertainty_score":0.0302757,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03958429564436395,"score_gpt":0.4037476638439788,"score_spread":0.3641633681996149,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}