{"id":"W4417201030","doi":"10.1038/s41746-025-02140-w","title":"EchoGraph system for automated quality assessment of echocardiography reports","year":2025,"lang":"en","type":"article","venue":"npj Digital Medicine","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"National Heart, Lung, and Blood Institute; Mayo Clinic","keywords":"Schema (genetic algorithms); Variance (accounting); Quality assessment; Quality Score; F1 score; Quality (philosophy); Sensitivity (control systems)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008481537,0.00014839,0.0006058402,0.0004694373,0.00007320618,0.00001484781,0.00006666336,0.0001262453,0.00001027731],"category_scores_gemma":[0.0007940813,0.0001156667,0.000211863,0.0008982227,0.0001839525,0.0001049939,0.00001722007,0.0001211456,0.000001213093],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001207604,"about_ca_system_score_gemma":0.0003208144,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002759151,"about_ca_topic_score_gemma":0.000004254888,"domain_scores_codex":[0.9979169,0.00003263257,0.001151851,0.0003143131,0.000350528,0.0002337161],"domain_scores_gemma":[0.9980214,0.0004012843,0.0002986748,0.0004940675,0.0006444165,0.0001402122],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002864282,0.0004657698,0.846571,0.005653735,0.0005351951,0.00003529993,0.0005046678,0.00002566025,0.002987888,0.01153124,0.02039789,0.1110053],"study_design_scores_gemma":[0.001350323,0.004013766,0.8931966,0.01151364,0.001241778,0.0001772496,0.02322304,0.005743386,0.0197616,0.01200609,0.02710127,0.0006712945],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8724142,0.000758595,0.02216312,0.005794499,0.00387416,0.002652599,0.00004691942,0.0009350303,0.09136091],"genre_scores_gemma":[0.998283,0.00002473232,0.0007058979,0.0002623763,0.0002171013,0.0001165785,0.0001574145,0.00001292297,0.0002199834],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1258688,"threshold_uncertainty_score":0.471675,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1342374651418137,"score_gpt":0.5010621793141272,"score_spread":0.3668247141723135,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}