{"id":"W4386387286","doi":"10.1186/s40708-023-00203-w","title":"Cerebrovascular disease case identification in inpatient electronic medical record data using natural language processing","year":2023,"lang":"en","type":"article","venue":"Brain Informatics","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Alberta Health Services; University of Calgary","funders":"Canadian Institutes of Health Research","keywords":"Identification (biology); Electronic medical record; Medicine; Medical record; Disease; Computer science; Natural language processing; Medical emergency; Pathology; Internal medicine","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006701285,0.0004815164,0.0005234625,0.008519326,0.0003995687,0.001442896,0.000787568,0.0005743409,0.0007417712],"category_scores_gemma":[0.02498287,0.0002006698,0.0007734163,0.003877172,0.000437075,0.00130496,0.0008209394,0.0005694,0.0003887722],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001149993,"about_ca_system_score_gemma":0.001752251,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005203384,"about_ca_topic_score_gemma":0.006736584,"domain_scores_codex":[0.9939984,0.002583125,0.001223312,0.001152844,0.0008890849,0.0001532104],"domain_scores_gemma":[0.9658849,0.02491814,0.005631794,0.0009894196,0.002346449,0.0002292188],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006199098,0.0008352624,0.5621309,0.003211082,0.0003937563,0.002756766,0.002100553,0.01692068,0.0108547,0.0016132,0.01065486,0.3879084],"study_design_scores_gemma":[0.0002078623,0.0005869931,0.4889273,0.001424775,0.0005822734,0.003781037,0.003208108,0.4556182,0.01655764,0.01076894,0.01814581,0.0001909334],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.804063,0.003559697,0.1488632,0.003283615,0.000132435,0.002393189,0.03279032,0.001832395,0.003082107],"genre_scores_gemma":[0.7362801,0.0009054745,0.232732,0.0005889057,0.0001921977,0.001181449,0.02773863,0.00003419432,0.0003471602],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.008519326,"threshold_uncertainty_score":0.03544021,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02924179200630377,"score_gpt":0.3474506794720171,"score_spread":0.3182088874657134,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}