{"id":"W2611354752","doi":"10.5210/ojphi.v9i1.7648","title":"Automated Classification of Alcohol Use by Text Mining of Electronic Medical Records","year":2017,"lang":"en","type":"article","venue":"Online Journal of Public Health Informatics","topic":"Substance Abuse Treatment and Outcomes","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Manitoba; George & Fay Yee Centre for Healthcare Innovation","funders":"Mitacs","keywords":"Medical record; Computer science; Medicine; Health records; Health care; Unstructured data; Primary care; Disease; Data science; Information retrieval; Family medicine; Artificial intelligence; Data mining; Big data; Pathology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002840343,0.001157988,0.0009196899,0.01045387,0.0005910691,0.001675228,0.001224057,0.001027735,0.001285193],"category_scores_gemma":[0.01097116,0.0002864655,0.001063573,0.003972493,0.0003818697,0.00176904,0.001164764,0.000660681,0.001394075],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007222483,"about_ca_system_score_gemma":0.001419238,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004022625,"about_ca_topic_score_gemma":0.005062011,"domain_scores_codex":[0.9965714,0.0008344825,0.0008906585,0.000782214,0.0006859449,0.0002352482],"domain_scores_gemma":[0.9886165,0.005680217,0.002419304,0.0008740586,0.00214635,0.000263584],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009433495,0.001630643,0.2470355,0.002683641,0.0004689815,0.001880478,0.0008210466,0.009967244,0.02915927,0.001248771,0.02295534,0.6812058],"study_design_scores_gemma":[0.0003179141,0.001206978,0.3691636,0.001229268,0.000754714,0.003472253,0.00220433,0.5231817,0.05202304,0.01019178,0.03606232,0.0001920264],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7313281,0.007194235,0.159951,0.003436961,0.0007147203,0.003829263,0.08092147,0.006454045,0.006170233],"genre_scores_gemma":[0.6601379,0.002580693,0.2351261,0.0007329137,0.0007462318,0.00132117,0.09632543,0.0001167363,0.002912785],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01045387,"threshold_uncertainty_score":0.01502132,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1334890589865161,"score_gpt":0.4127568772933147,"score_spread":0.2792678183067986,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}