{"id":"W3095617614","doi":"10.2196/22898","title":"Extraction of Family History Information From Clinical Notes: Deep Learning and Heuristics Approach","year":2020,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Relationship extraction; Information extraction; Heuristics; Computer science; Artificial intelligence; Task (project management); Natural language processing; Information retrieval; Machine learning; Data extraction; Data mining; MEDLINE; Engineering","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000328681,0.0001181868,0.0002384842,0.00002777853,0.00003244387,0.0000112471,0.00015546,0.0004665609,0.00003168519],"category_scores_gemma":[0.00194713,0.0001009634,0.00006536952,0.0000543041,0.0003542663,0.00001757661,0.000136503,0.000412022,0.000013357],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001305932,"about_ca_system_score_gemma":0.000113936,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000008933812,"about_ca_topic_score_gemma":6.29568e-7,"domain_scores_codex":[0.9985607,0.00006486937,0.0007695553,0.00009669143,0.0003636201,0.000144543],"domain_scores_gemma":[0.9991034,0.0001321871,0.0003063662,0.0001132402,0.00007229541,0.0002725692],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002844428,0.0001619358,0.007255022,0.0005172281,0.0001379219,0.000003068328,0.008001417,0.00001980148,0.001406289,0.00009463351,0.01543919,0.966679],"study_design_scores_gemma":[0.001672867,0.0009471035,0.007821599,0.00005782397,0.00004663018,0.00001387642,0.006912841,0.07521643,0.0003083703,0.00003244138,0.9066597,0.0003102623],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.683373,0.001390486,0.3105942,0.0003082651,0.0003224479,0.0002011026,0.00001698487,0.00007362534,0.003719864],"genre_scores_gemma":[0.9536864,0.001467512,0.04065081,0.003259064,0.0004060024,0.00001530066,0.0004864231,0.00001145168,0.00001707716],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9663688,"threshold_uncertainty_score":0.4117168,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04476226521817948,"score_gpt":0.3279625408580742,"score_spread":0.2832002756398947,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}