{"id":"W2977852562","doi":"","title":"Automated Identification of National Health Survey Research Topics in the Academic Literature.","year":2017,"lang":"en","type":"article","venue":"PubMed","topic":"Data-Driven Disease Surveillance","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Identification (biology); Public health; Health care; Population; Data science; Health Information National Trends Survey; Environmental health; Health information; Medicine; Computer science; Political science; Nursing","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01049984,0.00005354977,0.00014794,0.0001491297,0.0001282903,0.00006207284,0.0004235338,0.00006486902,0.000003261792],"category_scores_gemma":[0.00576451,0.00003962847,0.00002520852,0.0002878103,0.0001252199,0.0001422906,0.0000661719,0.0003585068,0.000009156613],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001063632,"about_ca_system_score_gemma":0.0001973271,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001846747,"about_ca_topic_score_gemma":0.0003359854,"domain_scores_codex":[0.9978961,0.0006081171,0.000333835,0.0001813068,0.000726504,0.0002541846],"domain_scores_gemma":[0.9985631,0.0001784846,0.0001965467,0.0005752938,0.0004136912,0.00007286848],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001610543,0.0001759633,0.8882798,0.0001957349,0.00002636047,0.000009088694,0.0008688562,0.000002773153,0.00006282935,0.001005325,0.08030406,0.02890814],"study_design_scores_gemma":[0.0003775806,0.000007772236,0.9970987,0.00003576734,0.00000105708,0.000003329734,0.00001602744,0.0001819211,0.00005005811,0.0002847112,0.001912957,0.00003004703],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.977413,0.001035863,0.0000055118,0.01691733,0.0002392866,0.001724297,0.000770432,0.00007752779,0.001816745],"genre_scores_gemma":[0.9980456,0.0001411724,0.00001071865,0.0002405123,0.0001134588,0.0002797095,0.0005907204,0.000006248912,0.000571915],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.108819,"threshold_uncertainty_score":0.6901074,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1887667733192991,"score_gpt":0.4529664531246465,"score_spread":0.2641996798053474,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}