{"id":"W2802776178","doi":"10.17269/s41997-018-0059-0","title":"Comparing Twitter data to routine data sources in public health surveillance for the 2015 Pan/Parapan American Games: an ecological study","year":2018,"lang":"en","type":"article","venue":"Canadian Journal of Public Health","topic":"Data-Driven Disease Surveillance","field":"Medicine","cited_by":11,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University; Toronto Public Health; Kingston Health Sciences Centre; Public Health Ontario; University Health Network; University of Toronto; Queen's University","funders":"","keywords":"Helpline; Social media; Public health surveillance; Medicine; Public health; Big data; Categorization; Computer science; Data mining; World Wide Web; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02490846,0.0005537544,0.0005490684,0.002752542,0.00140797,0.003224667,0.001877999,0.001500622,0.001308871],"category_scores_gemma":[0.1128233,0.0007120757,0.001239517,0.005262642,0.001425103,0.00567186,0.004153474,0.001782857,0.0003951344],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004089963,"about_ca_system_score_gemma":0.003368365,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.1468017,"about_ca_topic_score_gemma":0.1673512,"domain_scores_codex":[0.9682549,0.02241296,0.001673689,0.002855595,0.003327164,0.001475766],"domain_scores_gemma":[0.9193692,0.0488887,0.01210797,0.005454658,0.01190919,0.002270205],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0007010167,0.0006677052,0.9777189,0.0002873439,0.0006618582,0.00009127049,0.004744852,0.001005128,0.0001866723,0.00115939,0.003210203,0.009565589],"study_design_scores_gemma":[0.0001195258,0.0006807224,0.9498891,0.0004777018,0.0005522044,0.0002291743,0.0220113,0.01634713,0.0005881904,0.001439053,0.00755909,0.0001068873],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9895248,0.0003658932,0.002180979,0.001328167,0.0000707462,0.0002845137,0.004686193,0.0000285768,0.001530075],"genre_scores_gemma":[0.9921731,0.0001554285,0.002218587,0.0004013991,0.00003549258,0.0003135361,0.004366296,0.00002965022,0.0003065515],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1468017,"threshold_uncertainty_score":0.2918944,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3756291943115768,"score_gpt":0.4365406736477606,"score_spread":0.06091147933618379,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}