{"id":"W6976543735","doi":"10.60692/qg05f-5zj33","title":"Leveraging machine learning approaches for predicting potential Lyme disease cases and incidence rates in the United States using Twitter","year":2023,"lang":"en","type":"article","venue":"Greater South Information System","topic":"Data-Driven Disease Surveillance","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"HEC Montréal; Université de Montréal","funders":"","keywords":"Lyme disease; Word2vec; Disease; Incidence (geometry); LYME; Set (abstract data type); Spamming","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001078478,0.0006466179,0.0004099376,0.004086253,0.0003400907,0.0009355837,0.0004210951,0.0006297787,0.00107135],"category_scores_gemma":[0.003928225,0.0001775702,0.0005094752,0.001652721,0.0001686614,0.001296047,0.0006317415,0.0006342137,0.001211668],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005584669,"about_ca_system_score_gemma":0.0003888788,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006919584,"about_ca_topic_score_gemma":0.01147362,"domain_scores_codex":[0.999463,0.0001767264,0.00006702293,0.000141784,0.00009631523,0.00005516842],"domain_scores_gemma":[0.9973878,0.001653724,0.0003379323,0.0001193,0.0003929249,0.0001082594],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006869563,0.0009076986,0.5446966,0.0004428598,0.0003555073,0.0004687122,0.0004470754,0.1259413,0.006731398,0.000952689,0.01497776,0.3033915],"study_design_scores_gemma":[0.00001212149,0.0001259653,0.05763402,0.00006345866,0.00004534179,0.0000930384,0.0004180905,0.9348562,0.002526434,0.001464893,0.002732067,0.00002837923],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9415063,0.001128629,0.03464914,0.001876013,0.0002311587,0.0001927123,0.01274693,0.001505034,0.00616414],"genre_scores_gemma":[0.9726451,0.0003082116,0.01688832,0.0001322802,0.0001644341,0.00008601475,0.008491983,0.00002924891,0.001254429],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006919584,"threshold_uncertainty_score":0.01375866,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09808327153389258,"score_gpt":0.2726396494698408,"score_spread":0.1745563779359482,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}