{"id":"W4382583924","doi":"10.3389/fdgth.2023.1203874","title":"Comparison of pretrained transformer-based models for influenza and COVID-19 detection using social media text data in Saskatchewan, Canada","year":2023,"lang":"en","type":"article","venue":"Frontiers in Digital Health","topic":"Data-Driven Disease Surveillance","field":"Medicine","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Saskatchewan","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Social media; Coronavirus disease 2019 (COVID-19); Computer science; Transformer; Artificial intelligence; Context (archaeology); Language model; Outbreak; Natural language processing; Machine learning; Medicine; Geography; World Wide Web; Virology; Infectious disease (medical specialty); Disease; Internal medicine","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002203295,0.001983538,0.0007106237,0.001088832,0.0009648399,0.001212442,0.001734345,0.0008670597,0.001968191],"category_scores_gemma":[0.006864623,0.0004583389,0.0009660996,0.0009971714,0.00059647,0.001153114,0.0009567674,0.001589807,0.001292598],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.009341675,"about_ca_system_score_gemma":0.01022727,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.859228,"about_ca_topic_score_gemma":0.8598896,"domain_scores_codex":[0.9991041,0.0002313184,0.00006740769,0.0002899925,0.0001267256,0.0001804505],"domain_scores_gemma":[0.9968302,0.001532399,0.0000818022,0.0001858881,0.001229312,0.000140512],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002735843,0.0008091379,0.1073734,0.000557812,0.0007880279,0.0005004627,0.000516895,0.5500696,0.005971996,0.002310419,0.04351978,0.2848466],"study_design_scores_gemma":[0.00005973248,0.0000865549,0.0103082,0.00003620519,0.00008534369,0.00003326215,0.0003310595,0.984795,0.001507568,0.0006850254,0.002036631,0.00003535561],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9260305,0.003544598,0.03587903,0.002764259,0.0005195954,0.0003759583,0.01726001,0.004510663,0.009115505],"genre_scores_gemma":[0.9415723,0.0009706334,0.01651847,0.0004863817,0.00005662262,0.0001464052,0.033078,0.0001690428,0.007002203],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.140772,"threshold_uncertainty_score":0.2832021,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1175481210410137,"score_gpt":0.3913340771546693,"score_spread":0.2737859561136556,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}