{"id":"W3104327413","doi":"10.1145/3388440.3412418","title":"Global Surveillance of COVID-19 by mining news media using a multi-source dynamic embedded topic model","year":2020,"lang":"en","type":"article","venue":"","topic":"Misinformation and Its Impacts","field":"Social Sciences","cited_by":21,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Topic model; Computer science; Social media; News media; Framing (construction); Inference; Latent Dirichlet allocation; Classifier (UML); Digital media; Data science; Artificial intelligence; Machine learning; World Wide Web; Political science","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003278909,0.001289566,0.0009671836,0.003985848,0.0004549634,0.001696446,0.001600993,0.001596227,0.000945929],"category_scores_gemma":[0.009603142,0.0007718237,0.001452471,0.002455975,0.0005948067,0.003018112,0.00136312,0.002193692,0.0006761467],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008018012,"about_ca_system_score_gemma":0.0006865868,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01150524,"about_ca_topic_score_gemma":0.01193764,"domain_scores_codex":[0.9988194,0.000411598,0.00009520452,0.0004278531,0.0001569729,0.00008893414],"domain_scores_gemma":[0.9912287,0.00655278,0.0009736934,0.0004795017,0.0005864995,0.0001788452],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009764693,0.0008766113,0.1399247,0.001246234,0.0008786032,0.001382683,0.002030846,0.5766571,0.00815,0.02310641,0.02289991,0.2218705],"study_design_scores_gemma":[0.00002332437,0.00003745789,0.006074439,0.00002942471,0.00005071572,0.00007164147,0.00009141541,0.9875292,0.0006609811,0.003547812,0.001861032,0.00002257862],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.545966,0.004703945,0.4151307,0.005648123,0.0006784331,0.0004888719,0.01824614,0.00316083,0.005977045],"genre_scores_gemma":[0.8836511,0.001459214,0.08757632,0.0003457209,0.0008078406,0.0002648862,0.02295028,0.000170914,0.002773724],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01150524,"threshold_uncertainty_score":0.02287656,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09761497201716676,"score_gpt":0.3834688836502118,"score_spread":0.285853911633045,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}