{"id":"W4221116189","doi":"10.2196/preprints.36941","title":"Using Reddit data to investigate perspectives on the COVID-19 pandemic using natural language processing: a comparative study of the US, the UK, Canada and Australia (Preprint)","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Misinformation and Its Impacts","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Latent Dirichlet allocation; Social media; Topic model; Pandemic; Public health; Coronavirus disease 2019 (COVID-19); Promotion (chess); Political science; Geography; Public relations; Computer science; Medicine; World Wide Web; Artificial intelligence","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001388482,0.0003474988,0.000295679,0.00382613,0.001490338,0.002070173,0.000860359,0.0006499732,0.001759635],"category_scores_gemma":[0.006907232,0.0002085603,0.0003720206,0.009100598,0.001105623,0.0009340281,0.001201737,0.0007591604,0.0004383683],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01674876,"about_ca_system_score_gemma":0.01277732,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.9709421,"about_ca_topic_score_gemma":0.979879,"domain_scores_codex":[0.9983662,0.000278802,0.0001040847,0.000198411,0.0007290287,0.0003234048],"domain_scores_gemma":[0.9925183,0.002313834,0.0009299846,0.0002444899,0.003341205,0.0006521902],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004725833,0.0004359138,0.8633215,0.0006604543,0.000248055,0.002041031,0.05132068,0.001625422,0.002301603,0.001841212,0.01839332,0.05733825],"study_design_scores_gemma":[0.00001114429,0.00004464256,0.9475686,0.000102739,0.00004696282,0.0001421346,0.03663929,0.001367986,0.0005917185,0.0001007929,0.01331995,0.00006411122],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9747518,0.0006827029,0.0004406602,0.0009879987,0.00002529125,0.0002039082,0.01744556,0.00004180851,0.00542027],"genre_scores_gemma":[0.9771136,0.001031331,0.001627207,0.0004574185,0.00002647768,0.0001544278,0.01667723,0.00004711733,0.002865307],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02905786,"threshold_uncertainty_score":0.1215214,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4219967475732372,"score_gpt":0.4732986068416273,"score_spread":0.05130185926839004,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}