{"id":"W3180273654","doi":"10.2139/ssrn.3708327","title":"Trends in COVID-19 Publications: Streamlining Research Using NLP and LDA","year":2020,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Topic Modeling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"ca_institutions":"Trinity College","funders":"","keywords":"Coronavirus disease 2019 (COVID-19); Natural language processing; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Artificial intelligence; 2019-20 coronavirus outbreak; Computer science; Medicine; Virology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003333013,0.00008761742,0.00012506,0.000491682,0.0002956784,0.0003623803,0.0006875703,0.00005396912,0.00001427253],"category_scores_gemma":[0.0004560531,0.00008596566,0.00003291549,0.00123705,0.00003791514,0.0007312245,0.0002249035,0.001909129,0.000003393471],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008941976,"about_ca_system_score_gemma":0.00306918,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001933871,"about_ca_topic_score_gemma":0.0004244787,"domain_scores_codex":[0.9973053,0.0002284336,0.0002794194,0.0003419064,0.0003715467,0.001473421],"domain_scores_gemma":[0.9992235,0.000126365,0.00007877424,0.0002197123,0.00007898032,0.0002726578],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001536564,0.00003969152,0.009191627,0.00001025114,0.00003198034,0.00001538341,0.003466682,0.003735381,0.0004071463,0.5840463,0.0001243682,0.3989158],"study_design_scores_gemma":[0.00115729,0.0002502182,0.0005221987,0.00003064328,0.000005796944,0.0005599051,0.002533626,0.7304813,0.00002926526,0.2608761,0.003309858,0.0002438786],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.146549,0.003093687,0.814206,0.03554923,0.00005313553,0.00006568935,3.982944e-7,0.00006281085,0.0004200288],"genre_scores_gemma":[0.989952,0.0006609382,0.008575118,0.000515548,0.0001824384,0.000002973791,7.486051e-7,0.000008727099,0.000101568],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8434029,"threshold_uncertainty_score":0.829432,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1657803183038663,"score_gpt":0.4051460986215873,"score_spread":0.239365780317721,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}