{"id":"W4391925924","doi":"10.21203/rs.3.rs-3912968/v1","title":"Demystifying COVID-19 Mortality Causes with Interpretable Data Mining","year":2024,"lang":"en","type":"preprint","venue":"Research Square","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"National Key Research and Development Program of China; Shanghai Municipal Health Commission","keywords":"Coronavirus disease 2019 (COVID-19); Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); 2019-20 coronavirus outbreak; Data mining; Computer science; Data science; Geography; Virology; Medicine; Internal medicine; Outbreak; Infectious disease (medical specialty)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","scholarly_communication","open_science","research_integrity"],"consensus_categories":["open_science"],"category_scores_codex":[0.009311806,0.0004734471,0.0006021549,0.0008596558,0.0006485962,0.002100467,0.008240868,0.0004023622,0.0001209711],"category_scores_gemma":[0.005917212,0.0003991361,0.00009332506,0.00145669,0.0002829519,0.0004182104,0.04162562,0.005934633,0.0001789398],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009326421,"about_ca_system_score_gemma":0.006855996,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01206119,"about_ca_topic_score_gemma":0.003097564,"domain_scores_codex":[0.989967,0.002347277,0.0006017522,0.002968095,0.002748665,0.001367242],"domain_scores_gemma":[0.9887313,0.002327133,0.0001904862,0.007232187,0.0005775241,0.0009414152],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002348632,0.000444993,0.5467466,0.1416204,0.001634891,0.0107334,0.04385605,0.05095755,0.00006200892,0.05498365,0.08255439,0.06617129],"study_design_scores_gemma":[0.0002999806,0.000336224,0.00710177,0.007181733,0.00005281172,0.0001449449,0.001114599,0.9389811,0.00002708007,0.01734764,0.02637146,0.001040634],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2249882,0.02831886,0.6234465,0.08335187,0.004952119,0.008821635,0.002319779,0.00719235,0.01660873],"genre_scores_gemma":[0.9583388,0.0001860579,0.03906049,0.0003947771,0.0004571711,0.0003058036,0.0004133205,0.0001013034,0.0007422771],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8880236,"threshold_uncertainty_score":0.999846,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.370068581574596,"score_gpt":0.5434794758159253,"score_spread":0.1734108942413292,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}