{"id":"W4396533031","doi":"10.1101/2024.04.26.591384","title":"Refining SARS-CoV-2 Intra-host Variation by Leveraging Large-scale Sequencing Data","year":2024,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"SARS-CoV-2 and COVID-19 Research","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; Mila - Quebec Artificial Intelligence Institute; Montreal Heart Institute","funders":"","keywords":"Host (biology); Scale (ratio); Refining (metallurgy); Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Coronavirus disease 2019 (COVID-19); Biology; Computer science; Geography; Genetics; Medicine; Cartography; Infectious disease (medical specialty)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005608513,0.000950783,0.0008142277,0.002611846,0.0009396251,0.001871282,0.0007543151,0.0007641129,0.0008955559],"category_scores_gemma":[0.01183964,0.0004173434,0.001460275,0.00227704,0.0004372548,0.001089737,0.001379536,0.001197745,0.0007309125],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007188411,"about_ca_system_score_gemma":0.001609636,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007276715,"about_ca_topic_score_gemma":0.01523676,"domain_scores_codex":[0.9976581,0.0006371813,0.0002082397,0.0007575665,0.0005782231,0.0001606658],"domain_scores_gemma":[0.9951343,0.001970246,0.0006251116,0.0008947286,0.001181972,0.0001936576],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","study_design_scores_codex":[0.0009996176,0.0005612239,0.1907719,0.000958018,0.000830863,0.0009807938,0.001810524,0.2565556,0.3586261,0.004939793,0.008575572,0.1743899],"study_design_scores_gemma":[0.00007435054,0.0002831557,0.06881259,0.0001498069,0.0002642893,0.0004462071,0.0007235117,0.771253,0.1300608,0.01149554,0.0162541,0.000182634],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6812437,0.0009510677,0.300209,0.000556212,0.0001333629,0.0003489594,0.007648894,0.006425614,0.00248323],"genre_scores_gemma":[0.658836,0.0003475719,0.3240674,0.0002854569,0.00005651425,0.0002071108,0.01430359,0.001042074,0.0008542113],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.007276715,"threshold_uncertainty_score":0.029661,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05660435609367723,"score_gpt":0.3135371481704794,"score_spread":0.2569327920768021,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}