{"id":"W4387328229","doi":"10.1101/2023.10.03.560722","title":"Drug Discovery in Low Data Regimes: Leveraging a Computational Pipeline for the Discovery of Novel SARS-CoV-2 Nsp14-MTase Inhibitors","year":2023,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Vector Institute; Canadian Institute for Advanced Research; Structural Genomics Consortium; Ontario Institute for Cancer Research; University of Toronto","funders":"Army Research Laboratory; National Institutes of Health; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; Canada First Research Excellence Fund; Helmholtz-Zentrum Berlin für Materialien und Energie; University of Toronto; European Commission; École de technologie supérieure; National Science Foundation; Compute Canada; Damon Runyon Cancer Research Foundation; Natural Resources Canada; Nvidia","keywords":"Computational biology; Drug discovery; Biology; Protein Data Bank (RCSB PDB); Function (biology); Genome; Coronavirus disease 2019 (COVID-19); Pipeline (software); Gene; Computer science; Genetics; Bioinformatics; Biochemistry; Infectious disease (medical specialty)","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001361187,0.001336899,0.002070406,0.0009677791,0.0005560263,0.001607033,0.001776555,0.001181303,0.002670744],"category_scores_gemma":[0.003395444,0.0006611705,0.00148275,0.0009427085,0.0006196264,0.001312722,0.001089996,0.001502779,0.000437036],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000944243,"about_ca_system_score_gemma":0.003522901,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008335581,"about_ca_topic_score_gemma":0.01162099,"domain_scores_codex":[0.9996532,0.0001378987,0.00002315766,0.00005120117,0.00008297426,0.00005158577],"domain_scores_gemma":[0.9989593,0.0006630516,0.00007260232,0.00008905149,0.0001152703,0.0001006725],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003406806,0.0002694634,0.002449671,0.0001932118,0.0001566236,0.0002043731,0.00003805968,0.9741151,0.001548291,0.003696361,0.001531874,0.01545617],"study_design_scores_gemma":[0.00009221888,0.0000577716,0.00008152362,0.000004695094,0.00002621962,0.000008891311,0.000008608144,0.9973827,0.0003392245,0.001503144,0.0004901798,0.000004783785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6225686,0.003607887,0.3325201,0.005370905,0.0003843501,0.0009000212,0.004688489,0.008872421,0.02108719],"genre_scores_gemma":[0.7620209,0.001560918,0.2276026,0.0008417897,0.0001126485,0.0009591845,0.004593413,0.0003327294,0.00197586],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.008335581,"threshold_uncertainty_score":0.01657414,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07120104289483209,"score_gpt":0.3097856783897418,"score_spread":0.2385846354949097,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}