{"id":"W4317213717","doi":"10.1128/mra.01079-22","title":"Deep6: Classification of Metatranscriptomic Sequences into Cellular Empires and Viral Realms Using Deep Learning Models","year":2023,"lang":"en","type":"article","venue":"Microbiology Resource Announcements","topic":"Bacteriophages and microbial interactions","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Fisheries and Oceans Canada; Tula Foundation; University of British Columbia","funders":"Hakai Institute; University of British Columbia; Tula Foundation; Gordon and Betty Moore Foundation","keywords":"Deep learning; Sequence (biology); Range (aeronautics); Computational biology; Artificial intelligence; Biology; Nucleotide; Computer science; Genetics; Gene; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000242094,0.0001519023,0.0002006624,0.00008639741,0.0003786226,0.00002024521,0.0001749338,0.0001086735,0.0001507591],"category_scores_gemma":[0.000008761185,0.0001436157,0.00005859065,0.0002313469,0.0003709583,0.0002250682,0.0002015598,0.00015374,0.00005110085],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0000917615,"about_ca_system_score_gemma":0.00000801276,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006765085,"about_ca_topic_score_gemma":0.0001144226,"domain_scores_codex":[0.9988716,0.0001224235,0.0003036426,0.0003589194,0.0000567102,0.0002867633],"domain_scores_gemma":[0.9996083,0.00002248031,0.000160325,0.0001518415,0.00001234794,0.00004464535],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00002640911,0.00002758676,0.003595629,0.00001149466,0.00003595033,0.000002450234,0.002067704,0.003394057,0.9890534,0.00001077974,0.0001812212,0.001593363],"study_design_scores_gemma":[0.002968735,0.001481289,0.02537764,0.0002943305,0.0005537345,0.0002302465,0.01160882,0.1115912,0.3193527,0.001976022,0.5225114,0.002053835],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.998023,0.0001709225,0.0008974324,0.0001055731,0.00008808043,0.000155257,0.0000542024,0.00004722872,0.0004582717],"genre_scores_gemma":[0.997969,0.0000855374,0.0007536841,0.00008494007,0.00001824037,0.000008825922,0.0004678034,0.00001479857,0.0005971295],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6697006,"threshold_uncertainty_score":0.5856479,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03615802309286137,"score_gpt":0.2639383703584047,"score_spread":0.2277803472655433,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}