{"id":"W4401587896","doi":"10.1186/s40168-024-01861-6","title":"Fairy: fast approximate coverage for multi-sample metagenomic binning","year":2024,"lang":"en","type":"article","venue":"Microbiome","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Algorithm; Computer science; Metagenomics; Artificial intelligence; Biology; Genetics; Gene","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003247948,0.002296759,0.002215973,0.00313051,0.001843268,0.003279852,0.004062946,0.00183243,0.03671258],"category_scores_gemma":[0.01651784,0.001632376,0.002756926,0.003290669,0.001164826,0.003763828,0.003608871,0.002796671,0.009860567],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002413808,"about_ca_system_score_gemma":0.003213029,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01171059,"about_ca_topic_score_gemma":0.01760979,"domain_scores_codex":[0.9978258,0.0003327872,0.0001482028,0.0007077522,0.0007585871,0.000226932],"domain_scores_gemma":[0.9972344,0.001417271,0.0001738393,0.0005851386,0.0004307832,0.0001586425],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.002894144,0.0003060255,0.01531433,0.002841455,0.001162722,0.000662706,0.001027743,0.1192921,0.03929104,0.03194847,0.1946639,0.5905954],"study_design_scores_gemma":[0.0004870283,0.0001304598,0.004163162,0.0001632354,0.00011996,0.000281958,0.0001699919,0.845055,0.03391303,0.05889596,0.05643023,0.0001899599],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01255277,0.001014852,0.7772064,0.0002769388,0.0003009877,0.0002201386,0.009339306,0.1967718,0.002316704],"genre_scores_gemma":[0.08468401,0.0002832907,0.8589362,0.0005232373,0.0001027282,0.0009867779,0.02049316,0.0304278,0.003562805],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03671258,"threshold_uncertainty_score":0.1228158,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02454039499607893,"score_gpt":0.2697265679046888,"score_spread":0.2451861729086099,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}