{"id":"W2507770958","doi":"10.1093/bioinformatics/btw400","title":"LCA*: an entropy-based measure for taxonomic assignment within assembled metagenomes","year":2016,"lang":"en","type":"article","venue":"Bioinformatics","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":34,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Taxonomic rank; Taxonomy (biology); Voting; Phylogenetic tree; Data mining; Information retrieval; Machine learning; Biology; Ecology; Genetics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003303275,0.000207032,0.0002027479,0.00004219076,0.0001172944,0.00003680978,0.0002290879,0.0001135463,0.00001014059],"category_scores_gemma":[0.00007058845,0.0001397819,0.0001277917,0.00003161241,0.00004496681,0.000003384637,0.00006118968,0.00002655356,0.00001650443],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003427744,"about_ca_system_score_gemma":0.0001376432,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000002226123,"about_ca_topic_score_gemma":0.00001857196,"domain_scores_codex":[0.9989876,0.00002737395,0.0003742266,0.0002002302,0.0001218524,0.0002887898],"domain_scores_gemma":[0.9991403,0.0000272558,0.0001988349,0.0004158707,0.0001042935,0.0001135065],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0001537384,0.00007726355,0.001359757,0.00005090232,0.0002280136,2.969826e-7,0.0001202115,0.0004468536,0.9872627,0.0005507139,0.002048608,0.007700996],"study_design_scores_gemma":[0.003940542,0.001564512,0.002101261,0.00003515479,0.0001585943,0.000005208736,0.0003619796,0.004184112,0.8359498,0.000303292,0.1506156,0.0007799701],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7488962,0.0005505405,0.2474552,0.0003800883,0.0005071866,0.001037662,0.0002550193,0.00001999827,0.0008981111],"genre_scores_gemma":[0.9505594,0.00004712846,0.04851375,0.0003038179,0.0001697555,0.0001175778,0.0000462611,0.00002436003,0.0002179591],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2016632,"threshold_uncertainty_score":0.5700142,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02568471845788952,"score_gpt":0.2416481304674724,"score_spread":0.2159634120095829,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}