{"id":"W4415933731","doi":"10.1371/journal.pone.0336142","title":"Evaluating machine learning approaches for host prediction using H3 influenza genomic data","year":2025,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Influenza Virus Research Studies","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Guelph","funders":"Ontario Veterinary College, University of Guelph","keywords":"Host (biology); Identification (biology); Training set; Transmission (telecommunications); Predictive modelling; Influenza A virus","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01581696,0.002486612,0.001118035,0.003217991,0.0007607783,0.001600216,0.001628189,0.001802918,0.0009288874],"category_scores_gemma":[0.02208393,0.0005141439,0.001735604,0.001645742,0.0006112485,0.001927547,0.001314731,0.002295705,0.0005280018],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00204891,"about_ca_system_score_gemma":0.001495139,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01459246,"about_ca_topic_score_gemma":0.009054999,"domain_scores_codex":[0.9953809,0.002461458,0.0003961955,0.0007760514,0.0007277427,0.0002576736],"domain_scores_gemma":[0.9747857,0.02034893,0.0009622477,0.0008731623,0.002574114,0.0004557967],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000836472,0.0007236528,0.06192257,0.0003547443,0.0009772137,0.0001167783,0.0001088973,0.8573115,0.0008769575,0.0004679261,0.002070656,0.07423263],"study_design_scores_gemma":[0.00002154986,0.0003271973,0.003431816,0.00004270524,0.00005990241,0.00002547152,0.00005350219,0.994574,0.0007274581,0.000500888,0.0002230377,0.00001258055],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9226607,0.00657285,0.05907606,0.001672353,0.0003959173,0.0004569824,0.002419029,0.001903143,0.004842999],"genre_scores_gemma":[0.9589352,0.0006627236,0.03668338,0.0001997986,0.00009745638,0.0001542991,0.002528207,0.00005951738,0.0006792705],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01581696,"threshold_uncertainty_score":0.08364904,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6727196062943223,"score_gpt":0.464951591596609,"score_spread":0.2077680146977133,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}