{"id":"W4223653240","doi":"10.1111/1755-0998.13615","title":"A setback into a success: What can batch effects tell us about best practices in genomics?","year":2022,"lang":"en","type":"article","venue":"Molecular Ecology Resources","topic":"Genetic diversity and population structure","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université Laval","funders":"","keywords":"Population genomics; Biology; Genomics; DNA sequencing; Data science; Inference; Population; Causal inference; Whole genome sequencing; Ecology; Computational biology; Genome; Genetics; Computer science; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2494819,0.002402405,0.0049179,0.004639735,0.006029094,0.02245003,0.009720257,0.01767545,0.005157901],"category_scores_gemma":[0.5344592,0.001973118,0.004206794,0.004745018,0.03665187,0.05540189,0.01105173,0.02747543,0.002851429],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.008220618,"about_ca_system_score_gemma":0.009427705,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01143446,"about_ca_topic_score_gemma":0.01220382,"domain_scores_codex":[0.8568155,0.08722314,0.01070648,0.01482074,0.02738831,0.003045923],"domain_scores_gemma":[0.3365736,0.5367228,0.03929175,0.05264777,0.02883849,0.005925504],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001845735,0.0003566025,0.05957451,0.006872834,0.002895984,0.001297325,0.01870995,0.004864624,0.001536432,0.1510448,0.2184143,0.5325871],"study_design_scores_gemma":[0.0001444352,0.0006488032,0.01927323,0.008221955,0.0009758303,0.0008557361,0.008990606,0.003508304,0.002665956,0.7264707,0.2274501,0.0007942759],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"empirical","genre_scores_codex":[0.01151624,0.07759232,0.06241012,0.8203446,0.01876141,0.0001461697,0.00091593,0.0006615082,0.007651758],"genre_scores_gemma":[0.2240662,0.07382484,0.1209116,0.5403981,0.03133728,0.0007135932,0.001109219,0.002528613,0.005110573],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7505181,"threshold_uncertainty_score":0.9255225,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.007858059042478608,"score_gpt":0.2449686423113842,"score_spread":0.2371105832689056,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}