{"id":"W7092316242","doi":"","title":"Big Data Approaches to Bovine Bioacoustics: A FAIR-Compliant Dataset and Scalable ML Framework for Precision Livestock Welfare","year":2025,"lang":"","type":"article","venue":"ArXiv.org","topic":"Animal Vocal Communication and Behavior","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Mitacs; Dalhousie University; Dairy Farmers of Nova Scotia; Department of Agriculture, Nova Scotia","keywords":"Big data; Variety (cybernetics); Feature (linguistics); Field (mathematics); Animal welfare; Subject-matter expert; Scalability; Scale (ratio)","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004950635,0.001647414,0.001057064,0.002359133,0.0009826528,0.00308361,0.004622058,0.001517257,0.00325011],"category_scores_gemma":[0.0165975,0.0006852598,0.001553881,0.002076236,0.001241359,0.003946863,0.00713098,0.002462141,0.002856123],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001178145,"about_ca_system_score_gemma":0.002271367,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00988216,"about_ca_topic_score_gemma":0.01841679,"domain_scores_codex":[0.9968423,0.0006194338,0.0002819357,0.0009849255,0.001059767,0.0002116175],"domain_scores_gemma":[0.9954828,0.001047182,0.0002472788,0.001923367,0.0009025829,0.0003967121],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001738807,0.001109748,0.02865137,0.001591128,0.0008497337,0.0009817878,0.001964087,0.1036883,0.05909232,0.04883816,0.331352,0.4201426],"study_design_scores_gemma":[0.0002622169,0.0003193426,0.01540476,0.0002132838,0.0001167206,0.0003381954,0.0009745634,0.7230172,0.0198025,0.08104071,0.1583242,0.0001863048],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"dataset","genre_scores_codex":[0.01841095,0.001079177,0.7879466,0.002269923,0.0004819048,0.0006903435,0.06481425,0.1201265,0.004180323],"genre_scores_gemma":[0.149954,0.0005456567,0.5835729,0.001258179,0.000212966,0.001546453,0.2548915,0.004843147,0.003175367],"genre_candidate":"dataset","genre_consensus":null,"teacher_disagreement_score":0.00988216,"threshold_uncertainty_score":0.02618176,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2792637771079751,"score_gpt":0.3521362379885699,"score_spread":0.07287246088059485,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}