{"id":"W1753884649","doi":"10.48550/arxiv.1307.0589","title":"The Orchive : Data mining a massive bioacoustic archive","year":2013,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Music and Audio Processing","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Bioacoustics; Computer science; Data science; Geography; Telecommunications","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001860783,0.001360434,0.001108325,0.005130471,0.001126104,0.002102547,0.002893417,0.00135558,0.00287289],"category_scores_gemma":[0.008039372,0.0004809616,0.0009626752,0.004746697,0.0005475237,0.002180847,0.002485518,0.001507982,0.003524479],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008363218,"about_ca_system_score_gemma":0.001453676,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01135348,"about_ca_topic_score_gemma":0.01813316,"domain_scores_codex":[0.9983618,0.0002052244,0.0001788405,0.0005004692,0.0006501985,0.0001034991],"domain_scores_gemma":[0.9972687,0.0007276522,0.0001583041,0.0009242818,0.0006772539,0.0002436972],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007949757,0.001152184,0.04163594,0.001574175,0.0005292595,0.001740822,0.001138363,0.02844092,0.01973138,0.003857502,0.3694481,0.5299563],"study_design_scores_gemma":[0.0005231507,0.0005882003,0.1023787,0.0003983468,0.0004118745,0.001553749,0.00307357,0.471633,0.04163855,0.0186536,0.3588735,0.0002739173],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"empirical","genre_scores_codex":[0.260886,0.004553549,0.1766811,0.002386836,0.0009051206,0.002538463,0.4521834,0.08447038,0.01539506],"genre_scores_gemma":[0.2068866,0.001360306,0.3025462,0.000368951,0.00027087,0.001314234,0.480389,0.001378618,0.005485071],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01135348,"threshold_uncertainty_score":0.02257484,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1116954153435085,"score_gpt":0.1968003970982075,"score_spread":0.08510498175469901,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}