{"id":"W4412195443","doi":"10.1002/env.70023","title":"Occupancy Modeling for Rare Species Using Large Datasets: A Subsampling Approach","year":2025,"lang":"en","type":"article","venue":"Environmetrics","topic":"Species Distribution and Climate Change","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Actua; Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Institute for Catastrophic Loss Reduction; Canadian Statistical Sciences Institute; Ontario Ministry of Natural Resources and Forestry","keywords":"Occupancy; Inference; Covariate; Negative binomial distribution; Computer science; Statistics; Sampling (signal processing); Distance sampling; Abundance (ecology); Ecology; Artificial intelligence; Machine learning; Mathematics; Poisson distribution; Biology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0003368109,0.0001905033,0.0002030833,0.0001463594,0.0003904833,0.00007043862,0.0003322031,0.0001118788,0.005418262],"category_scores_gemma":[0.0002163101,0.000193484,0.0001080557,0.0009965682,0.00008428574,0.0002119531,0.0003782868,0.0001316113,0.0001401684],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007083632,"about_ca_system_score_gemma":0.000008935835,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004326941,"about_ca_topic_score_gemma":0.00001435321,"domain_scores_codex":[0.9984922,0.0000245074,0.0002688609,0.0004604337,0.0002711399,0.0004828763],"domain_scores_gemma":[0.9993446,0.00008377475,0.00006945858,0.0004123311,0.000005075803,0.00008470463],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005350516,0.005535692,0.4447227,0.0009915634,0.0004046237,0.0000478281,0.002178465,0.2268377,0.03798888,0.05808258,0.2063043,0.01637052],"study_design_scores_gemma":[0.001608383,0.00003682505,0.01645355,0.00002367625,0.0001231887,0.000008190861,0.004788734,0.5111898,0.001200241,0.0004619728,0.4634064,0.0006990029],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2396409,0.0005151358,0.7450224,0.00006624963,0.0002032925,0.0004435929,0.002453452,0.00006730557,0.01158771],"genre_scores_gemma":[0.9781626,0.0002899336,0.01675672,0.0006196192,0.00007785422,0.00006578094,0.002764879,0.00003570618,0.001226864],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7385218,"threshold_uncertainty_score":0.9954909,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08522441394924438,"score_gpt":0.2984696268860576,"score_spread":0.2132452129368132,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}