{"id":"W2341518122","doi":"10.1177/0959683616632881","title":"Calibrating aquatic microfossil proxies with regression-tree ensembles: Cross-validation with modern chironomid and diatom data","year":2016,"lang":"en","type":"article","venue":"The Holocene","topic":"Species Distribution and Climate Change","field":"Environmental Science","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Canadian Institutes of Health Research; Norges Forskningsråd; Suomen Kulttuurirahasto","keywords":"Random forest; Tree (set theory); Diatom; Regression; Computer science; Parametric statistics; Statistics; Artificial intelligence; Ecology; Mathematics; Biology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0002396756,0.0001382475,0.0001105734,0.00001014014,0.0002679007,0.000101446,0.0003266899,0.00003542717,0.001215797],"category_scores_gemma":[0.00003546976,0.00005719435,0.000009455671,0.00009560676,0.0005131849,0.0004176324,0.0003135194,0.00005358464,0.0001115394],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007861557,"about_ca_system_score_gemma":0.00001338311,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001071965,"about_ca_topic_score_gemma":0.0000819952,"domain_scores_codex":[0.9990402,0.00004245616,0.00012757,0.0003302179,0.0001996481,0.0002599128],"domain_scores_gemma":[0.9991601,0.00006329724,0.0001117932,0.0005842037,0.000005867179,0.00007477184],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000409417,0.0001328582,0.9158455,0.00003196187,0.00004119849,0.00001155819,0.001611975,0.00003343691,0.02943064,0.0001781648,0.003701464,0.04857186],"study_design_scores_gemma":[0.001921528,0.0002112638,0.9126039,0.000217738,0.00005139099,0.00007452851,0.001160159,0.001799933,0.08001249,0.0003382783,0.001117198,0.0004916617],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9954137,0.0001155514,0.0009878803,0.001425567,0.00001727841,0.0001885198,0.00008830551,0.00004727637,0.001715928],"genre_scores_gemma":[0.9988683,0.00008798957,0.0002375047,0.0001185917,0.00002333198,0.00001718226,0.00005517698,0.00001465933,0.0005772392],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.05058185,"threshold_uncertainty_score":0.9996972,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03286938657367067,"score_gpt":0.2600920337592939,"score_spread":0.2272226471856232,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}