{"id":"W2023691900","doi":"10.1029/2007jd008804","title":"Measuring the potential predictability of ensemble climate predictions","year":2008,"lang":"en","type":"article","venue":"Journal of Geophysical Research Atmospheres","topic":"Climate variability and models","field":"Environmental Science","cited_by":60,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Northern British Columbia","funders":"Canadian Foundation for Climate and Atmospheric Sciences","keywords":"Predictability; Forecast skill; Ensemble forecasting; Mean squared error; Statistics; Mathematics; Computer science; Climatology; Environmental science; Econometrics; Machine learning; Geology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002345312,0.0001032501,0.0002524212,0.00001050113,0.0004960594,0.00002242826,0.0005566856,0.0000638007,0.000728713],"category_scores_gemma":[0.0008228064,0.00006472717,0.0002345252,0.0004106455,0.001244046,0.0003354344,0.000422736,0.0006814566,0.00006179194],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001549399,"about_ca_system_score_gemma":0.0001030139,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008931793,"about_ca_topic_score_gemma":0.00008216318,"domain_scores_codex":[0.9966562,0.000453436,0.000531147,0.0001886508,0.001698208,0.0004723038],"domain_scores_gemma":[0.9983826,0.0006488464,0.0001866452,0.0003745516,0.0002048248,0.0002024928],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.003481071,0.007549069,0.4362944,0.0002936475,0.0004256794,0.0002624811,0.007296184,0.1556401,0.3506769,0.002279181,0.02126358,0.01453771],"study_design_scores_gemma":[0.0009308284,0.001310719,0.9495119,0.00008485072,0.00005221185,0.0001602314,0.0007861207,0.02519427,0.005771355,0.01467569,0.001356033,0.00016577],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9952079,0.00006138335,0.0008367665,0.0004549865,0.0001060968,0.0001867628,0.00001051057,0.000009103724,0.003126489],"genre_scores_gemma":[0.9985747,0.000278791,0.0008128618,0.00001289934,0.0001853674,0.000004913747,4.642355e-7,0.000009765631,0.0001202069],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5132175,"threshold_uncertainty_score":0.7978896,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0583190096537498,"score_gpt":0.3002598824649025,"score_spread":0.2419408728111527,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}