{"id":"W2995894011","doi":"10.1029/2019jd030767","title":"Diagnostic Evaluation of Large‐Domain Hydrologic Models Calibrated Across the Contiguous United States","year":2019,"lang":"en","type":"article","venue":"Journal of Geophysical Research Atmospheres","topic":"Hydrology and Watershed Management Studies","field":"Environmental Science","cited_by":121,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Saskatchewan","funders":"Northwestern Division, U.S. Army Corps of Engineers","keywords":"Evapotranspiration; Environmental science; Calibration; Streamflow; Statistics; Mathematics; Drainage basin; Geography; Ecology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005207295,0.0001251721,0.000288828,0.0000154782,0.0002495791,0.0000344803,0.0005373134,0.00006778505,0.000847046],"category_scores_gemma":[0.0007528216,0.0000712783,0.0001066292,0.0005943821,0.0006653077,0.000323616,0.00047672,0.0004945929,0.0002071276],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001026898,"about_ca_system_score_gemma":0.00003017974,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008807986,"about_ca_topic_score_gemma":0.0001191288,"domain_scores_codex":[0.9960451,0.00121996,0.0003820864,0.0001874548,0.001613704,0.0005516775],"domain_scores_gemma":[0.9975538,0.001632138,0.0002254567,0.0002553983,0.0002409366,0.00009222265],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001082396,0.001372389,0.182585,0.00005709961,0.0006411592,0.00008561848,0.007097951,0.7783473,0.003604444,0.002231282,0.01954482,0.003350543],"study_design_scores_gemma":[0.003759399,0.002487752,0.2445154,0.00008873394,0.0001222729,0.000008228896,0.006139756,0.4925717,0.001175851,0.2436309,0.005235564,0.0002643737],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9958855,0.0001812635,0.0001946988,0.001900195,0.00007446462,0.0004358804,0.000007105743,0.000006792607,0.001314099],"genre_scores_gemma":[0.9991634,0.0001678386,0.00008019833,0.0001922485,0.00004199423,0.00001441706,0.0000045753,0.000009795268,0.0003255544],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2857755,"threshold_uncertainty_score":0.927456,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03777292542406704,"score_gpt":0.3390764025506477,"score_spread":0.3013034771265807,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}