{"id":"W2210922601","doi":"10.14796/jwmm.r227-08","title":"Reservoir Operation Optimization by Reinforcement Learning","year":2007,"lang":"en","type":"article","venue":"Journal of Water Management Modeling","topic":"Water resources management and optimization","field":"Engineering","cited_by":12,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Reinforcement learning; Reinforcement; Computer science; Psychology; Artificial intelligence; Social psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001014562,0.0005735991,0.001076194,0.0003759843,0.0002515235,0.0006420629,0.0007509524,0.0008583242,0.001784979],"category_scores_gemma":[0.003585922,0.0003570566,0.0003614898,0.0004209089,0.0009670748,0.000731424,0.0006897314,0.001052452,0.0002625998],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008993157,"about_ca_system_score_gemma":0.001011245,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007657486,"about_ca_topic_score_gemma":0.004623752,"domain_scores_codex":[0.9996657,0.0001300861,0.00001524368,0.00006246542,0.00006787635,0.00005848094],"domain_scores_gemma":[0.9982759,0.001169602,0.0001876392,0.00007785069,0.0002168746,0.00007216669],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002457079,0.00001423635,0.0002490714,0.00001540031,0.00001126285,0.00001468359,0.00001014457,0.9893292,0.0001554264,0.002281584,0.0002970188,0.007597416],"study_design_scores_gemma":[0.000004449229,0.000006451409,0.00002142,0.000001301656,0.000001298671,0.000001560093,9.247991e-7,0.9985219,0.00003876464,0.001339319,0.00006145702,0.000001151609],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06213059,0.0007965922,0.928191,0.0006489498,0.00009356099,0.00006246727,0.00007318683,0.0005777524,0.00742593],"genre_scores_gemma":[0.9656479,0.0002158663,0.03073522,0.0001064993,0.00004274154,0.00009948025,0.00007217003,0.00002879203,0.003051311],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007657486,"threshold_uncertainty_score":0.01522583,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.009316627540507676,"score_gpt":0.1982349449760692,"score_spread":0.1889183174355616,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}