{"id":"W4407997333","doi":"10.1016/j.est.2025.115428","title":"Deep reinforcement learning for economic battery dispatch: A comprehensive comparison of algorithms and experiment design choices","year":2025,"lang":"en","type":"article","venue":"Journal of Energy Storage","topic":"Microgrid Control and Optimization","field":"Engineering","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"Faculty of Engineering, McGill University","keywords":"Reinforcement learning; Economic dispatch; Computer science; Battery (electricity); Artificial intelligence; Machine learning; Reinforcement; Mathematical optimization; Engineering; Mathematics; Power (physics); Electric power system; Structural engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01853234,0.001424515,0.001248703,0.0008696683,0.0003776325,0.001279875,0.001421531,0.001564716,0.001922195],"category_scores_gemma":[0.0480585,0.0004909667,0.001011904,0.000847311,0.001034793,0.002503528,0.001364436,0.00223623,0.0003669978],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001775384,"about_ca_system_score_gemma":0.001747905,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002532999,"about_ca_topic_score_gemma":0.002738904,"domain_scores_codex":[0.9913868,0.006294856,0.0004522842,0.0007671146,0.0008738096,0.0002250335],"domain_scores_gemma":[0.9545953,0.03861514,0.001583392,0.003072718,0.001726936,0.0004065782],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003189983,0.001700948,0.008608889,0.001593241,0.0007971629,0.00007730035,0.000110969,0.7702926,0.002111288,0.01919848,0.004870486,0.1874487],"study_design_scores_gemma":[0.0009550508,0.001530808,0.00273452,0.000284476,0.0002410074,0.00004528901,0.00007429851,0.9634779,0.00298658,0.02344271,0.004161319,0.00006606784],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3877283,0.01536224,0.5705296,0.003563107,0.0004916323,0.002020552,0.002830746,0.002876726,0.01459715],"genre_scores_gemma":[0.7653284,0.002400547,0.2249918,0.001013575,0.0001064427,0.001977827,0.002070636,0.0002816513,0.00182907],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01853234,"threshold_uncertainty_score":0.09800959,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0147327854247463,"score_gpt":0.2488367015405714,"score_spread":0.2341039161158252,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}