{"id":"W3207692912","doi":"10.1016/j.apenergy.2022.120500","title":"Multi-agent hierarchical reinforcement learning for energy management","year":2022,"lang":"en","type":"article","venue":"Applied Energy","topic":"Smart Grid Energy Management","field":"Engineering","cited_by":97,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University; Group for Research in Decision Analysis","funders":"Trottier Institute for Sustainability in Engineering and Design","keywords":"Reinforcement learning; Computer science; Scheduling (production processes); Novelty; Energy management; Control engineering; Efficient energy use; Distributed computing; Energy (signal processing); Artificial intelligence; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009730097,0.0004930529,0.0008855922,0.0003118874,0.0004099079,0.0005833216,0.0009830212,0.0007220997,0.001897897],"category_scores_gemma":[0.002556117,0.0002795753,0.0003392702,0.0002835553,0.0006801692,0.0006510119,0.0009074187,0.001031316,0.0002523077],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008380258,"about_ca_system_score_gemma":0.0009202259,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007863393,"about_ca_topic_score_gemma":0.006523645,"domain_scores_codex":[0.99962,0.00016312,0.00001726173,0.0000578439,0.00008130603,0.00006055326],"domain_scores_gemma":[0.9990827,0.0005410434,0.0001096539,0.00005571071,0.0001440645,0.00006676894],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003130806,0.00003158767,0.0002158382,0.000020908,0.0000173319,0.00002030168,0.00001714706,0.9830316,0.0003862431,0.004505335,0.0003761926,0.01134621],"study_design_scores_gemma":[0.000003662559,0.000007141535,0.00002331596,9.5993e-7,0.000001363429,0.000001562784,0.000001213948,0.9986448,0.00005176721,0.001202662,0.000060743,9.503358e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0323316,0.0003211977,0.9631174,0.0002600763,0.00006828552,0.00004775957,0.000033613,0.0003511568,0.003468944],"genre_scores_gemma":[0.9481039,0.0001132686,0.04917844,0.00006753007,0.00003045689,0.00007831757,0.0000412585,0.00002455904,0.00236226],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007863393,"threshold_uncertainty_score":0.01563525,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01014517915541733,"score_gpt":0.1966193987083418,"score_spread":0.1864742195529245,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}