{"id":"W3081650381","doi":"10.1109/sege49949.2020.9181985","title":"Multi-advisor Deep Reinforcement Learning for Thermostatically Controlled Heating in Smart Homes","year":2020,"lang":"en","type":"article","venue":"","topic":"Smart Grid Energy Management","field":"Engineering","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"Lakehead University","funders":"","keywords":"Reinforcement learning; Computer science; Weighting; Schedule; Energy consumption; Set point; Set (abstract data type); Reduction (mathematics); Control (management); Demand response; Artificial intelligence; Machine learning; Engineering; Control engineering; Electricity; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001897928,0.0001758881,0.0003220477,0.00006729877,0.00004491651,0.00004124541,0.0001195788,0.00004032696,0.0001690335],"category_scores_gemma":[0.0002425403,0.0001598783,0.00008253418,0.000144044,0.00001082113,0.00008586959,0.00004747881,0.0001269025,0.0000323841],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006655019,"about_ca_system_score_gemma":0.000007153498,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002181989,"about_ca_topic_score_gemma":0.00004198171,"domain_scores_codex":[0.998916,0.0000242055,0.0003997503,0.0001857689,0.0001349846,0.0003392727],"domain_scores_gemma":[0.9995584,0.0001952731,0.0000282741,0.0001021345,0.00002462872,0.00009127149],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00007733324,0.00001031481,0.0009510381,0.00008193182,0.00007768701,0.000003272092,0.0005262887,0.9942514,0.001199148,0.000615259,0.0002424685,0.001963902],"study_design_scores_gemma":[0.00591321,0.00009208161,0.0009224916,0.00001675646,0.00001586396,1.68902e-7,0.0004754378,0.9886044,0.0005472073,0.00001116155,0.003210346,0.0001908944],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02343727,0.0001048927,0.9648578,0.000745349,0.0001640081,0.0009069764,2.422611e-7,0.0005222032,0.009261209],"genre_scores_gemma":[0.9774225,0.00002643962,0.02108502,0.000596115,0.00007214031,0.0003088061,0.00001330567,0.00004960288,0.0004260501],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9539853,"threshold_uncertainty_score":0.6519647,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01579870547014811,"score_gpt":0.2236927800176281,"score_spread":0.20789407454748,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}