{"id":"W4388968620","doi":"10.1016/j.enbuild.2023.113760","title":"A transfer learning approach to minimize reinforcement learning risks in energy optimization for automated and smart buildings","year":2023,"lang":"en","type":"article","venue":"Energy and Buildings","topic":"Building Energy and Comfort Optimization","field":"Engineering","cited_by":26,"is_retracted":false,"has_abstract":false,"ca_institutions":"Toronto Metropolitan University; Trent University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Software deployment; Transfer of learning; Computer science; Reinforcement; Artificial intelligence; Building automation; Machine learning; Variance (accounting); Engineering; Software engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0002949735,0.0002646675,0.0002813831,0.0004622006,0.0002307803,0.0000944138,0.0001016144,0.0002051933,0.0000074766],"category_scores_gemma":[0.00004271104,0.0002873356,0.00004819392,0.0007263754,0.00002974908,0.0002736363,0.0000539078,0.000148792,2.529749e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004977368,"about_ca_system_score_gemma":0.00001153091,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002302355,"about_ca_topic_score_gemma":0.000008955952,"domain_scores_codex":[0.998674,0.00003469764,0.0003280205,0.0003883541,0.0001432022,0.0004317505],"domain_scores_gemma":[0.9996223,0.00008807099,0.00003099222,0.00009561786,0.00003792153,0.0001250662],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004513764,0.00001137401,0.0003020893,0.0000589448,0.00003505233,0.000001369809,0.0003764275,0.9811032,0.001340277,0.009818298,0.0002018758,0.006705943],"study_design_scores_gemma":[0.0007934466,0.00007418634,0.0001335612,0.00006764651,0.00002099789,0.000006159766,0.0001116945,0.9799152,0.002322193,0.00006558391,0.01614182,0.0003475144],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1763522,0.0002788958,0.8209051,0.00007795033,0.0001284797,0.000121773,0.000001591449,0.001438,0.0006959839],"genre_scores_gemma":[0.9708397,0.001227174,0.02668032,0.0001376814,0.00006084741,0.0002523961,0.0001681746,0.00008066771,0.0005530822],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7944874,"threshold_uncertainty_score":0.9999579,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01377692013026892,"score_gpt":0.2197594526700507,"score_spread":0.2059825325397818,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}