{"id":"W4296558883","doi":"10.1109/adconip55568.2022.9894150","title":"Meta-Reinforcement Learning for Adaptive Control of Second Order Systems","year":2022,"lang":"en","type":"article","venue":"","topic":"Advanced Control Systems Optimization","field":"Engineering","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"Honeywell (Canada); University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Computer science; Leverage (statistics); Process (computing); Controller (irrigation); Meta learning (computer science); Key (lock); Artificial intelligence; Machine learning; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001251651,0.001049861,0.001126873,0.0004732896,0.00033068,0.001013328,0.001105463,0.001151263,0.002105871],"category_scores_gemma":[0.002699878,0.0003986824,0.0006730459,0.0004438275,0.001169562,0.0007837689,0.0009498725,0.001913586,0.0002813755],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001284393,"about_ca_system_score_gemma":0.001095151,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003656261,"about_ca_topic_score_gemma":0.003128856,"domain_scores_codex":[0.999542,0.0001607902,0.00002191397,0.00007181353,0.0001488177,0.0000546561],"domain_scores_gemma":[0.9989753,0.0005892438,0.0001457534,0.00009106708,0.000146354,0.00005231118],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002212459,0.00001713238,0.0001669263,0.00004299324,0.00002757788,0.0000275803,0.00002232186,0.9741034,0.0006946723,0.01548573,0.0002796153,0.009110041],"study_design_scores_gemma":[0.000004731702,0.00001372322,0.00002390992,0.000003762637,0.000002416438,0.000003410803,0.000001192962,0.9952537,0.0001117937,0.00435183,0.0002275088,0.00000205598],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.009465992,0.000816851,0.9853468,0.0003747435,0.00006571459,0.00002998107,0.00003305729,0.0002773405,0.003589524],"genre_scores_gemma":[0.9250097,0.0005204224,0.07093266,0.0001209389,0.00009366329,0.000162554,0.00005156197,0.00006213775,0.003046417],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003656261,"threshold_uncertainty_score":0.009318948,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01809623477758406,"score_gpt":0.2089249018463832,"score_spread":0.1908286670687991,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}