{"id":"W4402305461","doi":"10.1016/j.ifacol.2024.08.449","title":"A Deep Reinforcement Learning-Based PID Tuning Strategy for Nonlinear MIMO Systems with Time-varying Uncertainty","year":2024,"lang":"en","type":"article","venue":"IFAC-PapersOnLine","topic":"Advanced Control Systems Design","field":"Engineering","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; PID controller; Nonlinear system; MIMO; Control theory (sociology); Computer science; Reinforcement; Control engineering; Artificial intelligence; Engineering; Psychology; Physics; Control (management); Telecommunications; Social psychology; Temperature control","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007618691,0.0006768829,0.0005462226,0.0002025902,0.0002956683,0.0004831269,0.0006982523,0.0006354304,0.00100621],"category_scores_gemma":[0.001348471,0.000293557,0.0003393847,0.0001417703,0.0006566897,0.0004573042,0.000708313,0.000882812,0.0001628316],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005683537,"about_ca_system_score_gemma":0.000945433,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005317905,"about_ca_topic_score_gemma":0.004386417,"domain_scores_codex":[0.9997517,0.00004765799,0.00001638919,0.00006281754,0.0000800921,0.00004123912],"domain_scores_gemma":[0.9995028,0.0002074886,0.00009009866,0.00003150322,0.0001375655,0.00003048194],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004705287,0.00003420598,0.0003265749,0.00004888089,0.00002267839,0.00006612315,0.00004509754,0.9598339,0.006978225,0.003884673,0.0004521064,0.02826045],"study_design_scores_gemma":[0.000004710131,0.0000217629,0.00003694188,0.000002265532,0.000002857817,0.000005445095,0.00000146268,0.9988571,0.0004955435,0.0004209307,0.0001485688,0.000002433349],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02048825,0.0001851981,0.9757599,0.0001639718,0.0000460889,0.00003237697,0.00001478336,0.0002894833,0.003019964],"genre_scores_gemma":[0.9536612,0.00008509925,0.04387078,0.0001322834,0.00002196014,0.00005853501,0.00001940609,0.00002054121,0.002130176],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005317905,"threshold_uncertainty_score":0.01057386,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01324766589085903,"score_gpt":0.2349124473748849,"score_spread":0.2216647814840259,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}