{"id":"W4364375123","doi":"10.1016/j.eswa.2023.120112","title":"Neural Network-based control using Actor-Critic Reinforcement Learning and Grey Wolf Optimizer with experimental servo system validation","year":2023,"lang":"en","type":"article","venue":"Expert Systems with Applications","topic":"Adaptive Dynamic Programming Control","field":"Computer Science","cited_by":126,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada; Ministry of Education and Research, Romania; Unitatea Executiva pentru Finantarea Invatamantului Superior, a Cercetarii, Dezvoltarii si Inovarii; Corporation for National and Community Service","keywords":"Reinforcement learning; Computer science; Artificial neural network; Particle swarm optimization; Gradient descent; Convergence (economics); Process (computing); Controller (irrigation); Mathematical optimization; Servomechanism; Artificial intelligence; Machine learning; Control engineering; Mathematics; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002945866,0.0008833375,0.0009327244,0.0004718342,0.0005564335,0.0006851752,0.0008308581,0.001307712,0.001880793],"category_scores_gemma":[0.005399694,0.0004038852,0.0004411204,0.0002990795,0.0009616219,0.0006243238,0.000817609,0.001095545,0.0001898857],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009873732,"about_ca_system_score_gemma":0.001155088,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01182806,"about_ca_topic_score_gemma":0.007249158,"domain_scores_codex":[0.9993533,0.0002762162,0.00004552995,0.00007823422,0.0001860954,0.00006058713],"domain_scores_gemma":[0.9968759,0.001718682,0.0002808477,0.0002103506,0.0008568593,0.00005748789],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000185677,0.0001036071,0.0004655233,0.0001422766,0.00004246171,0.00003851455,0.0000676321,0.9782569,0.004492837,0.001690516,0.0002490863,0.01426492],"study_design_scores_gemma":[0.00001523171,0.00004600466,0.0001585258,0.000006204975,0.000005091617,0.000004133199,0.000003320964,0.9979431,0.001587852,0.0001669746,0.00005917253,0.000004389027],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2935678,0.0005894112,0.6955472,0.0003288832,0.0001493587,0.0003450553,0.00008878723,0.0009478498,0.008435732],"genre_scores_gemma":[0.9722214,0.0000464333,0.02645336,0.00001927376,0.000004113007,0.0001172555,0.00003170552,0.00003224178,0.001074292],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01182806,"threshold_uncertainty_score":0.02351844,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01517488254014964,"score_gpt":0.2595307435211804,"score_spread":0.2443558609810307,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}