{"id":"W4308140687","doi":"10.1142/s0219843622500219","title":"Reinforcement Learning for Bipedal Gait with MAX-E2 Humanoid Robot","year":2022,"lang":"en","type":"article","venue":"International Journal of Humanoid Robotics","topic":"Robotic Locomotion and Control","field":"Engineering","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université du Québec à Trois-Rivières","funders":"Mitacs","keywords":"Humanoid robot; Reinforcement learning; Computer science; Gait; Robot; Parametric statistics; Q-learning; Artificial intelligence; Simulation","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005062536,0.0005142147,0.0004649428,0.0001862014,0.0002264782,0.0003376685,0.0004800482,0.0004963079,0.001179767],"category_scores_gemma":[0.001087084,0.0001730395,0.000256906,0.0001397813,0.0004725861,0.0003416481,0.0006334145,0.0003959725,0.000149958],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003062559,"about_ca_system_score_gemma":0.0003996228,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002620224,"about_ca_topic_score_gemma":0.001118984,"domain_scores_codex":[0.9998465,0.00005647865,0.00000708011,0.00003390208,0.00002953539,0.00002657751],"domain_scores_gemma":[0.9996864,0.0001331333,0.00006256317,0.00003585821,0.00005616621,0.00002601215],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000771979,0.00003389684,0.0004926038,0.00004371218,0.00001685843,0.00008788056,0.00004188021,0.9770679,0.002889678,0.003513248,0.0002098543,0.01552529],"study_design_scores_gemma":[0.000008643784,0.00005616558,0.00008423495,0.000001840761,0.000001817363,0.00001283643,0.000003465398,0.9983966,0.0003237925,0.001007232,0.0001009213,0.000002437266],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1215723,0.0001697793,0.8739342,0.0001666858,0.00002486075,0.00005503208,0.0000340034,0.0004119102,0.003631132],"genre_scores_gemma":[0.9759393,0.00003516602,0.02306823,0.00002754186,0.00000451826,0.00005250156,0.00001742828,0.00001032623,0.0008449965],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002620224,"threshold_uncertainty_score":0.005209923,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01085213223107623,"score_gpt":0.2290392555915959,"score_spread":0.2181871233605197,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}