{"id":"W4390035554","doi":"10.1101/2023.12.19.572447","title":"Reinforcement Learning for Control of Human Locomotion in Simulation","year":2023,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Prosthetics and Rehabilitation Robotics","field":"Engineering","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Rehabilitation Institute; University of Toronto","funders":"Toronto Rehabilitation Institute; AGE-WELL","keywords":"Reinforcement learning; Computer science; Exoskeleton; Artificial intelligence; Imitation; Action (physics); Robot; Simulation","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001456192,0.0005456645,0.0007416275,0.0003155016,0.0002853947,0.0004871599,0.001013502,0.0007101677,0.001685339],"category_scores_gemma":[0.004733362,0.0003878422,0.0003614755,0.0002124093,0.0008102425,0.000593702,0.0007638522,0.001079144,0.0002433433],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001080674,"about_ca_system_score_gemma":0.001133757,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009757855,"about_ca_topic_score_gemma":0.005531234,"domain_scores_codex":[0.9997079,0.0001320576,0.00001693251,0.00004193031,0.00006324529,0.00003791666],"domain_scores_gemma":[0.9979591,0.001446208,0.0001236339,0.0001090509,0.0002848911,0.0000770749],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001558741,0.00001021564,0.0001326817,0.00001097392,0.0000055976,0.000006279257,0.000008773475,0.9940188,0.0002580721,0.0009337495,0.00005950337,0.004539709],"study_design_scores_gemma":[0.000001746847,0.000002994918,0.000008241969,7.28996e-7,3.431469e-7,4.4421e-7,4.333137e-7,0.9996797,0.00005704472,0.0002266691,0.00002129691,4.021627e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05434123,0.0001839621,0.9429061,0.0002595343,0.00003662393,0.00005100333,0.00002513969,0.0006702641,0.001526103],"genre_scores_gemma":[0.9044198,0.00007340744,0.09420588,0.00007743854,0.00001380693,0.0001227832,0.00004451801,0.00006783766,0.0009745926],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009757855,"threshold_uncertainty_score":0.01940209,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01727358426663469,"score_gpt":0.2411089147021429,"score_spread":0.2238353304355082,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}