{"id":"W3046590403","doi":"10.1016/j.ibmed.2024.100137","title":"Reinforcement learning in large, structured action spaces: A simulation study of decision support for spinal cord injury rehabilitation","year":2024,"lang":"en","type":"article","venue":"Intelligence-Based Medicine","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Parkwood Institute; Lawson Health Research Institute; Western University","funders":"","keywords":"Rehabilitation; Reinforcement; Reinforcement learning; Spinal cord injury; Action (physics); Physical medicine and rehabilitation; Psychology; Spinal cord; Computer science; Medicine; Artificial intelligence; Neuroscience; Social psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001701178,0.0002115334,0.0003262834,0.0008432833,0.00008895335,0.00006404927,0.0003714508,0.00009621832,0.00007726632],"category_scores_gemma":[0.001663419,0.000179065,0.00006987192,0.001096912,0.00006369186,0.0003946826,0.00006930427,0.0003180831,0.000008208588],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002586713,"about_ca_system_score_gemma":0.0001927656,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00006843692,"about_ca_topic_score_gemma":0.00004075117,"domain_scores_codex":[0.9973195,0.0001165932,0.0009693058,0.0004879084,0.0008029726,0.0003037243],"domain_scores_gemma":[0.9975431,0.001393526,0.0002739761,0.0004151,0.0002988707,0.00007545685],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008189044,0.00006973951,0.001084012,0.0002341903,0.0000144889,0.000006456436,0.002207323,0.8586097,0.0002312038,0.001760442,0.00003776443,0.1349257],"study_design_scores_gemma":[0.000727641,0.02351592,0.001196404,0.0006857569,0.00002912275,0.000001155378,0.001932956,0.9682125,0.0007612547,0.0009398732,0.001843114,0.0001543367],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06275293,0.00004962846,0.9345285,0.0002536876,0.000962628,0.001247031,6.815404e-7,0.0001405124,0.00006442978],"genre_scores_gemma":[0.984736,0.00000922272,0.01485448,0.00006245957,0.0001001128,0.00006500955,0.00002532837,0.00001782654,0.0001295866],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9219831,"threshold_uncertainty_score":0.7302057,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05463180441145013,"score_gpt":0.399762031456585,"score_spread":0.3451302270451349,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}