{"id":"W4414734237","doi":"10.1007/978-3-031-95111-4_12","title":"Predicting Road User Behavior Using Inverse Reinforcement Learning: Potentials for Applications in Autonomous Vehicles","year":2025,"lang":"en","type":"book-chapter","venue":"Lecture notes in civil engineering","topic":"Traffic control and management","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Intuition; Software deployment; Adversarial system; Reinforcement learning; Process (computing); Collision avoidance; Pedestrian; Human behavior","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0001688347,0.0005020926,0.0005304522,0.0006788712,0.00005738477,0.00005411916,0.0002243417,0.0003975449,0.00003172189],"category_scores_gemma":[0.00006437822,0.000591984,0.0001732053,0.0001278634,0.00001493537,0.00008058054,0.00009432207,0.0007127963,0.000002245629],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005423377,"about_ca_system_score_gemma":0.0000431061,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000711731,"about_ca_topic_score_gemma":0.001103627,"domain_scores_codex":[0.9983363,0.00000561178,0.0006157059,0.0004059878,0.0001723447,0.0004640261],"domain_scores_gemma":[0.9993413,0.0001725026,0.00008443643,0.0003051852,0.00003425521,0.0000623372],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000005007846,0.000009650682,0.0001251611,0.0005307854,0.00008597365,0.000009106414,0.0001338783,0.9806662,0.0006638365,0.0008888746,0.00001444139,0.01686706],"study_design_scores_gemma":[0.0006970922,0.00002437432,0.0002921296,0.0006753724,0.0002052666,0.000002007313,0.000006569906,0.9636346,0.0001582973,0.0001412549,0.03356754,0.0005954822],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.002346889,0.001847997,0.9831337,0.00003127509,0.0007603228,0.003085671,0.00003016847,0.0009894853,0.00777448],"genre_scores_gemma":[0.9901733,0.0001708139,0.004319983,0.00003208549,0.000320674,0.0008907358,0.0001534032,0.0002078815,0.003731093],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9878265,"threshold_uncertainty_score":0.9996532,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.009366324154898175,"score_gpt":0.2107360903354535,"score_spread":0.2013697661805553,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}