{"id":"W4406171015","doi":"10.1109/tase.2025.3527327","title":"Behaviorally-Aware Multi-Agent RL With Dynamic Optimization for Autonomous Driving","year":2025,"lang":"en","type":"article","venue":"IEEE Transactions on Automation Science and Engineering","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Autonomous agent; Vehicle dynamics; Control engineering; Engineering; Artificial intelligence; Automotive engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007662227,0.0007270915,0.0006669139,0.0003052631,0.0002647599,0.0005429547,0.000987918,0.0005025831,0.0006361257],"category_scores_gemma":[0.001604032,0.0003700592,0.0004293314,0.0002057297,0.0006289482,0.000520715,0.0009262983,0.0007792109,0.0001473996],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005999877,"about_ca_system_score_gemma":0.0009728855,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005337927,"about_ca_topic_score_gemma":0.003673702,"domain_scores_codex":[0.9997261,0.0000992581,0.00001308033,0.00005232175,0.00006423557,0.00004493111],"domain_scores_gemma":[0.9995552,0.0002081617,0.00008351865,0.00003561794,0.00008020957,0.00003733454],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001475985,0.00002066431,0.0003128751,0.00001273511,0.00001762236,0.00001980385,0.00001836393,0.9881408,0.0007486788,0.001952554,0.0001379317,0.008603196],"study_design_scores_gemma":[0.000001782412,0.000006374649,0.00002248752,6.632042e-7,0.000001290763,0.000001550861,0.000001182805,0.9993652,0.00005531548,0.0004913003,0.00005199948,9.677653e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03563323,0.0002574373,0.9614062,0.0001816328,0.00003584531,0.00003087222,0.00001624512,0.0003576999,0.00208095],"genre_scores_gemma":[0.9594589,0.0000859772,0.03917617,0.00006015666,0.00002030751,0.00006640857,0.00002542623,0.000032559,0.001073944],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005337927,"threshold_uncertainty_score":0.01061368,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01107059958361727,"score_gpt":0.2564603295386846,"score_spread":0.2453897299550673,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}