{"id":"W4315630313","doi":"10.1109/globecom48099.2022.10001396","title":"Reinforcement Learning for Joint V2I Network Selection and Autonomous Driving Policies","year":2022,"lang":"en","type":"article","venue":"GLOBECOM 2022 - 2022 IEEE Global Communications Conference","topic":"Vehicular Ad Hoc Networks (VANETs)","field":"Engineering","cited_by":20,"is_retracted":false,"has_abstract":true,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Markov decision process; Computer science; Acceleration; Base station; Wireless; Reliability (semiconductor); Markov process; Process (computing); Vehicle dynamics; Q-learning; Wireless sensor network; Real-time computing; Network dynamics; Computer network; Artificial intelligence; Telecommunications; Engineering; Automotive engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001733108,0.0009626757,0.001234994,0.0004552231,0.0004184671,0.0007653014,0.001146936,0.001167517,0.001996937],"category_scores_gemma":[0.005325591,0.0005256798,0.0004585941,0.00030982,0.001316631,0.0008971718,0.001014446,0.001520018,0.0002040718],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001693377,"about_ca_system_score_gemma":0.001931113,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01210372,"about_ca_topic_score_gemma":0.007492812,"domain_scores_codex":[0.9993653,0.0002141818,0.00002419695,0.000143397,0.00009219304,0.0001607202],"domain_scores_gemma":[0.9969038,0.00209944,0.0003698112,0.00008337882,0.0003641646,0.0001793183],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003778105,0.00002444405,0.0005753511,0.00001684041,0.00001372504,0.00003156954,0.00002196665,0.9902183,0.0002596175,0.00337001,0.0002300891,0.005200288],"study_design_scores_gemma":[0.000004596044,0.000008921294,0.00004738419,0.000001738124,0.000001963417,0.00000199826,0.000003023943,0.9987468,0.00004370205,0.001095354,0.00004304257,0.000001475538],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0878953,0.0004948227,0.9062629,0.0007181818,0.00006506075,0.00008835586,0.0001003521,0.0003467769,0.004028111],"genre_scores_gemma":[0.9787266,0.0001143646,0.0191004,0.0001161807,0.00002283576,0.00009787394,0.00006181563,0.0000270121,0.001732942],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01210372,"threshold_uncertainty_score":0.02406651,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02395971897213769,"score_gpt":0.2517271623924098,"score_spread":0.2277674434202721,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}