{"id":"W4315630313","doi":"10.1109/globecom48099.2022.10001396","title":"Reinforcement Learning for Joint V2I Network Selection and Autonomous Driving Policies","year":2022,"lang":"en","type":"article","venue":"GLOBECOM 2022 - 2022 IEEE Global Communications Conference","topic":"Vehicular Ad Hoc Networks (VANETs)","field":"Engineering","cited_by":20,"is_retracted":false,"has_abstract":true,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Markov decision process; Computer science; Acceleration; Base station; Wireless; Reliability (semiconductor); Markov process; Process (computing); Vehicle dynamics; Q-learning; Wireless sensor network; Real-time computing; Network dynamics; Computer network; Artificial intelligence; Telecommunications; Engineering; Automotive engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","sts"],"consensus_categories":[],"category_scores_codex":[0.0006672733,0.0003106186,0.0003535207,0.00008848966,0.001805885,0.0001861541,0.0009436719,0.00008281522,0.0002938002],"category_scores_gemma":[0.00005271388,0.0004067494,0.0001204745,0.0007708876,0.00009684994,0.0001921206,0.001042431,0.0008150294,0.00001255659],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001016034,"about_ca_system_score_gemma":0.0001500672,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003011247,"about_ca_topic_score_gemma":0.001081523,"domain_scores_codex":[0.9978209,0.0002883518,0.0005370163,0.000345513,0.000310738,0.0006974504],"domain_scores_gemma":[0.9984619,0.0001450371,0.0001647512,0.0009575264,0.0001141002,0.000156664],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000009069707,0.00002525684,0.001225044,0.00002453843,0.00009982372,8.787247e-7,0.0002156545,0.971176,0.0003225905,0.01130233,0.009597367,0.006001424],"study_design_scores_gemma":[0.0003326993,0.0001295877,0.001226329,0.00002490825,0.00005309382,0.00005438057,0.000410905,0.8796818,0.00003104776,0.001153391,0.1165378,0.0003641251],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3550004,0.01814865,0.5542154,0.005219117,0.004833597,0.006344876,0.0004065082,0.005245954,0.05058547],"genre_scores_gemma":[0.9932947,0.001038496,0.004206205,0.0001627765,0.0001177721,0.0004624656,0.0003023308,0.00004316479,0.0003721103],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.6382942,"threshold_uncertainty_score":0.9998384,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02395971897213769,"score_gpt":0.2517271623924098,"score_spread":0.2277674434202721,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}