{"id":"W4391237386","doi":"10.1109/cvci59596.2023.10397147","title":"Continual Reinforcement Learning for Autonomous Driving with Application on Velocity Control under Various Environment","year":2023,"lang":"en","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Intelligent Mechatronic Systems (Canada); University of Waterloo","funders":"","keywords":"Reinforcement learning; Adaptability; Computer science; Forgetting; Task (project management); Artificial intelligence; Control engineering; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009664107,0.0005396242,0.0004673853,0.0003055164,0.0003323323,0.0004434562,0.0007762508,0.0004977453,0.00104418],"category_scores_gemma":[0.001680562,0.0002168087,0.0003189794,0.0001863752,0.0007537829,0.0004776596,0.0006964072,0.0008656283,0.0001156343],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005786168,"about_ca_system_score_gemma":0.0008309982,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004340989,"about_ca_topic_score_gemma":0.003472254,"domain_scores_codex":[0.9997234,0.00007929123,0.00001431163,0.00006443455,0.00007952873,0.00003911647],"domain_scores_gemma":[0.9992931,0.0003528645,0.00008765268,0.00004928559,0.000164895,0.0000522087],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00006142597,0.0000646249,0.0008768967,0.00005722779,0.00002574013,0.00007110454,0.00007530116,0.9438455,0.003286397,0.006071527,0.0003177341,0.04524649],"study_design_scores_gemma":[0.000004013918,0.00002645397,0.00006606214,0.000001877301,0.000002654068,0.000007409762,0.000002892791,0.9986196,0.0002698381,0.0008476446,0.0001489945,0.000002565622],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04902053,0.0002999102,0.9472947,0.000195684,0.00004535668,0.00004232945,0.00001300135,0.0003369609,0.002751648],"genre_scores_gemma":[0.9743485,0.00009519827,0.02429149,0.00003046759,0.00001510856,0.00004831237,0.00001211354,0.00001293034,0.001145801],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004340989,"threshold_uncertainty_score":0.008631408,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01069531595903084,"score_gpt":0.2272326084609021,"score_spread":0.2165372925018713,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}