{"id":"W3093511015","doi":"10.3390/s20215991","title":"Policy-Gradient and Actor-Critic Based State Representation Learning for Safe Driving of Autonomous Vehicles","year":2020,"lang":"en","type":"article","venue":"Sensors","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Autoencoder; Computer science; Representation (politics); Artificial intelligence; Reinforcement learning; Perception; Scheme (mathematics); Object (grammar); Function (biology); Deep learning; Machine learning; Simulation; Mathematics; Psychology; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009086251,0.0007567728,0.0007319057,0.0003373437,0.0002729735,0.0006917887,0.001026065,0.0008964408,0.001156851],"category_scores_gemma":[0.002295628,0.0005027005,0.0004257413,0.0002706012,0.0007911104,0.0008641977,0.0008799076,0.001409466,0.0002734804],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000866553,"about_ca_system_score_gemma":0.001444217,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006227026,"about_ca_topic_score_gemma":0.004945404,"domain_scores_codex":[0.999631,0.0001044364,0.00001612687,0.00010123,0.00008642475,0.00006077569],"domain_scores_gemma":[0.9993511,0.0002993843,0.00009253606,0.00005277813,0.0001492943,0.00005486665],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003425473,0.00003064749,0.0004136411,0.00002732242,0.00002000087,0.00003907311,0.00004029793,0.9680609,0.001561304,0.004843573,0.0004498851,0.02447911],"study_design_scores_gemma":[0.000001702205,0.000009291646,0.00002879518,0.0000012566,0.000001149728,0.000002902693,0.000001588216,0.9988568,0.0001730542,0.0008363866,0.00008538989,0.000001565504],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01736343,0.0001983119,0.9803147,0.0002017663,0.00004225893,0.00002582197,0.00002424496,0.0004875186,0.00134195],"genre_scores_gemma":[0.9211596,0.0001176712,0.07542698,0.0001227037,0.00002986719,0.00008359972,0.00007916443,0.00006764691,0.002912822],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006227026,"threshold_uncertainty_score":0.01238155,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02501525026013139,"score_gpt":0.2744572081329379,"score_spread":0.2494419578728065,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}