{"id":"W3035417664","doi":"10.48550/arxiv.2006.07262","title":"A Brief Look at Generalization in Visual Meta-Reinforcement Learning","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Reinforcement learning; Overfitting; Generalization; Computer science; Artificial intelligence; Meta learning (computer science); Scalability; Machine learning; Realization (probability); Artificial neural network; Task (project management); Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002981539,0.001050419,0.001116771,0.0005194378,0.0004156285,0.001480321,0.00197591,0.001752652,0.002848273],"category_scores_gemma":[0.01121785,0.0005698932,0.001361054,0.0006693693,0.002077211,0.003079072,0.002102134,0.004117632,0.0004333813],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001363511,"about_ca_system_score_gemma":0.0007277289,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003263012,"about_ca_topic_score_gemma":0.001824292,"domain_scores_codex":[0.9988626,0.0004385014,0.00006823419,0.0002973133,0.0002258398,0.0001074777],"domain_scores_gemma":[0.9967942,0.001935484,0.0003110358,0.0005564938,0.0002764798,0.0001262099],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000104216,0.0001016597,0.002051361,0.0003276926,0.000174736,0.0001604978,0.0002963956,0.7945491,0.004786286,0.09350996,0.002923718,0.1010143],"study_design_scores_gemma":[0.00001230945,0.0001937299,0.0006453354,0.0001013474,0.00002085724,0.00009673187,0.00003715674,0.9204282,0.001465704,0.07363228,0.003339203,0.00002724643],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02544777,0.005929979,0.9575396,0.001939483,0.0002291506,0.00008223508,0.00007058325,0.00081314,0.007948159],"genre_scores_gemma":[0.8192067,0.004288274,0.1688625,0.001135549,0.0004201369,0.0002742388,0.0001379729,0.000337132,0.005337671],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003263012,"threshold_uncertainty_score":0.01576811,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1025356039800561,"score_gpt":0.2165601146297081,"score_spread":0.114024510649652,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}