{"id":"W7132054910","doi":"","title":"Time and temporal abstraction in continual learning: tradeoffs, analogies and regret in an active measuring setting","year":2023,"lang":"en","type":"article","venue":"NPARC","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Abstraction; Regret; Context (archaeology); Class (philosophy); Markov decision process; Relevance (law); Hierarchy; Reinforcement learning; Simple (philosophy)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006452994,0.0001002082,0.0001412394,0.0002487139,0.00007543618,0.0001343718,0.0001554402,0.0000628044,0.000005109249],"category_scores_gemma":[0.0001696872,0.000105642,0.00001136524,0.0003473677,0.00005249503,0.0007712786,0.0001240076,0.0003381624,0.000009189553],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004199319,"about_ca_system_score_gemma":0.00002483314,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000023082,"about_ca_topic_score_gemma":0.00003567139,"domain_scores_codex":[0.998964,0.0001209922,0.0001941344,0.000288272,0.0001861073,0.000246544],"domain_scores_gemma":[0.9995571,0.0001585152,0.00009139194,0.0001258648,0.00001962069,0.0000474686],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00005869388,0.00003651623,0.315535,0.00006157478,0.00002136996,0.0001939216,0.0195069,0.5198377,0.03826383,0.0008625516,0.000149448,0.1054725],"study_design_scores_gemma":[0.0002984972,0.00008747428,0.3147589,0.00004299565,0.000001392518,0.000007539054,0.0006629619,0.6830646,0.000588038,0.0002962382,0.0000763984,0.0001148929],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9949915,0.00000780532,0.002444655,0.0004706168,0.00004690696,0.0001099649,3.870215e-7,0.0001773124,0.001750878],"genre_scores_gemma":[0.9967367,0.00001180895,0.00296954,0.00001445157,0.00001882524,0.00000419895,0.000006542869,0.000007707034,0.0002301928],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1632269,"threshold_uncertainty_score":0.4307956,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03017605342244424,"score_gpt":0.263177105349338,"score_spread":0.2330010519268938,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}