{"id":"W7124299647","doi":"10.65109/njvx2967","title":"Automatic Noise Filtering with Dynamic Sparse Training in Deep Reinforcement Learning","year":2023,"lang":"","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Reinforcement learning; Noise (video); Focus (optics); Robot; Code (set theory); Training (meteorology); Transfer of learning; Deep learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001795269,0.0007902634,0.000824107,0.001339113,0.0005346721,0.0009630975,0.001632018,0.0002236413,0.000855497],"category_scores_gemma":[0.0003189336,0.0007672829,0.0001623788,0.004060273,0.0001944331,0.001401377,0.001249543,0.001286038,0.001455789],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005634908,"about_ca_system_score_gemma":0.0005084155,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009360758,"about_ca_topic_score_gemma":0.0001285253,"domain_scores_codex":[0.9933193,0.0002893105,0.001542077,0.001235254,0.001453035,0.002160992],"domain_scores_gemma":[0.997244,0.0004502355,0.0006098596,0.001202777,0.0001217059,0.0003714264],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001840769,0.0000160387,0.001083311,0.0002451996,0.00007457421,0.0003629574,0.0244743,0.9127538,0.0002055699,0.001064442,0.00001625518,0.05968522],"study_design_scores_gemma":[0.001526174,0.0008490345,0.004344617,0.001148549,0.00003593518,0.00005500892,0.004119162,0.9865463,0.00007188803,0.00004449926,0.0002898245,0.0009689895],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06483551,0.00003917511,0.9213515,0.0004664959,0.0007331559,0.0008695381,1.632136e-7,0.00127642,0.01042806],"genre_scores_gemma":[0.963608,0.0001422727,0.02373097,0.0001806551,0.00005351035,0.00008181617,0.00002312581,0.0001015858,0.01207805],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8987725,"threshold_uncertainty_score":0.9994778,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02828108593994722,"score_gpt":0.2598315582196306,"score_spread":0.2315504722796834,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}