{"id":"W2906796853","doi":"10.1109/ijcnn52387.2021.9533459","title":"Dynamic Planning Networks","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"Ontario Centres of Excellence","keywords":"Traverse; Computer science; Generalization; Reinforcement learning; Action (physics); Artificial intelligence; Construct (python library); State (computer science); Architecture; Machine learning; Algorithm; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004351236,0.0008209219,0.0004703962,0.0004982962,0.0004123597,0.001043901,0.001508759,0.0008146584,0.009008932],"category_scores_gemma":[0.002694219,0.0004967757,0.0005407917,0.0005122708,0.0007862134,0.001629929,0.00142165,0.001543708,0.001418559],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001024061,"about_ca_system_score_gemma":0.001392779,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004619542,"about_ca_topic_score_gemma":0.007576535,"domain_scores_codex":[0.9996303,0.00007251451,0.00002117841,0.0001357307,0.00009483552,0.00004534991],"domain_scores_gemma":[0.999403,0.0002917781,0.00006804307,0.00008306733,0.00009595556,0.00005826263],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00009776375,0.00006088529,0.0009111206,0.000226401,0.00006268969,0.000151583,0.00007999634,0.7026433,0.003026941,0.1134843,0.009867379,0.1693876],"study_design_scores_gemma":[0.00001261492,0.00001910698,0.00009136895,0.00002351612,0.00001057782,0.00003884284,0.00001018092,0.9119513,0.0009919013,0.07819947,0.008642909,0.000008221285],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.007218533,0.0006986477,0.9752435,0.0006491133,0.0001214219,0.00007029762,0.0007066627,0.001921945,0.01336994],"genre_scores_gemma":[0.4856665,0.001799671,0.4933241,0.0005656411,0.000107371,0.0004813429,0.002437542,0.0004302781,0.01518758],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009008932,"threshold_uncertainty_score":0.0301379,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01973673017005091,"score_gpt":0.2760966982052132,"score_spread":0.2563599680351623,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}