{"id":"W2945334994","doi":"10.65109/iadj1863","title":"Exploration in the Face of Parametric and Intrinsic Uncertainties","year":2019,"lang":"en","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Huawei Technologies (Canada); University of Alberta","funders":"","keywords":"Reinforcement learning; Parametric statistics; Schedule; Computer science; Face (sociological concept); Quantile; Mathematical optimization; Probability distribution; Artificial intelligence; Mathematics; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002193946,0.0007238904,0.000900705,0.000320965,0.0003420759,0.0007410305,0.0009779601,0.0007712778,0.001026487],"category_scores_gemma":[0.008715289,0.0004678743,0.0004645313,0.0002483838,0.001584282,0.002110525,0.002294133,0.001975519,0.000163176],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007456057,"about_ca_system_score_gemma":0.001202686,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002030839,"about_ca_topic_score_gemma":0.002218178,"domain_scores_codex":[0.9991553,0.0003739013,0.00003727337,0.0001592928,0.0001505224,0.0001236423],"domain_scores_gemma":[0.995364,0.003498171,0.0003493321,0.0003089225,0.0002878492,0.0001917582],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000167291,0.00003256998,0.000746357,0.00004899294,0.000027308,0.00007657732,0.00008728048,0.9479514,0.002283215,0.01555872,0.0004925339,0.03252773],"study_design_scores_gemma":[0.000009764089,0.0000234692,0.00009956197,0.000004151158,0.000002788939,0.00001488208,0.00000836375,0.9857771,0.000482495,0.01342911,0.0001434446,0.000004904085],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0806987,0.0002584938,0.9166811,0.000394941,0.00002781332,0.00002278311,0.00003606437,0.0002681394,0.001612014],"genre_scores_gemma":[0.9550068,0.0001055488,0.04332514,0.0001046885,0.00002361784,0.00004495216,0.00004005712,0.00004770243,0.001301538],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002193946,"threshold_uncertainty_score":0.01160282,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02470016581513209,"score_gpt":0.2461940805743528,"score_spread":0.2214939147592207,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}