{"id":"W2115318338","doi":"","title":"Bootstrapping Apprenticeship Learning","year":2010,"lang":"en","type":"article","venue":"Max Planck Digital Library","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université Laval","funders":"","keywords":"Computer science; Bootstrapping (finance); Reinforcement learning; Feature (linguistics); Machine learning; Artificial intelligence; Monte Carlo method; Quality (philosophy); State space; Feature engineering; Feature vector; Apprenticeship; Mathematical optimization; Mathematics; Econometrics; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001658256,0.0009175665,0.001424972,0.0007906876,0.0006478587,0.0006769165,0.003374594,0.001628883,0.005883829],"category_scores_gemma":[0.01133547,0.0004406582,0.0007343664,0.0005274176,0.001523573,0.001724766,0.003129226,0.002329482,0.001066427],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006615827,"about_ca_system_score_gemma":0.0009968599,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001476192,"about_ca_topic_score_gemma":0.001712969,"domain_scores_codex":[0.9987488,0.000504072,0.00005010083,0.0003506086,0.0002054481,0.0001409292],"domain_scores_gemma":[0.9934854,0.004056875,0.0003345021,0.0009095174,0.0007021085,0.0005117026],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003874504,0.000755258,0.005862844,0.0001781224,0.0001100262,0.0004559617,0.0003443396,0.5394905,0.002599891,0.04513932,0.005484449,0.3991918],"study_design_scores_gemma":[0.00004047171,0.0001184061,0.0002124381,0.00001554476,0.00001006227,0.00007087173,0.00002281946,0.9730991,0.001152183,0.0242435,0.001006661,0.000007984307],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.09226587,0.0002874034,0.8986707,0.0005763285,0.0001046479,0.0002605011,0.00006249052,0.001367054,0.006405104],"genre_scores_gemma":[0.8711345,0.00009849542,0.1230827,0.0003046255,0.00004394972,0.0003134103,0.0001938579,0.0001069398,0.004721557],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005883829,"threshold_uncertainty_score":0.01968342,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.006204349322123965,"score_gpt":0.1823350294708526,"score_spread":0.1761306801487287,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}