{"id":"W2126410641","doi":"10.7551/mitpress/7503.003.0060","title":"iLSTD: Eligibility Traces and Convergence Analysis","year":2007,"lang":"en","type":"book-chapter","venue":"The MIT Press eBooks","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":42,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Convergence (economics); Computer science; Economics; Macroeconomics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00512787,0.001080512,0.001262507,0.001674194,0.0008359517,0.00196575,0.00288157,0.001584838,0.008976622],"category_scores_gemma":[0.04484484,0.0007105201,0.001128933,0.00149588,0.002413265,0.004630116,0.003272258,0.004761828,0.001183696],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002044169,"about_ca_system_score_gemma":0.002999316,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00465646,"about_ca_topic_score_gemma":0.003437264,"domain_scores_codex":[0.9977419,0.000779723,0.0001309129,0.0003003377,0.0008383455,0.0002087344],"domain_scores_gemma":[0.9717705,0.02163372,0.0009143684,0.002055884,0.002926289,0.0006991511],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000292876,0.000226305,0.002615611,0.0003405255,0.00007145506,0.0001489649,0.0002485319,0.6465865,0.001844139,0.1828371,0.007950055,0.1568379],"study_design_scores_gemma":[0.00001296318,0.00002021317,0.00007727808,0.00001958297,0.000006322739,0.00002384311,0.00001122688,0.969094,0.0005959859,0.02930609,0.0008256208,0.000006704805],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01014679,0.0004887845,0.9835953,0.0004069667,0.00008244667,0.00007577242,0.00009334756,0.0007176127,0.004392967],"genre_scores_gemma":[0.437069,0.000810205,0.551855,0.0004565599,0.0001272072,0.0005394103,0.0006057086,0.0008977291,0.007639296],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008976622,"threshold_uncertainty_score":0.03002977,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06079291191339031,"score_gpt":0.2960664466490978,"score_spread":0.2352735347357074,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}