{"id":"W2944897634","doi":"10.65109/cuit1452","title":"Prediction in Intelligence: An Empirical Comparison of Off-policy Algorithms on Robots","year":2019,"lang":"en","type":"article","venue":"","topic":"Fault Detection and Control Systems","field":"Engineering","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Artificial intelligence; Computer science; Robot; Machine learning; Strengths and weaknesses; Temporal difference learning; Domain (mathematical analysis); Convergence (economics); Empirical research; Algorithm; Reinforcement learning; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01041861,0.0009013364,0.001016104,0.001433064,0.0006100074,0.001152312,0.00159852,0.001828481,0.001542391],"category_scores_gemma":[0.04789352,0.0002967247,0.0006932393,0.00105036,0.002008556,0.003077827,0.001983478,0.002090804,0.0004685413],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001377461,"about_ca_system_score_gemma":0.001049625,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002823171,"about_ca_topic_score_gemma":0.001662395,"domain_scores_codex":[0.9960431,0.002028314,0.0002367002,0.0006310281,0.0007970904,0.0002638568],"domain_scores_gemma":[0.9621195,0.02930347,0.001596132,0.004209935,0.002027747,0.000743253],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.001574781,0.0009278397,0.02259297,0.0004516279,0.0002246773,0.0001118319,0.0003282026,0.7929302,0.0008550155,0.009921646,0.004300601,0.1657806],"study_design_scores_gemma":[0.0001263552,0.00128729,0.01040481,0.0001145459,0.00004287514,0.0001135022,0.0002783243,0.9687011,0.001466757,0.01479853,0.002627583,0.00003829268],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8378633,0.004448826,0.1426298,0.001229809,0.0002304079,0.0005209798,0.000628492,0.001182415,0.01126598],"genre_scores_gemma":[0.9677403,0.0005690025,0.0291909,0.0001401513,0.00003643962,0.0002197264,0.000983053,0.0001214654,0.0009989181],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01041861,"threshold_uncertainty_score":0.05509955,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03350111625161623,"score_gpt":0.324964566170916,"score_spread":0.2914634499192997,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}