{"id":"W7124317253","doi":"10.65109/gzci2494","title":"Value Iteration for Learning Concurrently Executable Robotic Control Tasks","year":2025,"lang":"","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Executable; Task (project management); Reinforcement learning; Set (abstract data type); Independence (probability theory); Robot; Property (philosophy); Control (management)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002904487,0.001271366,0.001312152,0.0005924674,0.0003759579,0.0007377185,0.001273424,0.00145295,0.001851889],"category_scores_gemma":[0.00810316,0.0007945593,0.0006406671,0.0004431832,0.001856936,0.001311625,0.001423761,0.002183803,0.0002825433],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001503364,"about_ca_system_score_gemma":0.001470004,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004081519,"about_ca_topic_score_gemma":0.003066256,"domain_scores_codex":[0.9989288,0.0004893397,0.00004886511,0.0001582324,0.000248194,0.0001265931],"domain_scores_gemma":[0.9963093,0.002809702,0.0002394847,0.0001429302,0.0003532012,0.0001453836],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00005263985,0.0000270648,0.0002822327,0.0000279758,0.00001877822,0.00002353293,0.00003671099,0.9806231,0.0005357564,0.007487492,0.0001666579,0.01071795],"study_design_scores_gemma":[0.000005597705,0.00001496698,0.00001422746,0.000002283902,0.00000116839,0.000002262437,0.000001800875,0.9971536,0.000145242,0.002601388,0.00005580693,0.000001684073],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02282048,0.0001528053,0.9750541,0.0001644444,0.00002328802,0.00005414502,0.0000141096,0.0002177681,0.001498857],"genre_scores_gemma":[0.8402209,0.0001296684,0.1563548,0.0001261232,0.00003052955,0.0002916555,0.0000763735,0.0001101912,0.002659679],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004081519,"threshold_uncertainty_score":0.01536059,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01369195286495529,"score_gpt":0.2791122585949014,"score_spread":0.2654203057299461,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}