{"id":"W1672238326","doi":"10.1109/ccece.2015.7129412","title":"The residual gradient FACL algorithm for differential games","year":2015,"lang":"en","type":"article","venue":"","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"","keywords":"Fuzzy logic; Algorithm; Convergence (economics); Computer science; Reinforcement learning; Residual; Fuzzy control system; Adaptive neuro fuzzy inference system; Control theory (sociology); Artificial intelligence; Mathematics; Control (management)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001197719,0.001098862,0.001251664,0.0008134813,0.0004839748,0.000841129,0.001840182,0.001139095,0.003686706],"category_scores_gemma":[0.002199468,0.0003796261,0.0004679236,0.0004305124,0.001072466,0.0008471955,0.00106997,0.001345515,0.0008791332],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001372456,"about_ca_system_score_gemma":0.001563189,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006062143,"about_ca_topic_score_gemma":0.003864041,"domain_scores_codex":[0.9995277,0.0001589177,0.00002552718,0.00007741492,0.0001570853,0.00005344195],"domain_scores_gemma":[0.999401,0.0003006731,0.0000693175,0.00003698534,0.0001532645,0.00003877776],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008534059,0.00007574224,0.0004988296,0.0001560126,0.00004909253,0.00008803481,0.0001276747,0.7795929,0.001916991,0.06004096,0.003521144,0.1538472],"study_design_scores_gemma":[0.00001600177,0.00002385376,0.00002823571,0.000005494118,0.000002714404,0.00001405946,0.000004177386,0.9937893,0.0002191692,0.004989207,0.0009032869,0.000004614416],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.002764744,0.0001458175,0.9938822,0.0001040674,0.00003538507,0.00007100787,0.00001541725,0.0002347746,0.00274664],"genre_scores_gemma":[0.4400854,0.0003115312,0.5483878,0.000321468,0.00006749723,0.000795676,0.0001441238,0.0001474385,0.009739004],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006062143,"threshold_uncertainty_score":0.01233321,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03577575525246496,"score_gpt":0.2697363551253321,"score_spread":0.2339605998728671,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}