{"id":"W2027757692","doi":"10.1080/10798587.2005.10642903","title":"Behavior Arbitration using a Fuzzy Reinforcement Learning Approach","year":2005,"lang":"en","type":"article","venue":"Intelligent Automation & Soft Computing","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Arbitration; Reinforcement learning; Fuzzy logic; Artificial intelligence; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001492988,0.0004677263,0.0006275636,0.0004919382,0.0004032934,0.0005590663,0.001016196,0.0007785622,0.002007965],"category_scores_gemma":[0.002725413,0.0002073498,0.0004044913,0.0002659606,0.0008473247,0.0005388444,0.000615762,0.0008077472,0.0001718265],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007989153,"about_ca_system_score_gemma":0.0008418927,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004526214,"about_ca_topic_score_gemma":0.002491656,"domain_scores_codex":[0.9994109,0.0002212767,0.0000338666,0.00009653826,0.0001651207,0.00007239006],"domain_scores_gemma":[0.9986743,0.0006922818,0.0001509834,0.00008281984,0.0003132648,0.00008649911],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001011134,0.0001150873,0.0008623307,0.00005164839,0.00004726627,0.00007811521,0.00008592379,0.9214429,0.003236701,0.01252648,0.0004252638,0.06102719],"study_design_scores_gemma":[0.000006848284,0.00001889152,0.00003779442,0.000001976392,0.000002530472,0.000006291259,0.000002875367,0.9982958,0.000253196,0.001274338,0.00009732813,0.00000201078],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04417902,0.0001197271,0.9519299,0.0001816967,0.00003156512,0.00006911481,0.00001086841,0.0002311245,0.00324693],"genre_scores_gemma":[0.9268141,0.00004230386,0.07162485,0.00005824363,0.00001674357,0.00007874369,0.00001269225,0.00001390367,0.001338393],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004526214,"threshold_uncertainty_score":0.008999765,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03712224588085534,"score_gpt":0.2900795021192054,"score_spread":0.25295725623835,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}