{"id":"W4389192605","doi":"10.22215/etd/2023-15720","title":"Multi-Agent Cooperative Fuzzy Reinforcement Learning","year":2023,"lang":"en","type":"dissertation","venue":"","topic":"Complex Systems and Time Series Analysis","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"","keywords":"Reinforcement learning; Interpretability; Artificial intelligence; Computer science; Fuzzy logic; Hyperparameter; Machine learning; Multi-agent system","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001240526,0.0005940062,0.0007647867,0.0003109919,0.000389802,0.0008108044,0.001008908,0.0008937815,0.001514051],"category_scores_gemma":[0.002744354,0.0002008503,0.0005276179,0.0003354254,0.0008939885,0.0006542587,0.0009648752,0.0007764077,0.0001879861],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000982899,"about_ca_system_score_gemma":0.0007388671,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004216325,"about_ca_topic_score_gemma":0.00221276,"domain_scores_codex":[0.9995413,0.0001875305,0.00001960678,0.00008994673,0.0001064,0.00005524635],"domain_scores_gemma":[0.9990143,0.0005959495,0.0001089962,0.00005334817,0.0001612892,0.000066197],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003581717,0.00005399403,0.0004158803,0.00005210125,0.0000377148,0.00008370803,0.00008737991,0.9530575,0.0009323445,0.02644634,0.0003889176,0.01840841],"study_design_scores_gemma":[0.000005714956,0.00001871421,0.00003735954,0.000002914864,0.000002936037,0.000004750547,0.000006044798,0.9946691,0.000126047,0.004883269,0.0002409962,0.000002147289],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06332783,0.0005929975,0.9263031,0.0004083468,0.00007186547,0.00007534425,0.00002384612,0.0001127699,0.009083833],"genre_scores_gemma":[0.9536765,0.0002630163,0.04171178,0.00006098123,0.00002978448,0.00009947514,0.00002376824,0.00001014629,0.00412457],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004216325,"threshold_uncertainty_score":0.008383572,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04756884489419395,"score_gpt":0.2574842340453747,"score_spread":0.2099153891511808,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}