{"id":"W4313136702","doi":"10.1109/tsmc.2022.3214221","title":"Reinforcement Learning-Based Feedback and Weight-Adjustment Mechanisms for Consensus Reaching in Group Decision Making","year":2022,"lang":"en","type":"article","venue":"IEEE Transactions on Systems Man and Cybernetics Systems","topic":"Multi-Criteria Decision Making","field":"Decision Sciences","cited_by":47,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of New Brunswick; University of Windsor","funders":"Agencia Estatal de Investigación; Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Markov decision process; Computer science; Scalability; Harmony (color); Artificial intelligence; Group decision-making; Reinforcement; Decision problem; Notation; Machine learning; Markov process; Mathematics; Statistics; Psychology; Algorithm; Social psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004551399,0.001032822,0.001162348,0.0006384134,0.000802574,0.001079632,0.002177455,0.001210662,0.002196759],"category_scores_gemma":[0.01803005,0.0004399455,0.0007049173,0.0005347331,0.001385904,0.002092654,0.001802786,0.002027884,0.0004000768],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001612931,"about_ca_system_score_gemma":0.001969997,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00413439,"about_ca_topic_score_gemma":0.002850156,"domain_scores_codex":[0.9970453,0.001257728,0.0001924819,0.0006303719,0.0005876917,0.0002863452],"domain_scores_gemma":[0.9925249,0.004307036,0.001171204,0.0006039343,0.001018896,0.0003740905],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002887762,0.0003196498,0.001769073,0.0001862315,0.0001352443,0.0001587127,0.0005408352,0.8255515,0.006052782,0.04604483,0.00125497,0.1176975],"study_design_scores_gemma":[0.0000364706,0.00005844633,0.0001651076,0.000007973714,0.00001385428,0.00001228297,0.00001725475,0.9866391,0.001001313,0.01174276,0.000292851,0.00001245193],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02833028,0.0001205314,0.969346,0.0002276153,0.00003679032,0.0001120842,0.00001695326,0.0003193375,0.001490376],"genre_scores_gemma":[0.8799242,0.0001198634,0.1178385,0.0001102672,0.00003902856,0.0003088556,0.00003583078,0.00004300013,0.001580418],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004551399,"threshold_uncertainty_score":0.02407038,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06285006846990177,"score_gpt":0.3260461768517512,"score_spread":0.2631961083818494,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}