{"id":"W3037454891","doi":"10.1609/aaai.v34i10.7208","title":"Gifting in Multi-Agent Reinforcement Learning (Student Abstract)","year":2020,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Experimental Behavioral Economics Studies","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Appropriation; Reinforcement learning; Reinforcement; Computer science; Resource (disambiguation); Cognitive science; Artificial intelligence; Psychology; Epistemology; Social psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000575339,0.0001697231,0.000254177,0.00005810264,0.0003897509,0.0001398132,0.0007469287,0.00007088471,0.0002192485],"category_scores_gemma":[0.0005337362,0.0001503432,0.0000943144,0.0003178538,0.0003709933,0.0002252133,0.0002961936,0.0003686322,0.0001318087],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001991569,"about_ca_system_score_gemma":0.0000797503,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009562731,"about_ca_topic_score_gemma":0.0002971337,"domain_scores_codex":[0.9982632,0.00001797362,0.0005996135,0.0003445993,0.0004049895,0.0003696106],"domain_scores_gemma":[0.999203,0.00005109963,0.000357258,0.00006893252,0.0002040337,0.0001156279],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0001688196,0.0004672879,0.05914293,0.00006515568,0.00003624054,0.000002472844,0.2366213,0.002836033,0.1248575,0.5539769,0.0001024098,0.02172302],"study_design_scores_gemma":[0.0002072422,0.0005291068,0.008276389,0.0005535004,0.00003483851,4.339999e-7,0.3136771,0.01327221,0.6561402,0.004995289,0.001437942,0.0008757433],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9400958,0.00003846995,0.00007457207,0.00591112,0.0002422316,0.0006240148,0.00000111059,0.00006253291,0.05295008],"genre_scores_gemma":[0.9990365,0.000124996,0.0002268953,0.0002601904,0.00006450739,0.00003576176,3.214821e-7,0.00001180988,0.0002390058],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5489816,"threshold_uncertainty_score":0.6130817,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2183202042311135,"score_gpt":0.3927524565995398,"score_spread":0.1744322523684263,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}