{"id":"W2990081887","doi":"10.65109/iawo2403","title":"Option-Critic in Cooperative Multi-agent Systems","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Auction Theory and Applications","field":"Decision Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Mila - Quebec Artificial Intelligence Institute; Université de Montréal; McGill University","funders":"","keywords":"Computer science; Convergence (economics); Broadcasting (networking); Mathematical optimization; Partially observable Markov decision process; Artificial intelligence; Distributed computing; Machine learning; Mathematics; Markov chain; Economics; Computer security","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001367989,0.0001927061,0.0004091464,0.0002038969,0.000122865,0.000440731,0.0008449551,0.0001804792,0.0006903044],"category_scores_gemma":[0.001252161,0.0001457074,0.0001130008,0.0005551397,0.0001042676,0.0001143765,0.0005627607,0.0004917851,0.00400437],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00008334849,"about_ca_system_score_gemma":0.000148232,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001088878,"about_ca_topic_score_gemma":0.00004762697,"domain_scores_codex":[0.9970657,0.0004557704,0.0008780204,0.0008342562,0.0006066547,0.0001596173],"domain_scores_gemma":[0.997973,0.0006310797,0.0002018887,0.000708605,0.0003467217,0.0001386731],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001807155,0.0002343582,0.0004853391,0.00003444694,0.00003037142,0.00001412058,0.001646818,0.1601186,0.0003917936,0.8274798,0.007862353,0.001683855],"study_design_scores_gemma":[0.001014868,0.00006173889,0.004758271,0.0002146668,0.00003744558,0.00001932308,0.0227212,0.5462796,0.0008611996,0.3400635,0.082862,0.001106236],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01136978,0.0002599432,0.9716002,0.004438879,0.001391905,0.001150877,0.0001064383,0.0001287838,0.00955313],"genre_scores_gemma":[0.9841682,0.00002552184,0.001712645,0.0003280069,0.0001486858,0.0003854063,0.00002519674,0.00001134083,0.01319495],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9727985,"threshold_uncertainty_score":0.9967712,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3337810483368862,"score_gpt":0.4631403141163685,"score_spread":0.1293592657794823,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}