{"id":"W3041349757","doi":"10.24963/ijcai.2020/764","title":"RLCard: A Platform for Reinforcement Learning in Card Games","year":2020,"lang":"en","type":"article","venue":"","topic":"Artificial Intelligence in Games","field":"Computer Science","cited_by":32,"is_retracted":false,"has_abstract":true,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Reinforcement learning; Debugging; Python (programming language); Human–computer interaction; Visualization; Bridging (networking); Multimedia; Artificial intelligence; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001752398,0.001335937,0.0007426774,0.0008036324,0.0003962067,0.001526928,0.003812382,0.001142471,0.04142467],"category_scores_gemma":[0.006383976,0.001039178,0.001324143,0.0003874649,0.0009843066,0.002516803,0.003239541,0.002936095,0.009884624],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008111278,"about_ca_system_score_gemma":0.001476062,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002462937,"about_ca_topic_score_gemma":0.002918506,"domain_scores_codex":[0.9989994,0.0003023961,0.00009738158,0.0001804512,0.0002646427,0.00015571],"domain_scores_gemma":[0.9983903,0.000861022,0.0001037821,0.0002646463,0.000181613,0.0001986034],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002512523,0.00171486,0.005866908,0.00291041,0.0003469705,0.00130906,0.001192776,0.1765334,0.03413911,0.1862127,0.2052561,0.3820051],"study_design_scores_gemma":[0.0007795822,0.0003104165,0.00153398,0.0002542379,0.00006126668,0.0004061755,0.00006269578,0.7370664,0.02125343,0.07685681,0.1612158,0.00019927],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.007241038,0.000213437,0.8194221,0.0003326771,0.0001564378,0.0005936603,0.002752033,0.1578077,0.01148086],"genre_scores_gemma":[0.1881802,0.0005698748,0.7495592,0.000993346,0.00007656151,0.003436035,0.007051523,0.03287803,0.0172553],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.04142467,"threshold_uncertainty_score":0.1385793,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06500251615242786,"score_gpt":0.2965336277008747,"score_spread":0.2315311115484468,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}