{"id":"W4406033644","doi":"10.1287/opre.2021.0445","title":"Doubly Optimal No-Regret Online Learning in Strongly Monotone Games with Bandit Feedback","year":2025,"lang":"en","type":"article","venue":"Operations Research","topic":"Advanced Bandit Algorithms Research","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Regret; Monotone polygon; Computer science; Mathematical optimization; Online learning; Mathematical economics; Operations research; Mathematics; Multimedia; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004613654,0.002018967,0.002519536,0.0006794432,0.0008376333,0.001817862,0.002103021,0.002120392,0.001951915],"category_scores_gemma":[0.02241718,0.0008930066,0.0007585363,0.0005797692,0.002461317,0.002825242,0.002228939,0.002840671,0.0003863854],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001840867,"about_ca_system_score_gemma":0.002283642,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004260211,"about_ca_topic_score_gemma":0.003237105,"domain_scores_codex":[0.9974148,0.00131896,0.0001232801,0.0004020171,0.000363364,0.0003774621],"domain_scores_gemma":[0.9848999,0.01221184,0.0009212985,0.0006247613,0.0008175889,0.0005245902],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002587279,0.0001661388,0.0008531098,0.0001163374,0.00007123667,0.00008970367,0.00008987767,0.9365904,0.0005468879,0.04387593,0.0009715773,0.01637011],"study_design_scores_gemma":[0.00001354065,0.00002853823,0.00004839188,0.000007254661,0.000004970479,0.000007422247,0.000006374155,0.9878972,0.0001545974,0.01173901,0.00008749044,0.000005192352],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05351246,0.0005748554,0.939564,0.0008383371,0.00008668852,0.0001187009,0.00006948454,0.0003306095,0.004904822],"genre_scores_gemma":[0.9262775,0.0003335255,0.06901416,0.0004015833,0.00008652087,0.0002694065,0.0001122279,0.00009001621,0.003415083],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004613654,"threshold_uncertainty_score":0.02439964,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1309400321508501,"score_gpt":0.4967886970957619,"score_spread":0.3658486649449118,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}