Regret Minimization with Adaptive Opponents in Repeated Games
重复博弈中与自适应对手的遗憾最小化
机构 * Massachusetts Institute of Technology(麻省理工学院) ; OpenAI ; University of Maryland, College Park(马里兰大学学院公园分校)
AI总结 针对重复博弈中自适应对手的遗憾最小化问题,提出重复策略遗憾(RP-Regret)指标,并设计三种算法实现次线性遗憾,同时证明所有玩家最小化该遗憾可学习子博弈完美均衡。