Infra-Bayesian Reinforcement Learning Agents Outperform Classical RL For Worst-Case Robustness
Infra-Bayesian 强化学习智能体在最坏情况鲁棒性上优于经典强化学习
Manish Aryal, Faiyaz Azam, Agnivo Banerjee, Syed Mahir Ahamed, Sai Sidhanth Manoharan Jayanthi, Allegra Laro, Clément Legentilhomme, Andrew Lin, Florian Lorkowski, Marina Pérez del Valle, Radman Rakhshandehroo, Patric Rommel, Emanuel Ruzak, Nathan Theng, Paul Yushin Rapoport
机构
*
Purdue University(普渡大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
WorldQuant University(WorldQuant大学)
;
UC Berkeley(加州大学伯克利分校)
;
Aix-Marseille University(阿维尼翁-马赛大学)
;
MIT(麻省理工学院)
;
University of Zurich(苏黎世大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
University of Stuttgart(斯图加特大学)
;
University of Buenos Aires(布宜诺斯艾利斯大学)
;
California State University, Fresno(弗雷斯诺加州州立大学)
;
University of Chicago(芝加哥大学)