Hierarchical Reinforcement Learning for Sparse-Reward Search in Commutative Algebra
用于交换代数中稀疏奖励搜索的分层强化学习
Giorgi Butbaia, Paul Orland, Coco Huang, Davide Passaro, Lucas Fagan, Michele Tarquini, Hailong Dao, David Eisenbud, Ali Shehper, Sergei Gukov
机构
*
California Institute of Technology(加州理工学院)
;
Temple University(天普大学)
;
University of Kansas(堪萨斯大学)
;
University of California, Berkeley(加州大学伯克利分校)
The Two-Hump Problem: Bridging the Difficulty Gap in Mathematical Reinforcement Learning
双峰问题:弥合数学强化学习中的难度差距
Lucas Fagan, Michele Tarquini, Ali Shehper, Maksymilian Manko, Angus Gruen, Coco Huang, Giorgi Butbaia, Davide Passaro, Sergei Gukov
机构
*
Department of Mathematics, California Institute of Technology(加州理工学院数学系)
;
Institute of Mathematics, University of Zurich(苏黎世大学数学研究所)
;
Zero Latency Labs(零延迟实验室)
;
Department of Mathematics, Temple University(天普大学数学系)