LaGO: Latent Action Guidance for Online Reinforcement Learning
LaGO:面向在线强化学习的潜在动作引导
Kuan-Yen Liu, Ren-Jyun Huang, Ti-Rong Wu
机构
*
Siebel School of Computing(计算科学系)
;
Data Science, University of Illinois Urbana-Champaign, USA(数据科学,伊利诺伊大学厄巴纳-香槟分校,美国)
;
Department of Computer Science, National Yang Ming Chiao Tung University, Taiwan(计算机科学系,National Yang Ming Chiao Tung大学,台湾)
;
Institute of Information Science, Academia Sinica, Taiwan(信息科学研究所, Academia Sinica,台湾)
专题命中
后训练与偏好优化
:LLM(abstract,abstract_cn);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI