2602.03201
2026-05-11
cs.LG
57%
SLOPE: Optimistic Potential Landscape Shaping for Model-based Reinforcement Learning
SLOPE:基于模型的强化学习中的乐观势能塑造
Yao-Hui Li, Zeyu Wang, Xin Li, Wei Pang, Yingfang Yuan, Zhengkun Chen, Boya Zhang, Riashat Islam, Alex Lamb, Yonggang Zhang
机构
*
Beijing Institute of Technology(北京理工大学)
;
Heriot-Watt University(赫瑞-沃森大学)
;
Shenzhen Institutes of Advanced Technology, CAS(深圳先进技术研究院)
;
Microsoft Research NY(微软研究院纽约分部)
;
Tsinghua University(清华大学)
;
Jilin University(吉林大学)
专题命中
模仿学习与强化学习
:robotic(abstract);分类 cs.LG
AI总结
SLOPE通过乐观势能估计构建信息丰富的势能景观,解决稀疏奖励环境下梯度信息不足的问题,提升模型在稀疏、半稀疏和密集奖励任务中的性能。