LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning
LaST-R1:通过自适应物理潜在推理强化机器人操作
机构 * The Chinese University of Hong Kong(香港中文大学) ; State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室,计算机学院) ; Simplexity Robotics Project(Simplexity机器人项目)
专题命中 模仿学习与强化学习 :robotic(title,abstract);manipulation(title);world model(abstract);分类 cs.RO、cs.CV
AI总结 本文提出LaST-R1,一种基于强化学习的后训练框架,通过联合优化潜在推理过程和动作生成,提升机器人在动态环境中的适应性和泛化能力。