ROVE: Unlocking Human Interventions for Humanoid Manipulation via Reinforcement Learning
ROVE: 通过强化学习解锁人类干预用于人形机器人操作
机构 * XPENG Robotics(小鹏机器人) ; Fudan University(复旦大学) ; The Chinese University of Hong Kong(香港中文大学) ; Shanghai Jiao Tong University(上海交通大学)
AI总结 提出ROVE框架,利用强化学习和乐观价值估计,从次优人类干预轨迹中学习高价值行为,提升人形机器人操作性能。