ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
ReinforceGen:具有自动数据生成和强化学习的混合技能策略
机构 * University of Toronto(多伦多大学) ; Vector Institute(向量研究所) ; Georgia Institute of Technology(佐治亚理工学院) ; NVIDIA Research(NVIDIA研究)
AI总结 针对机器人长期操纵挑战,ReinforceGen系统结合任务分解、数据生成、模仿学习与运动规划形成初始方案,经强化学习微调,在Robosuite数据集基准测试中成功率达80%,消融研究显示微调使性能平均提升89%,实际评估也有显著改进。