DVG-WM: Disentangled Video Generation Enables Efficient Embodied World Model for Robotic Manipulation
DVG-WM:解耦视频生成实现高效机器人操作具身世界模型
机构 * Nanyang Technological University, Singapore(南洋理工大学(新加坡)) ; Beijing University of Posts and Telecommunications, Beijing, China(北京邮电大学(中国北京)) ; GigaAI
专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(title,abstract);分类 cs.RO
AI总结 提出解耦视频生成世界模型(DVG-WM),将世界模型分解为动力学学习和视觉合成,通过流匹配直接映射动力学到视频潜变量,并引入潜变量退化机制再生接触细节,在LIBERO和真实平台实现高达3.97倍加速。