Veo-Act: How Far Can Frontier Video Models Advance Generalizable Robot Manipulation?
Veo-Act:前沿视频模型在通用机器人操作中能走多远?
机构 * Tsinghua University(清华大学)
专题命中 动作与事件理解 :video generation(abstract)
AI总结 本文探讨前沿视频模型如Veo-3在通用机器人操作中的应用,提出Veo-Act框架结合高阶运动规划与低阶执行器,提升指令跟随性能。
Comments 16 pages, 12 figures. Equal contribution by Zhongru Zhang, Chenghan Yang, Qingzhou Lu and Yanjiang Guo. Project lead: Yanjiang Guo