Action Images: End-to-End Policy Learning via Multiview Video Generation
动作图像:通过多视图视频生成实现端到端策略学习
机构 * UMass Amherst(马萨诸塞大学阿默斯特分校) ; NVIDIA(英伟达) ; Harvard University(哈佛大学) ; Genesis AI
专题命中 动作表示与策略 :action model(abstract);分类 cs.RO、cs.CV
AI总结 本文提出Action Images,通过多视图视频生成实现策略学习,利用像素化的动作表示,使视频模型本身成为零样本策略,提升视频-动作联合生成质量。
Comments Project Page: https://actionimages.github.io/