DCARL: A Divide-and-Conquer Framework for Autoregressive Long-Trajectory Video Generation
DCARL:一种用于自回归长轨迹视频生成的分而治之框架
机构 * Institute for Creative Technologies(创意技术研究所) ; University of Southern California(南加州大学)
专题命中 具身推理 :world model(abstract);分类 cs.CV
AI总结 本文提出DCARL框架,通过分而治之策略结合VDMs的高保真生成能力,解决长轨迹视频生成中的视觉漂移和可控性问题,实现高质量且稳定的生成。
Comments 29 pages, 11 figures. Project page: https://junyiouy.github.io/projects/dcarl