World-R1: Reinforcing 3D Constraints for Text-to-Video Generation
World-R1:通过强化学习为文本到视频生成注入3D约束
机构 * Zhejiang University(浙江大学) ; Microsoft Research(微软研究院) ; Independent Researcher(独立研究者)
专题命中 视频生成 :video generation(title,abstract);text-to-video(title);分类 cs.CV
AI总结 提出World-R1框架,利用强化学习(Flow-GRPO)结合3D基础模型和视觉语言模型的反馈,在不修改架构的情况下增强视频生成的3D一致性,并采用周期解耦训练策略平衡刚体几何与动态场景。
Comments ICML 2026, Project Page: https://aka.ms/world-r1, Code: https://github.com/microsoft/World-R1