VideoWeaver: Multimodal Multi-View Video-to-Video Transfer for Embodied Agents
VideoWeaver:多模态多视角视频到视频转换用于具身智能体
机构 * Huawei Heisenberg Research Center(华为海森堡研究中心) ; Ludwig Maximilian University of Munich(慕尼黑大学) ; University of Freiburg(弗莱堡大学) ; Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
专题命中 机器人学习 :embodied agent(title);robot learning(abstract);embodied AI(abstract);分类 cs.CV
AI总结 VideoWeaver是首个多视角视频到视频转换框架,通过共享4D潜在空间实现多视角一致性,支持动态相机运动和不同视角的自回归合成,提升具身智能体在真实环境中的迁移能力。