MosaicMem: Hybrid Spatial Memory for Controllable Video World Models
MosaicMem: 用于可控视频世界模型的混合空间记忆
机构 * University of Toronto(多伦多大学) ; Vector Institute(向量研究所) ; The University of Osaka(大阪大学) ; Georgia Institute of Technology(佐治亚理工学院) ; Mujin Inc.(Mujin公司) ; University of Texas at Austin(德克萨斯大学奥斯汀分校) ; Taiyuan University of Technology(太原本科技大学)
AI总结 MosaicMem提出一种混合空间记忆方法,通过提升片段至3D实现可靠定位与检索,结合模型原生条件化保留提示生成,提升姿态一致性与动态建模能力,支持细粒度导航与场景编辑。
Comments Project Page: https://mosaicmem.github.io/mosaicmem/