Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models
Diff4Splat:基于潜在动态重建模型的可控4D场景生成
机构 * Peking University(北京大学) ; Xiamen University(厦门大学) ; CUHK(香港中文大学) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
AI总结 Diff4Splat通过单张图像和相机轨迹生成可控的4D场景,结合视频扩散模型的生成先验与大规模4D数据集学习的几何和运动约束,在单次前向传递中直接预测可变形3D高斯场,无需测试时优化。
Comments Accepted to CVPR 2026. Project page: https://paulpanwang.github.io/Diff4Splat