Beyond Pixels: From Video Priors to 4D Worlds
超越像素:从视频先验到4D世界
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
AI总结 本文提出Latent-to-4D方法,利用共享VAE的视频模型去噪潜在变量作为接口实现4D生成,在两个数据集上的DINO-F1指标优于对比方法,且受人类评估者认可。
Comments Project page: https://hayd-zju.github.io/Beyond-Pixels