V-RAE: Rethinking Video Latent Spaces for Generation
V-RAE:重新思考用于生成的视频隐空间
机构 * National University of Singapore(新加坡国立大学) ; University of Oxford(牛津大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
AI总结 本研究提出V-RAE视频表示自动编码器,基于冻结视觉基础模型构建生成隐空间,在多项视频任务上优于现有模型,还引入tFVD指标,证明冻结语义表示可支持多种视频建模任务。
Comments 26 pages, 8 tables, 13 figures, project page: https://v-rae.github.io/