SSM Meets Video Diffusion Models: Efficient Long-Term Video Generation with Structured State Spaces
结构状态空间模型与视频扩散模型的结合:利用结构状态空间实现高效长时视频生成
机构 * The University of Tokyo(东京大学)
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(title);分类 cs.CV
AI总结 本文提出利用结构状态空间模型作为视频扩散模型的时序特征提取器,以解决传统注意力层在生成长视频序列时的计算成本问题,实验表明结构状态空间模型在内存使用和性能上更具优势。
Comments Accepted as a workshop paper at ICLR 2024