DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching
DisCa:通过与知识蒸馏兼容的可学习特征缓存加速视频扩散变换器
机构 * Shanghai Jiao Tong University(上海交通大学) ; Tencent Hunyuan(腾讯文英) ; Xidian University(西安电子科技大学)
专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV
AI总结 本文提出一种与知识蒸馏兼容的可学习特征缓存机制,用于加速视频扩散变换器,通过轻量级可学习神经预测器提升高维特征演化过程的准确性,并采用保守的受限均值流方法实现更稳定无损的知识蒸馏,从而将加速边界推至11.8倍同时保持生成质量。
Comments 18 pages, 8 figures; cvpr2026 paper