HPSD: Hybrid-Policy Self-Distillation for Text-Image-to-Video Diffusion Models
HPSD:用于文本-图像转视频扩散模型的混合策略自蒸馏
机构 * Shanghai Jiao Tong University(上海交通大学) ; S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab实验室) ; University of Science and Technology of China(中国科学技术大学) ; Fudan University(复旦大学) ; Shanghai Innovation Institute(上海创新研究院) ; Shanghai AI Laboratory(上海人工智能实验室) ; Adobe Research(奥多比研究院) ; The Chinese University of Hong Kong(香港中文大学) ; CPII under InnoHK(InnoHK下属CPII机构)
AI总结 本研究提出HPSD混合策略自蒸馏框架,通过让同一TI2V模型在不同条件下分别充当教师与学生,解决现有自蒸馏方法的缺陷,显著提升T2V及TI2V生成性能,强化模型基础生成能力。
Comments Project Website: https://bujiazi.github.io/hpsd.github.io/ Code: https://github.com/Bujiazi/HPSD