TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation
TurboTalk: 一步生成音频驱动的虚拟角色的渐进蒸馏
机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; Meituan(美团) ; The Hong Kong Polytechnic University(香港理工大学) ; CAIR, HKISI, CAS(中国科学院CAS HKISI CAIR)
专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV、cs.MM
AI总结 本文提出TurboTalk框架,通过分布匹配蒸馏和对抗蒸馏逐步压缩多步音频驱动视频扩散模型,实现单步生成高质量虚拟角色,推理速度提升120倍。