Mutual Forcing: Dual-Mode Self-Evolution for Fast Autoregressive Audio-Video Character Generation
相互推动:双模式自我进化用于快速自回归音频视频生成
机构 * VCIP, School of Computer Science, Nankai University(南开大学计算机科学学院VCIP实验室) ; Tongyi Lab(通义实验室) ; Peking University(北京大学)
AI总结 本文提出Mutual Forcing框架,通过双阶段训练策略解决音频视频联合建模与快速自回归生成问题,通过共享参数实现自蒸馏,提升训练推理一致性,相比传统方法更高效且质量更优。