TunerDiT: Training-free Progressive Steering of Diffusion Transformer for Multi-Event Video Generation
TunerDiT: 无需训练的多事件视频生成扩散变压器渐进式引导
机构 * Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) ; Technical University of Munich(慕尼黑技术大学) ; MCML ; University of Hamburg(汉堡大学) ; Huawei European Research Institute(华为欧洲研究院)
专题命中 视频扩散模型 :video generation(title);video diffusion(abstract);text-to-video(abstract);分类 cs.CV
AI总结 针对长视频多事件生成难题,提出无需额外训练的TunerDiT方法,通过事件分区掩码和跨事件提示融合实现渐进式引导,在8项指标上达到最优。
Comments 17 pages, 13 figures