VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers
VISTA: 基于扩散变换器的三元组监督视频风格迁移
机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; Lovart AI(Lovart人工智能)
专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV
AI总结 本文提出VISTA方法,通过引入大规模三元组数据和基于扩散变换器的框架,解决视频风格迁移中风格、内容和运动的联合建模与解耦问题,实现了高质量的风格迁移效果。