Coherent Audio-Visual Editing via Conditional Audio Generation Following Video Edits
通过条件音频生成实现一致的音频视觉编辑
机构 * Sony AI(索尼人工智能) ; Sony Group Corporation(索尼集团)
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM
AI总结 本文提出一种联合音频视觉编辑 pipeline,通过条件音频生成实现视频编辑与音频的协调一致,实验表明其在保持音频视觉一致性方面优于现有方法。
Comments Source code: https://github.com/SonyResearch/CoherentAVEdit