InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation
InsEdit:通过数据高效的视频扩散模型适应实现基于指令的视觉编辑
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Celia Research HK ; City University of Hong Kong(香港城市大学)
专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV
AI总结 本文提出InsEdit,基于HunyuanVideo-1.5构建指令式编辑模型,结合Mutual Context Attention机制,仅需少量视频编辑数据即可实现高质量视频编辑,并支持图像编辑。
Comments 13 pages, 10 figures