ControlEdit: A MultiModal Local Clothing Image Editing Method
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV
Comments Accepted at ECCV 2024 AIM workshop
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
Comments Project: https://github.com/YangLing0818/EditWorld
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
Comments Accepted by CVPR 2024 Workshop AI4CC
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV
Comments Accepted to CVPR 2024 Project webpage: https://yuanze-lin.me/LearnableRegions_page
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV
Comments ICLR 2024
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
Comments for project page, see https://mag-edit.github.io/
专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
Comments Findings of EMNLP 2023 (Long paper)
专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
Comments Neurips 2023. The code page: https://github.com/wangkai930418/DPL
专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
Comments Project page: https://thaoshibe.github.io/visii/
专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
Comments code is available at https://github.com/buxiangzhiren/Asymmetric_VQGAN
Edit-R2:面向多轮图像编辑的上下文感知强化学习
机构 * Hong Kong University of Science and Technology(香港理工大学) ; Kuaishou Technology(快手科技)
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);diffusion(abstract)
AI总结 提出Edit-R2框架,通过重构会话意图和联合优化推理与生成的强化学习,解决多轮图像编辑中的长上下文稀释和状态污染问题,并在MICE-Bench基准上取得领先性能。
扩散编辑中的可控性-保真度前沿
机构 * Xidian University(西安电子科技大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR、cs.MM
AI总结 本文理论结合实证研究扩散图像编辑中用户意图遵循、非目标内容保持与输出质量间的权衡,提出算法框架并揭示关键失败模式,讨论伦理考量。
Comments Preprint
专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);inpainting(abstract)
机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR
Comments The paper has been accepted to NeurIPS Creative AI Track 2025. Figure 4(c) has been accepted to CVPR AI Art Gallery 2025
机构 * Snap Research ; The Hebrew University of Jerusalem(耶路撒冷希伯来大学) ; Tel Aviv University(特拉维夫大学) ; Reichman University(里赫曼大学)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR
Comments CVPR 2025. Project page is available at https://omriavrahami.com/stable-flow
机构 * Renmin University of China(中国人民大学) ; Chinese University of Hong Kong(香港大学) ; Chinese University of Hong Kong, Shenzhen(香港大学(深圳)) ; Johns Hopkins University(约翰霍普金斯大学) ; Tencent(腾讯) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 图像编辑 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.MM
Comments Accepted by ACL 2025 Findings
机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; University of Pisa(比萨大学)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV、cs.MM
Comments IJCNN 2025
专题命中 图像编辑 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.MM
Comments ACM MM 2024 Oral
专题命中 图像编辑 :image editing(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV、cs.GR
基于指令的图像编辑:数据、模型、评估及应用综述
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 综述基于指令的图像编辑研究,围绕任务定义、数据构建、模型架构、评估指标及商业应用五个维度展开,提出综合深度诊断基准,通过开源方案比较揭示优缺点,探讨未来研究方向以推动该领域发展。
Comments 33 pages, 7 figures, Vicinagearth
Journal ref Zang, X., Jiang, Z., Cheng, J. et al. Instruction-based image editing: a survey on data, models, evaluation, and applications. Vicinagearth 3, 3 (2026)
MotionEdit: 动作导向图像编辑的基准测试与学习
机构 * Tencent AI(腾讯AI) ; University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 MotionEdit提出一个动作导向图像编辑数据集及评估基准,通过MotionNFT框架提升编辑质量和运动保真度。
Comments Technical Report. We propose MotionEdit, a dataset and benchmark for motion-centric image editing. We also introduce MotionNFT, a reward training framework to improve existing models with motion-aware guidance. Github: https://github.com/elainew728/motion-edit/
PosBridge:用于身份感知图像编辑的多视图位置嵌入迁移
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 PosBridge是一种高效灵活的图像编辑框架,通过位置嵌入迁移与角点居中布局,实现自定义对象的无缝插入,在结构一致性、保真度和效率上优于主流基线。
跨分支冲突作为一种保护手段:在统一多模态图像编辑中保护面部身份
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 研究统一多模态模型中个人肖像编辑的安全问题,提出CCS统一对抗保护框架,通过联合驱动ViT和VAE表示及破坏跨分支兼容性,防止模型恢复身份信息,在抑制身份保留编辑上表现优于现有方法。
Comments 14 pages, preprint
SatEdit:基于VLM引导的区域标注的掩码条件卫星图像编辑
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV
AI总结 SatEdit是基于VLM引导区域标注的卫星图像编辑框架,通过未标注图像构建监督信号,经LoRA微调后在对比中实现最高掩码区域语义对齐,为卫星图像编辑提供了数据高效的可行方案。
Comments 14 pages, 5 figures
h-Flow:通过杜布h变换实现基于灵活流的图像编辑
机构 * East China Normal University(华东师范大学) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);分类 cs.CV
AI总结 本文提出h-Flow,一个无需训练且基于理论的基于流的图像编辑框架。受杜布h变换启发,将图像编辑重述为条件生成,通过构建等效SDE扩展h变换,设计专用h函数并引入速度正交分解,实现有效、稳健且灵活的图像编辑。
UniGeo:通过视频模型统一几何指导以实现相机可控的图像编辑
机构 * ReLER, CCAI, Zhejiang University(ReLER、CCAI、浙江大学) ; DBMI, HMS, Harvard University(DBMI、HMS、哈佛大学)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 UniGeo通过统一的几何指导在三个层面提升相机可控图像编辑的几何一致性与视觉质量,克服传统方法在连续相机运动下的几何漂移和结构退化问题。