arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1257 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1257 篇

2409.08857 2024-12-03 cs.CV 87%

InstantDrag: Improving Interactivity in Drag-based Image Editing

Joonghyuk Shin, Daehyeon Choi, Jaesik Park

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);diffusion(abstract)

Comments SIGGRAPH Asia 2024. Project webpage: https://joonghyuk.com/instantdrag-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08019 2024-06-25 cs.CV 87%

AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image Editing

Zhiyuan Ma, Guoli Jia, Bowen Zhou

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14487 2024-03-22 cs.CV 87%

DesignEdit: Multi-Layered Latent Decomposition and Fusion for Unified & Accurate Image Editing

Yueru Jia, Yuhui Yuan, Aosong Cheng, Chuke Wang, Ji Li, Huizhu Jia, Shanghang Zhang

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);inpainting(abstract)

Comments technical report, 15 pages, webpage: https://design-edit.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.08352 2020-08-07 cs.CV cs.AI stat.ML 87%

Sequential Attention GAN for Interactive Image Editing

Yu Cheng, Zhe Gan, Yitong Li, Jingjing Liu, Jianfeng Gao

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);image synthesis(abstract)

Comments ACM MM 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10600 2026-05-12 cs.CR 87%

Generate "Normal", Edit Poisoned: Branding Injection via Hint Embedding in Image Editing

生成“正常”,编辑污染:通过提示嵌入的品牌注入图像编辑

Desen Sun, Jason Hon, Howe Wang, Saarth Rajan, Meng Xu, Sihang Liu

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);diffusion(abstract)

AI总结 研究发现图像编辑流程中存在安全漏洞,通过隐含提示注入品牌信息可实现隐蔽攻击,提出针对两种攻击场景的缓解方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02366 2025-09-30 cs.CV 86%

GenMix: Effective Data Augmentation with Generative Diffusion Model Image Editing

Khawar Islam, Muhammad Zaigham Zaheer, Arif Mahmood, Karthik Nandakumar, Naveed Akhtar

机构 * School of Computing and Information Systems, The University of Melbourne, Australia(墨尔本大学计算与信息系统学院) Mohamed bin Zayed University of Artificial Intelligence, UAE(人工智能 Mohamed bin Zayed 大学) Information Technology University, Punjab, Pakistan(巴基斯坦旁遮普信息科技大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(title);分类 cs.CV

Comments https://diffusemix.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05101 2025-05-13 cs.CV 86%

MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models

Hongyang Zhu, Haipeng Liu, Bo Fu, Yang Wang

机构 * School of Computer Science and Information Engineering(计算机科学与信息工程学院) Hefei University of Technology(合肥工业大学) School of computer and artificial intelligence(计算机与人工智能学院) Liaoning Normal University(辽宁师范大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title);分类 cs.CV

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18605 2024-12-23 cs.CV 86%

FlexEdit: Flexible and Controllable Diffusion-based Object-centric Image Editing

Trong-Tung Nguyen, Duc-Anh Nguyen, Anh Tran, Cuong Pham

专题命中 图像编辑 :image editing(title,abstract);diffusion(title);分类 cs.CV

Comments Our project page: https://flex-edit.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18247 2024-07-26 cs.CV 86%

RegionDrag: Fast Region-Based Image Editing with Diffusion Models

Jingyi Lu, Xinghui Li, Kai Han

专题命中 图像编辑 :image editing(title,abstract);diffusion(title);分类 cs.CV

Comments ECCV 2024, Project page: https://visual-ai.github.io/regiondrag

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13916 2024-03-22 cs.CV cs.LG 86%

Enhancing Fingerprint Image Synthesis with GANs, Diffusion Models, and Style Transfer Techniques

W. Tang, D. Figueroa, D. Liu, K. Johnsson, A. Sopasakis

专题命中 图像编辑 :diffusion(title,abstract);image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.18085 2024-02-01 cs.CV 86%

Motion Guidance: Diffusion-Based Image Editing with Differentiable Motion Estimators

Daniel Geng, Andrew Owens

专题命中 图像编辑 :diffusion(title,abstract);image editing(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11715 2026-03-26 cs.CV cs.MM eess.IV 86%

EditMGT: Unleashing Potentials of Masked Generative Transformers in Image Editing

EditMGT: 解锁屏蔽生成变压器在图像编辑中的潜力

Wei Chow, Linfeng Li, Lingdong Kong, Zefeng Li, Qi Xu, Hang Song, Tian Ye, Xian Wang, Jinbin Bai, Shilin Xu, Xiangtai Li, Junting Pan, Shaoteng Liu, Ran Zhou, Tianshu Yang, Songhua Liu

机构 * National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出EditMGT框架,利用Masked Generative Transformers实现局部化编辑,通过多层注意力整合和区域保持采样提升编辑精度与效率,实验表明其在编辑质量和速度上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10941 2026-03-03 cs.CV cs.AI cs.CL cs.LG cs.MM 86%

VINCIE: Unlocking In-context Image Editing from Video

VINCIE:从视频中解锁上下文图像编辑

Leigang Qu, Feng Cheng, Ziyan Yang, Qi Zhao, Shanchuan Lin, Yichun Shi, Yicong Li, Wenjie Wang, Tat-Seng Chua, Lu Jiang

机构 * National University of Singapore(国立新加坡大学) ByteDance Seed(字节跳动种子)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV、cs.MM

AI总结 VINCIE通过视频直接训练模型,实现了强大的上下文图像编辑能力,并在多轮图像编辑基准中取得最佳成绩。

Comments ICLR 2026 Camera-ready. Project page: https://vincie2025.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15772 2026-02-09 cs.CV cs.MM 86%

Visual Autoregressive Modeling for Instruction-Guided Image Editing

用于指导图像编辑的视觉自回归建模

Qingyang Mao, Qi Cai, Yehao Li, Yingwei Pan, Mingyue Cheng, Ting Yao, Qi Liu, Tao Mei

机构 * University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV、cs.MM

AI总结 VAREdit通过自回归框架实现高效精准的图像编辑,优于扩散模型并在速度和质量上取得显著提升。

Comments ICLR 2026; Source codes and models are available at https://github.com/HiDream-ai/VAREdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12704 2025-11-04 cs.CV cs.MM 86%

SmartFreeEdit: Mask-Free Spatial-Aware Image Editing with Complex Instruction Understanding

Qianqian Sun, Jixiang Luo, Dell Zhang, Xuelong Li

机构 * Institute of Artificial Intelligence(TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) The University of Hongkong(香港大学)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20376 2025-02-28 cs.GR cs.CV cs.LG 86%

Tight Inversion: Image-Conditioned Inversion for Real Image Editing

Edo Kadosh, Nir Goren, Or Patashnik, Daniel Garibi, Daniel Cohen-Or

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page at: https://tight-inversion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14792 2024-02-23 cs.CV cs.GR cs.LG 86%

Consolidating Attention Features for Multi-view Image Editing

Or Patashnik, Rinon Gal, Daniel Cohen-Or, Jun-Yan Zhu, Fernando De la Torre

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.GR

Comments Project Page at https://qnerf-consolidation.github.io/qnerf-consolidation/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.09800 2023-01-19 cs.CV cs.AI cs.CL cs.GR cs.LG 86%

InstructPix2Pix: Learning to Follow Image Editing Instructions

Tim Brooks, Aleksander Holynski, Alexei A. Efros

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page with code: https://www.timothybrooks.com/instruct-pix2pix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16864 2026-07-17 cs.CV 版本更新 86%

RePlan: Reasoning-guided Region Planning for Complex Instruction-based Image Editing

RePlan:基于推理的复杂基于指令的图像编辑区域规划

Tianyuan Qu, Lei Ke, Xiaohang Zhan, Longxiang Tang, Yuqi Liu, Bohao Peng, Bei Yu, Dong Yu, Jiaya Jia

机构 * Tencent AI Lab(腾讯人工智能实验室) CUHK(香港中文大学) HKUST(香港科技大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 研究针对复杂指令图像编辑中现有模型在IV-复杂性下的不足,提出RePlan框架,结合视觉语言规划器与扩散编辑器,经强化学习提升性能,还推出IV-Edit基准,该框架在相关设置中优于强大基线,提高了区域精度和整体一致性。

Comments [ECCV2026] Precise multi-region control and planning for instruction-based image editing. Our project page: https://replan-iv-edit.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11745 2023-10-06 eess.IV cs.CV cs.LG 86%

PIE: Simulating Disease Progression via Progressive Image Editing

Kaizhao Liang, Xu Cao, Kuei-Da Liao, Tianren Gao, Wenqian Ye, Zhengyu Chen, Jianguo Cao, Tejas Nama, Jimeng Sun

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract,comments);text-to-image(abstract);分类 cs.CV

Comments Code and checkpoints for replicating our results can be found at https://github.com/IrohXu/PIE and https://huggingface.co/IrohXu/stable-diffusion-mimic-cxr-v0.1

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29025 2026-08-06 cs.CV 版本更新 85%

Evaluation-Verification Reward for Consistent Multi-Reference Image Editing

用于一致多参考图像编辑的评估-验证奖励

Yingmao Miao, Pengfei Zhang, Xiaochen Lv, Meng Yu, Lei Sun, Xiangxiang Chu, Chao Shen, Chenhao Lin

机构 * Xi’an Jiaotong University(西安交通大学) Amap, Alibaba(高德,阿里巴巴) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 针对多参考图像编辑的视觉一致性与奖励模型缺失问题,提出多维度评估-验证奖励EVR,实现无需架构改动的现成编辑器RL微调,性能优于Qwen-Image-Edit并达到或超NanoBanana。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20883 2026-07-24 cs.CV 新提交 85%

WhereEdit: Mask-aware Local Latent Editing for One-Step Image Editing

WhereEdit:用于一步图像编辑的掩码感知局部潜在编辑

Ming Hu, Mingyu Dou, Jianfu Yin, Miaomiao Zhang, Cong Hu, Yao Wang, Bingliang Hu, Quan Wang

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

AI总结 研究针对现有一步图像编辑方法缺乏空间控制及局部编辑能力不足的问题,提出WhereEdit框架,通过自动识别语义相关区域并应用自适应局部调制,实现局部潜在编辑,实验证明其优于现有方法,提升了一步图像编辑质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18438 2026-06-12 cs.CV 版本更新 85%

CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing

CPAM: 保持上下文的自适应操作用于零样本真实图像编辑

Dinh-Khoi Vo, Thanh-Toan Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * Faculty of Information Technology, University of Science, Ho Chi Minh City, Vietnam(越南科学大学信息科技学院) Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学) Faculty of Information Technology, Monash University, Melbourne, Victoria, Australia(莫纳什大学信息科技学院) Department of Computer Science, University of Dayton, Dayton, Ohio, US(Dayton 大学计算机科学系)

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出CPAM零样本框架,通过保持上下文的自适应操作和掩码引导,实现复杂非刚性真实图像的编辑,保留纹理和身份,无需微调。

Comments Accepted to IEEE Transactions on Multimedia. Project page: https://vdkhoi20.github.io/CPAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24942 2026-06-09 cs.CV 85%

BiFM: Bidirectional Flow Matching for Few-Step Image Editing and Generation

BiFM:双向流匹配用于少步图像编辑与生成

Yasong Dai, Zeeshan Hayder, David Ahmedt-Aristizabal, Hongdong Li

机构 * Australian National University(澳大利亚国立大学) Data61-CSIRO

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 BiFM通过双向流匹配框架统一学习生成与反向过程,解决少步采样中正向过程近似差问题,提升图像编辑质量与通用性。

Comments Accepted in CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06228 2026-06-05 cs.CV 85%

SAM-Flow: Source-Anchored Masked Flow for Training-Free Image Editing

SAM-Flow:源锚定掩码流用于免训练图像编辑

Haowang Cui, Rui Chen, Tao Luo, Tao Guo, Zheng Qin, Jiaze Wang

机构 * Tianjin Key Laboratory of Imaging and Sensing Microelectronic Technology, School of Microelectronics, Tianjin University(天津影像与传感微电子技术重点实验室,微电子学院,天津大学) School of Cyber Security, Tianjin University(网络安全学院,天津大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract,abstract_cn);分类 cs.CV

AI总结 提出SAM-Flow框架,通过源锚定掩码流和动态软掩码机制实现局部免训练图像编辑,有效防止背景泄漏。

Comments Code is available at: https://github.com/chwbob/Sam-Flow

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27505 2026-05-21 cs.CV 85%

Leveraging Verifier-Based Reinforcement Learning in Image Editing

利用基于验证器的强化学习进行图像编辑

Hanzhong Guo, Jie Wu, Jie Liu, Yu Gao, Zilyu Ye, Linxiao Yuan, Xionghui Wang, Yizhou Yu, Weilin Huang

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) Center for Embodied AI and Computer Vision, Shenzhen Loop Area Institute(具身人工智能与计算机视觉中心,深圳Loop Area研究院)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出Edit-R1框架,通过构建基于推理的验证器奖励模型(RRM)来解决图像编辑中缺乏稳健奖励模型的问题,该模型通过分解指令为不同原则并逐项评估图像,实现细粒度奖励,实验表明其在图像编辑任务中优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01908 2026-05-14 cs.CV 85%

Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning

基于推理的编辑:基于假设指令的图像编辑与视觉推理

Qingdong He, Xueqin Chen, Chaoyi Wang, Yanjie Pan, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Xiangtai Li, Jiangning Zhang

机构 * Tencent Youtu Lab(腾讯云图实验室) Sichuan University(四川大学) University of the Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出Reason50K数据集和ReasonBrain框架,通过多模态大语言模型和扩散模型实现复杂隐含指令的图像编辑,提升视觉推理能力。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25845 2026-05-01 cs.CV cs.AI 85%

Training-Free Reward-Guided Image Editing via Trajectory Optimal Control

无需训练的奖励引导图像编辑 via 轨迹最优控制

Jinho Chang, Jaemin Kim, Jong Chul Ye

机构 * Graduate School of Artificial Intelligence(人工智能研究生院) Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出无需训练的奖励引导图像编辑框架,将编辑过程建模为轨迹最优控制问题,通过迭代更新伴随状态以引导编辑过程,在保持源图像语义的同时提升目标奖励。

Comments Poster in ICLR 2026; 22 pages, 9 figures. The code is available at https://github.com/jinhojsk515/ITOC

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19406 2026-04-22 cs.CV cs.AI 85%

HP-Edit: A Human-Preference Post-Training Framework for Image Editing

HP-Edit:一种用于图像编辑的人类偏好后训练框架

Fan Li, Chonghuinan Wang, Lina Lei, Yuping Qiu, Jiaqi Xu, Jiaxiu Jiang, Xinran Qin, Zhikai Chen, Fenglong Song, Zhixin Wang, Renjing Pei, Wangmeng Zuo

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Harbin Institute of Technology(哈尔滨工业大学) Nankai University(南开大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出HP-Edit框架和RealPref-50K数据集,通过少量人类偏好评分数据和预训练视觉大语言模型开发自动评估器,提升图像编辑模型对人类偏好的契合度。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08477 2026-04-07 cs.CV cs.AI 85%

ContextDrag: Precise Drag-Based Image Editing via Context-Preserving Token Injection and Position-Aligned Attention

ContextDrag: 通过上下文保留的标记注入和位置对齐注意力实现精确的拖动式图像编辑

Huiguo He, Pengyu Yan, Ziqi Yi, Weizhi Zhong, Zheng Liu, Yejun Tang, Huan Yang, Guanbin Li, Lianwen Jin

机构 * School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息学院) KlingAI Research, Kuaishou Technology(快手科技KlingAI研究) The University of Hong Kong(香港大学) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出ContextDrag,首个将拖动式操作引入上下文图像编辑的框架,通过上下文保留的标记注入和位置对齐注意力实现精确拖动编辑,提升编辑精度与质量。

详情

展开后加载摘要…

URL PDF HTML 收藏