arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2602.19083 2026-03-26 cs.CV 83%

ChordEdit: One-Step Low-Energy Transport for Image Editing

ChordEdit: 图像编辑中的一步低能耗传输

Liangsi Lu, Xuhang Chen, Minzhe Guo, Shichu Li, Jingchao Wang, Yang Shi

机构 * Guangdong University of Technology(广东工业大学) Huizhou University(惠州大学) Shenzhen University(深圳大学) Peking University(北京大学)

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出ChordEdit,一种无需训练和反向传播的图像编辑方法,通过动态最优传输理论实现低能耗、高精度的一步编辑,解决传统方法在图像编辑中出现的失真和不一致性问题。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20644 2026-03-25 cs.CV 83%

ScaleEdit-12M: Scaling Open-Source Image Editing Data Generation via Multi-Agent Framework

ScaleEdit-12M:通过多智能体框架实现开源图像编辑数据生成的规模化

Guanzhou Chen, Erfei Cui, Changyao Tian, Danni Yang, Ganlin Yang, Yu Qiao, Hongsheng Li, Gen Luo, Hongjie Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多模态实验室) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Xiamen University(厦门大学)

专题命中 图像编辑 :image editing(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出ScaleEditor框架,通过多智能体方法构建大规模高质量图像编辑数据集,生成ScaleEdit-12M,涵盖23类任务,提升多种编辑模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17876 2026-03-19 cs.CV 83%

Edit Spillover as a Probe: Do Image Editing Models Implicitly Understand World Relations?

编辑溢出作为探测器:图像编辑模型是否隐式理解世界关系?

Guandong Li, Zhaobin Chu

机构 * iFLYTEK

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 研究探讨图像编辑模型中编辑溢出现象,通过系统框架评估不同模型的隐式世界理解能力,发现溢出率差异显著,且语义相关性溢出反映真实理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12949 2026-03-16 eess.IV cs.CR cs.MM 83%

Editing Away the Evidence: Diffusion-Based Image Manipulation and the Failure Modes of Robust Watermarking

去除证据:基于扩散的图像篡改与鲁棒水印的失效模式

Qian Qi, Jiangyun Tang, Jim Lee, Emily Davis, Finn Carter

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.MM

AI总结 本文分析了基于扩散的图像编辑对鲁棒水印的影响,指出非对抗性编辑可能无意中降低或消除水印,提出水印信号与噪声比和互信息的界限,揭示信息论上无法恢复的条件。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08059 2026-03-10 cs.CV cs.AI 83%

ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning

ImageEdit-R1: 通过强化学习提升多智能体图像编辑

Yiran Zhao, Yaoqi Ye, Xiang Liu, Michael Qizhe Shieh, Trung Bui

机构 * National University of Singapore(新加坡国立大学) Adobe Research(Adobe研究)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 ImageEdit-R1通过强化学习实现多智能体图像编辑,提升复杂指令下的编辑效果与上下文感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20839 2026-03-04 cs.CV 83%

Training-Free Multi-Concept Image Editing

无需训练的多概念图像编辑

Niki Foteinopoulou, Ignas Budvytis, Stephan Liwicki

机构 * Cambridge Research Laboratory, Toshiba Europe(东芝欧洲剑桥研究实验室)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 提出无需训练的多概念图像编辑方法,通过概念蒸馏采样实现多视觉概念的无缝组合与控制,提升图像编辑的精度与细节表现。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21778 2026-03-02 cs.CV 83%

From Statics to Dynamics: Physics-Aware Image Editing with Latent Transition Priors

从静态到动态:基于物理的图像编辑与潜在过渡先验

Liangbing Zhao, Le Zhuo, Sayak Paul, Hongsheng Li, Mohamed Elhoseiny

机构 * CUHK MMLab(香港中文大学多模态实验室)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出PhysicEdit,通过引入物理状态过渡和大规模数据集,提升图像编辑的物理真实性和知识引导能力,达到开源方法的新水平。

Comments All code, checkpoints, and datasets are available at https://liangbingzhao.github.io/statics2dynamics/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03467 2026-02-27 cs.CV 83%

ThinkRL-Edit: Thinking in Reinforcement Learning for Reasoning-Centric Image Editing

ThinkRL-Edit: 基于强化学习的图像编辑推理框架

Hengjia Li, Liming Jiang, Qing Yan, Yizhi Song, Hao Kang, Zichuan Liu, Xin Lu, Boxi Wu, Deng Cai

机构 * Zhejiang University(浙江大学)

专题命中 图像编辑 :image editing(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 ThinkRL-Edit通过引入链式推理和无偏奖励策略,提升图像编辑的推理能力,实现更精准和稳定的编辑效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21087 2026-02-26 cs.CV 83%

MIRA: Multimodal Iterative Reasoning Agent for Image Editing

MIRA: 多模态迭代推理代理用于图像编辑

Ziyun Zeng, Hang Hua, Jiebo Luo

机构 * University of Rochester(罗切斯特大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 MIRA通过多模态迭代推理代理提升图像编辑的语义一致性和感知质量,结合自研数据集和训练流程,实现与专有系统相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08785 2026-02-10 cs.CV cs.AI 83%

DeltaSpace: A Semantic-aligned Feature Space for Flexible Text-guided Image Editing

DeltaSpace: 一种语义对齐的特征空间用于灵活的文本引导图像编辑

Yueming Lyu, Kang Zhao, Bo Peng, Huafeng Chen, Yue Jiang, Yingya Zhang, Jing Dong, Caifeng Shan

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 DeltaSpace通过语义对齐的特征空间实现文本引导图像编辑的灵活训练和推理,支持零样本推理和无需文本的训练。

Comments 18 pages. arXiv admin note: text overlap with arXiv:2303.06285

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10498 2026-01-28 cs.CV 83%

TweezeEdit: Consistent and Efficient Image Editing with Path Regularization

TweezeEdit: 通过路径正则化实现一致且高效的图像编辑

Jianda Mao, Kaibo Wang, Yang Xiang, Kani Chen

机构 * Department of Mathematics, The Hong Kong University of Science and Technology, Hong Kong SAR(数学系,香港科学与技术大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 TweezeEdit通过路径正则化实现高效一致的图像编辑,无需调优和倒置,提升语义保留和实时性能。

Journal ref AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16645 2026-01-26 cs.CV 83%

Edge-Aware Image Manipulation via Diffusion Models with a Novel Structure-Preservation Loss

通过扩散模型实现边缘感知图像处理:一种新的结构保持损失

Minsu Gong, Nuri Ryu, Jungseul Ok, Sunghyun Cho

机构 * Planby Technologies(Planby技术公司) POSTECH

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出了一种新的结构保持损失,用于提升潜在扩散模型在图像编辑中的边缘结构保真度,通过局部线性模型量化结构差异并结合后处理步骤和掩码策略,实现了更高质量的图像编辑效果。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05397 2026-01-12 cs.CV 83%

Neural-Driven Image Editing

神经驱动的图像编辑

Pengfei Zhou, Jie Xia, Xiaopeng Peng, Wangbo Zhao, Zilong Ye, Zekai Li, Suorong Yang, Jiadong Pan, Yuanxiang Chen, Ziqiao Wang, Kai Wang, Qian Zheng, Hao Jin, Xiaojun Chang, Gang Pan, Shurong Dong, Kaipeng Zhang, Yang You

机构 * NUS(国立新加坡大学) ZJU(浙江大学) RIT(罗切斯特理工学院) NJU(南京大学) USTC(中国科学技术大学) Shanghai AI Lab(上海人工智能实验室) SII(上海信息所) Hangzhou RongNao Tech(杭州融纳科技)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 LoongX通过多模态神经信号驱动图像编辑,结合扩散模型和对比学习实现高性能图像编辑任务。

Comments 22 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14423 2025-12-18 cs.CV 83%

The Devil is in Attention Sharing: Improving Complex Non-rigid Image Editing Faithfulness via Attention Synergy

注意力共享中的魔鬼:通过注意力协同提升复杂非刚性图像编辑的忠实性

Zhuo Chen, Fanyue Wei, Runze Xu, Jingjing Li, Lixin Duan, Angela Yao, Wen Li

机构 * University of Electronic Science and Technology of China(电子科技大学) National University of Singapore(新加坡国立大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 SynPS通过协同利用位置嵌入和语义信息,解决现有注意力共享机制中的注意力崩溃问题,提升复杂非刚性图像编辑的忠实性。

Comments Project page:https://synps26.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14320 2025-12-17 cs.CV cs.AI cs.CY cs.LG 83%

Semantic Mismatch and Perceptual Degradation: A New Perspective on Image Editing Immunity

语义不匹配与感知退化:图像编辑免疫的新视角

Shuai Dong, Jie Zhang, Guoying Zhao, Shiguang Shan, Xilin Chen

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of China Academy of Sciences(中国科学院大学) Center for Machine Vision and Signal Analysis, University of Oulu(信号分析中心,奥卢大学) School of Computer Science, China University of Geosciences(计算机科学学院,中国地质大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出SIFM方法和ISR度量标准,通过语义不匹配和感知退化来评估图像编辑免疫效果,提升对抗恶意扩散式操纵的能力。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13276 2025-12-16 cs.CV 83%

CogniEdit: Dense Gradient Flow Optimization for Fine-Grained Image Editing

CogniEdit: 密集梯度流优化用于细粒度图像编辑

Yan Li, Lin Liu, Xiaopeng Zhang, Wei Xue, Wenhan Luo, Yike Guo, Qi Tian

机构 * Hongkong University of Science and Technology(香港科学与技术大学) Huawei Company(华为公司)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 CogniEdit通过密集梯度流优化实现细粒度图像编辑,结合多模态推理与动态令牌焦点重新定位,提升指令遵循与视觉质量的平衡

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11395 2025-12-15 cs.CV 83%

FlowDC: Flow-Based Decoupling-Decay for Complex Image Editing

FlowDC: 基于流的解耦-衰减用于复杂图像编辑

Yilei Jiang, Zhen Wang, Yanghao Wang, Jun Yu, Yueting Zhuang, Jun Xiao, Long Chen

机构 * Zhejiang University(浙江大学) HKUST(香港科技大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 FlowDC通过解耦和衰减技术提升复杂图像编辑的源一致性与语义对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03981 2025-12-04 cs.CV 83%

DirectDrag: High-Fidelity, Mask-Free, Prompt-Free Drag-based Image Editing via Readout-Guided Feature Alignment

DirectDrag: 一种高保真、无掩码、无提示的拖动图像编辑方法通过读取引导的特征对齐

Sheng-Hao Liao, Shang-Fu Chen, Tai-Ming Huang, Wen-Huang Cheng, Kai-Lung Hua

机构 * National Taiwan University of Science and Technology(台湾科技大学) National Taiwan University(台湾大学) Microsoft Taiwan(微软台湾)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 DirectDrag通过读取引导的特征对齐方法实现无掩码、无提示的拖动图像编辑,提升图像质量和拖动精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03142 2025-12-04 cs.CV 83%

UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying

UniEdit-I: 基于迭代理解、编辑和验证的无训练图像编辑

Chengyu Bai, Jintao Chen, Xiang Bai, Yilong Chen, Qi She, Ming Lu, Shanghang Zhang

机构 * Peking University(北京大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 UniEdit-I通过在语义潜在空间中引入迭代理解、编辑和验证循环,实现了无训练的闭环图像编辑,无需微调或架构修改即可达到最先进的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03046 2025-12-03 cs.CV 83%

MagicQuillV2: Precise and Interactive Image Editing with Layered Visual Cues

MagicQuillV2: 基于分层视觉提示的精确交互式图像编辑

Zichen Liu, Yue Yu, Hao Ouyang, Qiuyu Wang, Shuailei Ma, Ka Leong Cheng, Wen Wang, Qingyan Bai, Yuxuan Zhang, Yanhong Zeng, Yixuan Li, Xing Zhu, Yujun Shen, Qifeng Chen

机构 * HKUST(香港科技大学) Ant Group(蚂蚁集团) NEU(南京大学) ZJU(浙江大学) CUHK(香港中文大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 MagicQuillV2通过分层视觉提示实现精确交互式图像编辑,解决传统生成模型与图形软件间的控制与语义平衡问题。

Comments Code and demo available at https://magicquill.art/v2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22625 2025-12-02 cs.CV 83%

ReasonEdit: Towards Reasoning-Enhanced Image Editing Models

ReasonEdit: 向推理增强的图像编辑模型迈进

Fukun Yin, Shiyu Liu, Yucheng Han, Zhibo Wang, Peng Xing, Rui Wang, Wei Cheng, Yingming Wang, Aojie Li, Zixin Yin, Pengtao Chen, Xiangyu Zhang, Daxin Jiang, Xianfang Zeng, Gang Yu

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 ReasonEdit通过引入思考和反思机制,提升图像编辑模型的推理能力,实现更准确的编辑效果。

Comments code: https://github.com/stepfun-ai/Step1X-Edit

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24657 2025-12-01 cs.CV 83%

Group Relative Attention Guidance for Image Editing

基于组相对注意力的图像编辑

Xuanpu Zhang, Xuesong Niu, Ruidong Chen, Dan Song, Jianhao Zeng, Penghui Du, Haoxiang Cao, Kai Wu, An-an Liu

机构 * Tianjin University(天津大学) Kolors Team, Kuaishou Technology(快手科技Kolors团队)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 GRAG通过组相对注意力机制实现对图像编辑强度的连续精细控制,无需额外调整。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18055 2025-11-25 cs.CV cs.AI cs.CL 83%

IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment

IE-Critic-R1: 推动文本驱动图像编辑的解释性测量以实现人类感知对齐

Bowen Qu, Shangkun Sun, Xiaoyu Liang, Wei Gao

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Peng Cheng Laboratory, China(鹏城实验室,中国)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

AI总结 IE-Critic-R1通过强化学习从可验证奖励提升文本驱动图像编辑的解释性评估,实现与人类感知的对齐。

Comments 18 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14760 2025-11-19 cs.CV 83%

UniGen-1.5: Enhancing Image Generation and Editing through Reward Unification in Reinforcement Learning

Rui Tian, Mingfei Gao, Haiming Gang, Jiasen Lu, Zhe Gan, Yinfei Yang, Zuxuan Wu, Afshin Dehghan

机构 * Institute of Trustworthy Embodied AI, Fudan University(可信具身人工智能研究院,复旦大学) Apple(苹果公司)

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01119 2025-11-19 cs.CV cs.LG 83%

The Promise of RL for Autoregressive Image Editing

Saba Ahmadi, Rabiul Awal, Ankur Sikarwar, Amirhossein Kazemnejad, Ge Ya Luo, Juan A. Rodriguez, Sai Rajeswar, Siva Reddy, Christopher Pal, Benno Krojer, Aishwarya Agrawal

机构 * Mila – Quebec AI Institute(魁北克AI研究所) Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) École de Technologie Supérieure (ETS)(高等技术学院) Polytechnique Montréal(蒙特利尔理工学院) ServiceNow(ServiceNow公司) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12151 2025-11-18 cs.CV 83%

FIA-Edit: Frequency-Interactive Attention for Efficient and High-Fidelity Inversion-Free Text-Guided Image Editing

Kaixiang Yang, Boyang Shen, Xin Li, Yuchen Dai, Yuxuan Luo, Yueran Ma, Wei Fang, Qiang Li, Zhiwei Wang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20217 2025-11-10 cs.CV 83%

EditInfinity: Image Editing with Binary-Quantized Generative Models

Jiahuan Wang, Yuxin Chen, Jun Yu, Guangming Lu, Wenjie Pei

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 28 pages, 13 figures, accepted by The Thirty-ninth Annual Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27335 2025-11-03 cs.CV 83%

Understanding the Implicit User Intention via Reasoning with Large Language Model for Image Editing

Yijia Wang, Yiqing Shen, Weiming Chen, Zhihai He

机构 * Southern University of Science and Technology, Shenzhen, China(南方科技大学) Johns Hopkins University, Baltimore, USA(约翰霍普金斯大学) Pengcheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22337 2025-10-28 cs.CV 83%

GeoDiffusion: A Training-Free Framework for Accurate 3D Geometric Conditioning in Image Generation

Phillip Mueller, Talip Uenlue, Sebastian Schmidt, Marcel Kollovieh, Jiajie Fan, Stephan Guennemann, Lars Mikelsons

机构 * University of Augsburg(奥格斯堡大学) BMW Group(宝马集团) Technical University of Munich(慕尼黑技术大学) Leiden University(莱顿大学)

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06937 2025-10-28 cs.CV cs.AI 83%

CannyEdit: Selective Canny Control and Dual-Prompt Guidance for Training-Free Image Editing

Weiyan Xie, Han Gao, Didan Deng, Kaican Li, April Hua Liu, Yongxiang Huang, Nevin L. Zhang

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project Page: vaynexie.github.io/CannyEdit/; MindSpore Code: github.com/mindspore-lab/mindone/tree/master/examples/canny_edit; PyTorch Code: github.com/vaynexie/CannyEdit

详情

展开后加载摘要…

URL PDF HTML 收藏