arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1257 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1257 篇

2305.04441 2023-05-09 cs.CV 89%

Prompt Tuning Inversion for Text-Driven Image Editing Using Diffusion Models

Wenkai Dong, Song Xue, Xiaoyue Duan, Shumin Han

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.09276 2023-03-21 cs.CV 89%

Imagic: Text-Based Real Image Editing with Diffusion Models

Bahjat Kawar, Shiran Zada, Oran Lang, Omer Tov, Huiwen Chang, Tali Dekel, Inbar Mosseri, Michal Irani

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://imagic-editing.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.07825 2022-11-16 cs.CV 89%

Direct Inversion: Optimization-Free Text-Driven Real Image Editing with Diffusion Models

Adham Elarabawy, Harish Kamath, Samuel Denton

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12965 2022-10-25 cs.CV cs.LG 89%

High-Resolution Image Editing via Multi-Stage Blended Diffusion

Johannes Ackermann, Minjun Li

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV

Comments Machine Learning for Creativity and Design Workshop at NeurIPS 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28067 2026-05-28 cs.AI 89%

BlazeEdit: Generalist Image Editing on Mobile Devices with Image-to-Image Diffusion Models

BlazeEdit: 基于图像到图像扩散模型的移动设备通用图像编辑

Fei Deng, Yanwu Xu, Zhipeng Bao, Zhixing Zhang, Haolin Jia, Karthik Raveendran, Jianing Wei

机构 * Google(谷歌)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract)

AI总结 提出BlazeEdit,一个仅195M参数的轻量级通用图像编辑扩散模型,通过消除文本条件组件和多任务架构,在移动设备上实现快速、隐私保护的图像编辑。

Comments Accepted to CVPR 2026 EDGE Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.11797 2023-02-24 cs.CV cs.GR cs.MM 89%

Region-Aware Diffusion for Zero-shot Text-driven Image Editing

Nisha Huang, Fan Tang, Weiming Dong, Tong-Yee Lee, Changsheng Xu

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.GR、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14539 2024-12-03 cs.CV 89%

Invertible Consistency Distillation for Text-Guided Image Editing in Around 7 Steps

Nikita Starodubcev, Mikhail Khoroshikh, Artem Babenko, Dmitry Baranchuk

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);diffusion(abstract)

Comments Project page: https://yandex-research.github.io/invertible-cd/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16894 2025-07-22 cs.CV cs.AI cs.MM 88%

PFB-Diff: Progressive Feature Blending Diffusion for Text-driven Image Editing

Wenjing Huang, Shikui Tu, Lei Xu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.MM

Comments Accepted by Neural Networks. Code is available at https://github.com/CMACH508/PFB-Diff

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18989 2025-04-29 cs.GR cs.CV cs.LG 88%

REED-VAE: RE-Encode Decode Training for Iterative Image Editing with Diffusion Models

Gal Almog, Ariel Shamir, Ohad Fried

机构 * Reichman University(雷赫曼大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.GR

Comments Accepted to Eurographics 2025. Project page: https://reed-vae.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00735 2024-08-02 cs.CV cs.GR 88%

TurboEdit: Text-Based Image Editing Using Few-Step Diffusion Models

Gilad Deutch, Rinon Gal, Daniel Garibi, Or Patashnik, Daniel Cohen-Or

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.GR

Comments Project page: https://turboedit-paper.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.09477 2023-07-06 cs.CV cs.GR cs.LG 88%

UniTune: Text-Driven Image Editing by Fine Tuning a Diffusion Model on a Single Image

Dani Valevski, Matan Kalman, Eyal Molad, Eyal Segalis, Yossi Matias, Yaniv Leviathan

专题命中 图像编辑 :image editing(title,abstract);diffusion(title);image generation(abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09322 2026-08-11 cs.CV 新提交 88%

Diffusion Image Editing via Asynchronous Token Decoding

基于异步令牌解码的扩散图像编辑

Yang Shi, Liangsi Lu, Minzhe Guo, Yifeng Xie, Yanhui Chen, Jingchao Wang, Xuhang Chen

机构 * Guangdong University of Technology(广东工业大学) Hong Kong Baptist University(香港浸会大学) Peking University(北京大学) Huizhou University(惠州学院)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 针对文本引导扩散图像编辑的全局漂移问题,提出推理时框架ATDEdit,通过逐令牌条件意外度估计可编辑位置,在PIE-Bench上实现最优保留指标且语义对齐性具竞争力。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13303 2026-08-03 cs.CV 版本更新 88%

DuET: Dual Expert Trajectories for Diffusion Image Editing

DuET: 双专家轨迹用于扩散图像编辑

Lidia Troeshestova, Alexander Ustyuzhanin, Sergey Kastryulin

机构 * HSE University(高等经济大学) Yandex

专题命中 图像编辑 :diffusion(title,abstract);image editing(title);text-to-image(abstract);分类 cs.CV

AI总结 提出训练自由的DuET方法,通过临时切换到文本到图像阶段再返回编辑模式,缓解源图像条件限制,提升编辑指令相关性、语义保真度和感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16291 2026-07-21 cs.CV 新提交 88%

Beyond Target Scores: Measuring Off-Target Drift in Diffusion-Based Medical Image Editing

超越目标分数:测量基于扩散的医学图像编辑中的偏离目标漂移

Todd Zhou

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 研究基于扩散的医学图像编辑中偏离目标漂移问题,引入CIB-Med-1基准及受约束扩散引导基线,通过多指标评估编辑效果,实验显示能保留目标进展并减少偏离目标漂移,强调应从轨迹级语义控制角度评估医学图像编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16399 2026-07-01 cs.CV cs.LG 版本更新 88%

Stable and Near-Reversible Diffusion ODE Solvers for Image Editing

稳定且近可逆的图像编辑扩散ODE求解器

Barbora Barancikova, Daniil Shmelev, Cristopher Salvi

机构 * Department of Computing, Imperial College London, London, United Kingdom(帝国理工学院伦敦分校计算机系,伦敦,英国) Department of Mathematics, Imperial College London, London, United Kingdom(帝国理工学院伦敦分校数学系,伦敦,英国)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 本文提出近可逆Runge-Kutta方法以提升图像编辑的稳定性与精度,平衡可逆性与数值稳定性,保留背景保真优势。

Comments ICML 2026 Workshop on Structured Probabilistic Inference & Generative Modeling (SPIGM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14125 2026-06-15 cs.CV cs.AI 新提交 88%

Conditioning Matters: Stabilizing Inversion and Attention in Diffusion Image Editing

条件至关重要:稳定扩散图像编辑中的反演与注意力

Zheyuan Zhan, Hongchen Li, Can Wang, Yinfei Ma, Mingzhen Huang, Ruoshi Bai, Jiawei Chen, Siwei Lyu, Defang Chen

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全全国重点实验室) HangZhou High-Tech Zong (Binjiang) Institute of Blockchain and Data Security(杭州高新技术产业开发区(滨江)区块链与数据安全研究院) College of Computer Science, Zhejiang University(浙江大学计算机科学与技术学院) University at Buffalo, State University of New York(纽约州立大学布法罗分校)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 本文提出SimEdit框架,通过优化文本条件精度和令牌级跨分支注意力控制,提升扩散模型反演稳定性和编辑保真度,在PIE-Bench上显著优于先前方法。

Comments Accepted to ECML PKDD 2026 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21176 2026-03-24 cs.CV 88%

GIDE: Unlocking Diffusion LLMs for Precise Training-Free Image Editing

GIDE: 解锁扩散大语言模型用于精确无训练图像编辑

Zifeng Zhu, Jiaming Han, Jiaxiang Zhao, Minnan Luo, Xiangyu Yue

机构 * Xi'an Jiaotong University MMLab, The Chinese University of Hong Kong(西安交通大学MMLab,香港中文大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 本文提出GIDE框架,通过离散噪声逆向机制实现无训练图像编辑,支持多种指令并保持背景不变,实验表明其在语义正确性和感知质量上显著优于现有方法。

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23907 2026-03-02 cs.CV 88%

Cora: Correspondence-aware image editing using few step diffusion

Cora: 基于对应关系的图像编辑使用少量步骤扩散

Amirhossein Alimohammadi, Aryan Mikaeili, Sauradip Nag, Negar Hassanpour, Andrea Tagliasacchi, Ali Mahdavi-Amiri

机构 * Simon Fraser University(西蒙弗雷泽大学) Huawei(华为) University of Toronto(多伦多大学) Google Deepmind(谷歌DeepMind)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 Cora通过引入对应关系感知的噪声校正和插值注意力图,实现了在少量步骤下精准的图像编辑,有效保持结构、纹理和身份,优于现有方法。

Comments Published in SIGGRAPH 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23105 2025-12-01 cs.CV 88%

NumeriKontrol: Adding Numeric Control to Diffusion Transformers for Instruction-based Image Editing

NumeriKontrol: 为基于指令的图像编辑添加数字控制

Zhenyu Xu, Xiaoqi Shen, Haotian Nan, Xinyu Zhang

机构 * East China Normal University(华东师范大学) South China University of Technology(华南理工大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 NumeriKontrol通过引入数字控制框架,实现基于指令的图像编辑中对编辑强度的精确控制,提升交互编辑的灵活性和精度。

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16888 2025-11-05 cs.CV 88%

Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback

Zongjian Li, Zheyuan Liu, Qihui Zhang, Bin Lin, Feize Wu, Shenghai Yuan, Zhiyuan Yan, Yang Ye, Wangbo Yu, Yuwei Niu, Shaodong Wang, Xinhua Cheng, Li Yuan

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25970 2025-10-31 cs.CV 88%

SplitFlow: Flow Decomposition for Inversion-Free Text-to-Image Editing

Sung-Hoon Yoon, Minghan Li, Gaspard Beaudouin, Congcong Wen, Muhammad Rafay Azhar, Mengyu Wang

机构 * Harvard AI and Robotics Lab, Harvard University(哈佛人工智能与机器人实验室,哈佛大学) École des Ponts, Institut Polytechnique de Paris(巴黎高等工业学院) New York University Abu Dhabi(纽约大学阿布扎克分校) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究学院)

专题命中 图像编辑 :image editing(title,abstract);text-to-image(title);image generation(abstract);分类 cs.CV

Comments Camera-ready version for NeurIPS 2025, 10 pages (main paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00313 2025-10-14 cs.CV 88%

Streamlining Image Editing with Layered Diffusion Brushes

Peyman Gholami, Robert Xiao

机构 * University of British Columbia(不列颠哥伦比亚大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2306.00219

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05978 2025-10-08 cs.CV 88%

Diffusion-Based Image Editing for Breaking Robust Watermarks

Yunyi Ni, Finn Carter, Ze Niu, Emily Davis, Bo Zhang

专题命中 图像编辑 :diffusion(title,abstract);image editing(title);image generation(abstract);分类 cs.CV

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05694 2025-09-30 cs.CV 88%

DiffusionGuard: A Robust Defense Against Malicious Diffusion-based Image Editing

June Suk Choi, Kyungmin Lee, Jongheon Jeong, Saining Xie, Jinwoo Shin, Kimin Lee

机构 * KAIST(韩国国立科学技术院) Korea University(韩国大学) NYU(纽约大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20690 2025-09-24 cs.CV 88%

In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer

Zechuan Zhang, Ji Xie, Yu Lu, Zongxin Yang, Yi Yang

机构 * ReLER, CCAI, Zhejiang University(研发实验室、中国人工智能学会、浙江大学) DBMI, HMS, Harvard University(生物医学信息研究所、哈佛医学院、哈佛大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025, there will be future updates for camera ready version. Code: https://github.com/River-Zhang/ICEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04582 2025-09-08 cs.CV 88%

Inpaint4Drag: Repurposing Inpainting Models for Drag-Based Image Editing via Bidirectional Warping

Jingyi Lu, Kai Han

机构 * Visual AI Lab, The University of Hong Kong(视觉人工智能实验室,香港大学)

专题命中 图像编辑 :image editing(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025. Project page: https://visual-ai.github.io/inpaint4drag/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04715 2025-08-26 cs.CV 88%

Addressing Text Embedding Leakage in Diffusion-based Image Editing

Sunung Mun, Jinhwan Nam, Sunghyun Cho, Jungseul Ok

机构 * Graduate School of AI, POSTECH(POSTECH人工智能研究生院) Dept. of CSE, POSTECH(POSTECH计算机科学与工程系)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12833 2025-08-13 cs.CV cs.AI cs.LG 88%

SPIE: Semantic and Structural Post-Training of Image Editing Diffusion Models with AI feedback

Elior Benarous, Yilun Du, Heng Yang

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04050 2025-06-30 cs.CV 88%

PartEdit: Fine-Grained Image Editing using Pre-Trained Diffusion Models

Aleksandar Cvejic, Abdelrahman Eldesokey, Peter Wonka

机构 * King Abdullah University of Science and Technology (KAUST)(卡斯特国王科学与技术大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments Accepted by SIGGRAPH 2025 (Conference Track). Project page: https://gorluxor.github.io/part-edit/

Journal ref SIGGRAPH 2025 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13301 2025-06-17 cs.CV 88%

AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing

Biao Yang, Muqi Huang, Yuhui Zhang, Yun Xiong, Kun Zhou, Xi Chen, Shiyang Zhou, Huishuai Bao, Chuan Li, Feng Shi, Hualei Liu

机构 * Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University(上海数据科学关键实验室,计算机科学学院,复旦大学) Rajax Network Technology (ele.me), Alibaba Group(RAJAX网络技术(饿了么),阿里巴巴集团)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏