Prompt Tuning Inversion for Text-Driven Image Editing Using Diffusion Models
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV
Comments Project page: https://imagic-editing.github.io/
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV
Comments Machine Learning for Creativity and Design Workshop at NeurIPS 2022
BlazeEdit: 基于图像到图像扩散模型的移动设备通用图像编辑
机构 * Google(谷歌)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract)
AI总结 提出BlazeEdit,一个仅195M参数的轻量级通用图像编辑扩散模型,通过消除文本条件组件和多任务架构,在移动设备上实现快速、隐私保护的图像编辑。
Comments Accepted to CVPR 2026 EDGE Workshop
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.GR、cs.MM
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);diffusion(abstract)
Comments Project page: https://yandex-research.github.io/invertible-cd/
机构 * Shanghai Jiao Tong University(上海交通大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.MM
Comments Accepted by Neural Networks. Code is available at https://github.com/CMACH508/PFB-Diff
机构 * Reichman University(雷赫曼大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.GR
Comments Accepted to Eurographics 2025. Project page: https://reed-vae.github.io/
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV、cs.GR
Comments Project page: https://turboedit-paper.github.io/
专题命中 图像编辑 :image editing(title,abstract);diffusion(title);image generation(abstract);分类 cs.CV、cs.GR
Comments SIGGRAPH 2023
基于异步令牌解码的扩散图像编辑
机构 * Guangdong University of Technology(广东工业大学) ; Hong Kong Baptist University(香港浸会大学) ; Peking University(北京大学) ; Huizhou University(惠州学院)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 针对文本引导扩散图像编辑的全局漂移问题,提出推理时框架ATDEdit,通过逐令牌条件意外度估计可编辑位置,在PIE-Bench上实现最优保留指标且语义对齐性具竞争力。
Comments Accepted by ACMMM 2026
DuET: 双专家轨迹用于扩散图像编辑
机构 * HSE University(高等经济大学) ; Yandex
专题命中 图像编辑 :diffusion(title,abstract);image editing(title);text-to-image(abstract);分类 cs.CV
AI总结 提出训练自由的DuET方法,通过临时切换到文本到图像阶段再返回编辑模式,缓解源图像条件限制,提升编辑指令相关性、语义保真度和感知质量。
超越目标分数:测量基于扩散的医学图像编辑中的偏离目标漂移
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 研究基于扩散的医学图像编辑中偏离目标漂移问题,引入CIB-Med-1基准及受约束扩散引导基线,通过多指标评估编辑效果,实验显示能保留目标进展并减少偏离目标漂移,强调应从轨迹级语义控制角度评估医学图像编辑。
稳定且近可逆的图像编辑扩散ODE求解器
机构 * Department of Computing, Imperial College London, London, United Kingdom(帝国理工学院伦敦分校计算机系,伦敦,英国) ; Department of Mathematics, Imperial College London, London, United Kingdom(帝国理工学院伦敦分校数学系,伦敦,英国)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 本文提出近可逆Runge-Kutta方法以提升图像编辑的稳定性与精度,平衡可逆性与数值稳定性,保留背景保真优势。
Comments ICML 2026 Workshop on Structured Probabilistic Inference & Generative Modeling (SPIGM)
条件至关重要:稳定扩散图像编辑中的反演与注意力
机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全全国重点实验室) ; HangZhou High-Tech Zong (Binjiang) Institute of Blockchain and Data Security(杭州高新技术产业开发区(滨江)区块链与数据安全研究院) ; College of Computer Science, Zhejiang University(浙江大学计算机科学与技术学院) ; University at Buffalo, State University of New York(纽约州立大学布法罗分校)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 本文提出SimEdit框架,通过优化文本条件精度和令牌级跨分支注意力控制,提升扩散模型反演稳定性和编辑保真度,在PIE-Bench上显著优于先前方法。
Comments Accepted to ECML PKDD 2026 Research Track
GIDE: 解锁扩散大语言模型用于精确无训练图像编辑
机构 * Xi'an Jiaotong University MMLab, The Chinese University of Hong Kong(西安交通大学MMLab,香港中文大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 本文提出GIDE框架,通过离散噪声逆向机制实现无训练图像编辑,支持多种指令并保持背景不变,实验表明其在语义正确性和感知质量上显著优于现有方法。
Comments 25 pages, 7 figures
Cora: 基于对应关系的图像编辑使用少量步骤扩散
机构 * Simon Fraser University(西蒙弗雷泽大学) ; Huawei(华为) ; University of Toronto(多伦多大学) ; Google Deepmind(谷歌DeepMind)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 Cora通过引入对应关系感知的噪声校正和插值注意力图,实现了在少量步骤下精准的图像编辑,有效保持结构、纹理和身份,优于现有方法。
Comments Published in SIGGRAPH 2025
NumeriKontrol: 为基于指令的图像编辑添加数字控制
机构 * East China Normal University(华东师范大学) ; South China University of Technology(华南理工大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
AI总结 NumeriKontrol通过引入数字控制框架,实现基于指令的图像编辑中对编辑强度的精确控制,提升交互编辑的灵活性和精度。
Comments 13 pages, 10 figures
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
机构 * Harvard AI and Robotics Lab, Harvard University(哈佛人工智能与机器人实验室,哈佛大学) ; École des Ponts, Institut Polytechnique de Paris(巴黎高等工业学院) ; New York University Abu Dhabi(纽约大学阿布扎克分校) ; Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究学院)
专题命中 图像编辑 :image editing(title,abstract);text-to-image(title);image generation(abstract);分类 cs.CV
Comments Camera-ready version for NeurIPS 2025, 10 pages (main paper)
机构 * University of British Columbia(不列颠哥伦比亚大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:2306.00219
专题命中 图像编辑 :diffusion(title,abstract);image editing(title);image generation(abstract);分类 cs.CV
Comments Preprint
机构 * KAIST(韩国国立科学技术院) ; Korea University(韩国大学) ; NYU(纽约大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
Comments Preprint. Under review
机构 * ReLER, CCAI, Zhejiang University(研发实验室、中国人工智能学会、浙江大学) ; DBMI, HMS, Harvard University(生物医学信息研究所、哈佛医学院、哈佛大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
Comments Accepted by NeurIPS 2025, there will be future updates for camera ready version. Code: https://github.com/River-Zhang/ICEdit
机构 * Visual AI Lab, The University of Hong Kong(视觉人工智能实验室,香港大学)
专题命中 图像编辑 :image editing(title,abstract);inpainting(title,abstract);分类 cs.CV
Comments Accepted to ICCV 2025. Project page: https://visual-ai.github.io/inpaint4drag/
机构 * Graduate School of AI, POSTECH(POSTECH人工智能研究生院) ; Dept. of CSE, POSTECH(POSTECH计算机科学与工程系)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
Comments Accepted to ICCV 2025
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
机构 * King Abdullah University of Science and Technology (KAUST)(卡斯特国王科学与技术大学)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV
Comments Accepted by SIGGRAPH 2025 (Conference Track). Project page: https://gorluxor.github.io/part-edit/
Journal ref SIGGRAPH 2025 Conference Proceedings
机构 * Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University(上海数据科学关键实验室,计算机科学学院,复旦大学) ; Rajax Network Technology (ele.me), Alibaba Group(RAJAX网络技术(饿了么),阿里巴巴集团)
专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV