arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2311.10089 2023-11-17 cs.CV cs.AI cs.LG 83%

Emu Edit: Precise Image Editing via Recognition and Generation Tasks

Shelly Sheynin, Adam Polyak, Uriel Singer, Yuval Kirstain, Amit Zohar, Oron Ashual, Devi Parikh, Yaniv Taigman

专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.10073 2023-10-19 cs.CV 83%

DialogPaint: A Dialog-based Image Editing Model

Jingxuan Wei, Shiyu Wu, Xin Jiang, Yequan Wang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14934 2023-09-27 cs.CV 83%

FEC: Three Finetuning-free Methods to Enhance Consistency for Real Image Editing

Songyan Chen, Jiancheng Huang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.12849 2023-09-20 cs.CV 83%

Complex Scene Image Editing by Scene Graph Comprehension

Zhongping Zhang, Huiwen He, Bryan A. Plummer, Zhenyu Liao, Huayan Wang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to BMVC 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.12624 2023-08-21 cs.CV 83%

DreamEdit: Subject-driven Image Editing

Tianle Li, Max Ku, Cong Wei, Wenhu Chen

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04157 2023-07-12 cs.CV 83%

DIFF-NST: Diffusion Interleaving For deFormable Neural Style Transfer

Dan Ruta, Gemma Canet Tarrés, Andrew Gilbert, Eli Shechtman, Nicholas Kolkin, John Collomosse

专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05414 2023-07-07 cs.CV 83%

Improving Tuning-Free Real Image Editing with Proximal Guidance

Ligong Han, Song Wen, Qi Chen, Zhixing Zhang, Kunpeng Song, Mengwei Ren, Ruijiang Gao, Anastasis Stathopoulos, Xiaoxiao He, Yuxiao Chen, Di Liu, Qilong Zhangli, Jindong Jiang, Zhaoyang Xia, Akash Srivastava, Dimitris Metaxas

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Added inversion guidance, and fixed typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00522 2023-07-04 cs.CV cs.AI cs.LG 83%

LEDITS: Real Image Editing with DDPM Inversion and Semantic Guidance

Linoy Tsaban, Apolinário Passos

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 8 pages, 5 figures, 1 table. This report builds up on the works introduced in - arXiv:2304.06140, arXiv:2301.12247

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02717 2023-06-06 cs.CV 83%

User-friendly Image Editing with Minimal Text Input: Leveraging Captioning and Injection Techniques

Sunwoo Kim, Wooseok Jang, Hyunsu Kim, Junho Kim, Yunjey Choi, Seungryong Kim, Gayeong Lee

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05947 2023-05-11 cs.CV 83%

iEdit: Localised Text-guided Image Editing with Weak Supervision

Rumeysa Bodur, Erhan Gundogdu, Binod Bhattarai, Tae-Kyun Kim, Michael Donoser, Loris Bazzani

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11829 2023-04-26 cs.CV cs.AI 83%

Hierarchical Diffusion Autoencoders and Disentangled Image Manipulation

Zeyu Lu, Chengyue Wu, Xinyuan Chen, Yaohui Wang, Lei Bai, Yu Qiao, Xihui Liu

专题命中 图像编辑 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05866 2023-04-13 cs.CV cs.LG 83%

NoisyTwins: Class-Consistent and Diverse Image Generation through StyleGANs

Harsh Rangwani, Lavish Bansal, Kartik Sharma, Tejan Karmali, Varun Jampani, R. Venkatesh Babu

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

Comments CVPR 2023. Project Page: https://rangwani-harsh.github.io/NoisyTwins/

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04344 2023-04-11 cs.CV cs.LG 83%

Towards Real-time Text-driven Image Manipulation with Unconditional Diffusion Models

Nikita Starodubcev, Dmitry Baranchuk, Valentin Khrulkov, Artem Babenko

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04506 2022-10-11 cs.CV 83%

Bridging CLIP and StyleGAN through Latent Alignment for Image Editing

Wanfeng Zheng, Qiang Li, Xiaoyan Guo, Pengfei Wan, Zhongyuan Wang

专题命中 图像编辑 :image editing(title);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 20 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.01036 2022-10-11 cs.CV 83%

GANSeg: Learning to Segment by Unsupervised Hierarchical Image Generation

Xingzhe He, Bastian Wandt, Helge Rhodin

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.02711 2022-08-12 cs.CV cs.AI cs.LG 83%

DiffusionCLIP: Text-Guided Diffusion Models for Robust Image Manipulation

Gwanghyun Kim, Taesung Kwon, Jong Chul Ye

专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.15264 2022-07-22 cs.CV cs.LG 83%

EdiBERT, a generative model for image editing

Thibaut Issenhuth, Ugo Tanielian, Jérémie Mary, David Picard

专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.06125 2022-04-14 cs.CV 83%

Hierarchical Text-Conditional Image Generation with CLIP Latents

Aditya Ramesh, Prafulla Dhariwal, Alex Nichol, Casey Chu, Mark Chen

专题命中 图像编辑 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.01318 2022-04-05 cs.CV cs.AI 83%

Flexible Portrait Image Editing with Fine-Grained Control

Linlin Liu, Qian Fu, Fei Hou, Ying He

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.08422 2022-03-17 cs.CV 83%

Attribute Group Editing for Reliable Few-shot Image Generation

Guanqi Ding, Xinzhe Han, Shuhui Wang, Shuzhe Wu, Xin Jin, Dandan Tu, Qingming Huang

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

Comments CVPR2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.07238 2020-07-15 cs.CV 83%

Modeling Artistic Workflows for Image Generation and Editing

Hung-Yu Tseng, Matthew Fisher, Jingwan Lu, Yijun Li, Vladimir Kim, Ming-Hsuan Yang

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

Comments ECCV 2020. Code: https://github.com/hytseng0509/ArtEditing

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04128 2026-05-21 cs.GR cs.AI cs.CL cs.CV cs.LG 82%

JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation

JoyAI-Image: 激活统一多模态理解和生成中的空间智能

Lin Song, Wenbo Li, Guoqing Ma, Wei Tang, Bo Wang, Yuan Zhang, Yijun Yang, Yicheng Xiao, Jianhui Liu, Yanbing Zhang, Guohui Zhang, Wenhu Zhang, Hang Xu, Nan Jiang, Xin Han, Haoze Sun, Maoquan Zhang, Haoyang Huang, Nan Duan

机构 * Joy Future Academy, JD(京东探索研究院)

专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)

AI总结 本文提出JoyAI-Image,一种统一的多模态基础模型,用于视觉理解、文本到图像生成和指令引导的图像编辑。该模型结合了空间增强的多模态大语言模型(MLLM)和多模态扩散Transformer(MMDiT),通过共享的多模态接口实现感知与生成的交互。构建可扩展的训练配方,结合统一指令微调、长文本渲染监督、空间 grounded 数据和通用及空间编辑信号,使模型具备广泛的多模态能力,同时增强几何感知推理和可控视觉合成。实验表明,JoyAI-Image在理解、生成、长文本渲染和编辑基准上达到最先进的性能。更重要的是,增强的理解、可控的空间编辑和新视角辅助推理之间的双向循环使模型超越一般视觉能力,向更强的空间智能发展。

Comments Code: https://github.com/jd-opensource/JoyAI-Image

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14681 2025-06-02 cs.CR 82%

TrojanEdit: Multimodal Backdoor Attack Against Image Editing Model

Ji Guo, Peihong Chen, Wenbo Jiang, Xiaolei Wen, Jiaming He, Jiachen Li, Guoming Lu, Aiguo Chen, Hongwei Li

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20600 2025-05-28 cs.DC cs.AI cs.LG 82%

InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling

Xiaoxiao Jiang, Suyi Li, Lingyun Yang, Tianyu Feng, Zhipeng Di, Weiyi Lu, Guoxuan Zhu, Xiu Lin, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang, Wei Wang

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Alibaba Group(阿里巴巴集团)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07424 2025-04-11 cs.AI 82%

Routing to the Right Expertise: A Trustworthy Judge for Instruction-based Image Editing

Chenxi Sun, Hongzhi Zhang, Qi Wang, Fuzheng Zhang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12688 2024-07-18 cs.CR 82%

Robust-Wide: Robust Watermarking against Instruction-driven Image Editing

Runyi Hu, Jie Zhang, Ting Xu, Jiwei Li, Tianwei Zhang

专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract)

Comments European Conference on Computer Vision (ECCV) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06588 2023-02-14 cs.LG 82%

Raising the Cost of Malicious AI-Powered Image Editing

Hadi Salman, Alaa Khaddaj, Guillaume Leclerc, Andrew Ilyas, Aleksander Madry

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25578 2026-07-21 cs.CV 版本更新 81%

H-Adapter: Pose-Robust Hairstyle Transfer via Attention-Derived, Source-Aligned Hair Masks

H-Adapter: 通过注意力导出的源对齐头发掩码实现姿态鲁棒的发型迁移

Seulgi Jeong, Yunseong Cho, Sanghun Park

机构 * SNOW Corp.(SNOW公司)

专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);inpainting(abstract)

AI总结 提出H-Adapter,利用区域特定损失解耦头发与非头发目标,导出源对齐头发编辑掩码引导扩散修复,实现大姿态差异下的鲁棒发型迁移,在FID、FID_CLIP和CLIP-I指标上取得最优。

Comments Accepted at ECCV 2026. Project page: https://sanghunpark.github.io/hadapter_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16794 2024-04-15 cs.CV 81%

ZONE: Zero-Shot Instruction-Guided Local Editing

Shanglin Li, Bohan Zeng, Yutang Feng, Sicheng Gao, Xuhui Liu, Jiaming Liu, Li Lin, Xu Tang, Yao Hu, Jianzhuang Liu, Baochang Zhang

专题命中 图像编辑 :text-to-image(abstract);diffusion(abstract);image editing(abstract);image synthesis(abstract)

Comments Accepted at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04372 2024-04-02 cs.CV cs.CL 81%

MoEController: Instruction-based Arbitrary Image Manipulation with Mixture-of-Expert Controllers

Sijia Li, Chen Chen, Haonan Lu

专题命中 图像编辑 :image generation(abstract);diffusion(abstract);image editing(abstract);image synthesis(abstract)

Comments 6 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏