arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-24 至 2026-03-24 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 3 篇

2603.21176 2026-03-24 cs.CV 88%

GIDE: Unlocking Diffusion LLMs for Precise Training-Free Image Editing

GIDE: 解锁扩散大语言模型用于精确无训练图像编辑

Zifeng Zhu, Jiaming Han, Jiaxiang Zhao, Minnan Luo, Xiangyu Yue

机构 * Xi'an Jiaotong University MMLab, The Chinese University of Hong Kong(西安交通大学MMLab,香港中文大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

AI总结 本文提出GIDE框架,通过离散噪声逆向机制实现无训练图像编辑,支持多种指令并保持背景不变,实验表明其在语义正确性和感知质量上显著优于现有方法。

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21615 2026-03-24 cs.CV 79%

AdaEdit: Adaptive Temporal and Channel Modulation for Flow-Based Image Editing

AdaEdit: 一种基于流的图像编辑中的自适应时间与通道调节

Guandong Li, Zhaobin Chu

机构 * iFLYTEK

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出AdaEdit框架,通过自适应的渐进注入策略和通道选择性潜在扰动,解决流匹配模型中源特征注入与目标特征生成的矛盾,提升图像编辑效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01755 2026-03-24 cs.CV 79%

FreqEdit: Preserving High-Frequency Features for Robust Multi-Turn Image Editing

FreqEdit: 为鲁棒多轮图像编辑保留高频特征

Yucheng Liao, Jiajun Liang, Kaiqian Cui, Baoquan Zhao, Haoran Xie, Wei Liu, Qing Li, Xudong Mao

机构 * School of Artificial Intelligence, Sun Yat-sen University(中山大学人工智能学院) Lingnan University(岭大大学) Video Rebirth The Hong Kong Polytechnic University(香港理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出FreqEdit框架,通过高频特征注入、自适应注入策略和路径补偿机制,解决多轮图像编辑中高频信息丢失问题,提升编辑稳定性和指令遵循能力。

详情

展开后加载摘要…

URL PDF HTML 收藏