arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-30 至 2026-03-30 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 6 篇

2603.25994 2026-03-30 cs.CV cs.CR 88%

Neighbor-Aware Localized Concept Erasure in Text-to-Image Diffusion Models

邻域感知的局部概念擦除在文本到图像扩散模型中

Zhuan Shi, Alireza Dehghanpour Farashah, Rik de Vries, Golnoosh Farnadi

机构 * McGill University(麦吉尔大学) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) EPFL(瑞士联邦理工学院洛桑分校)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种无需训练的框架,用于在移除目标概念的同时保护邻域概念。通过三个阶段处理:谱加权嵌入调节、注意力引导的空间门控和空间门控硬擦除,实现局部概念移除并保持周围概念结构。

Comments Accepted by CVPR 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24133 2026-03-30 cs.CV cs.AI 83%

Compositional Image Synthesis with Inference-Time Scaling

基于推理时缩放的图像合成

Minsuk Ji, Sanghyeok Lee, Namhyuk Ahn

机构 * Inha University(仁荷大学)

专题命中 文生图 :image synthesis(title);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出一种无需训练的框架,结合对象中心方法与自我完善,提升布局忠实度并保持美学质量,通过大语言模型生成布局并注入图像生成过程,利用对象中心视觉-语言模型进行迭代选择,实现更强的场景对齐。

Comments projcet page: https://github.com/gcl-inha/ReFocus

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26328 2026-03-30 cs.CV 79%

Verify Claimed Text-to-Image Models via Boundary-Aware Prompt Optimization

通过边界感知提示优化验证声称的文本到图像模型

Zidong Zhao, Yihao Huang, Qing Guo, Tianlin Li, Anran Li, Kailong Wang, Jin Song Dong, Geguang Pu

机构 * Zhejiang University(浙江大学) East China Normal University(华东师范大学) Nankai University(南开大学) Beihang University(北京航空航天大学) University of Science and Technology of China(中国科学技术大学) Huazhong University of Science and Technology(华中科技大学) National University of Singapore(新加坡国立大学)

专题命中 文生图 :text-to-image(title,abstract);分类 cs.CV

AI总结 本文提出边界感知提示优化方法,通过识别模型特定的边界相邻提示来验证文本到图像模型的真实性,实验显示其验证准确率优越。

Comments Accepted to CVPR 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25819 2026-03-30 cs.CV 79%

Geo$^\textbf{2}$: Geometry-Guided Cross-view Geo-Localization and Image Synthesis

Geo²:基于几何的跨视角地理定位与图像合成

Yancheng Zhang, Xiaohan Zhang, Guangyu Sun, Zonglin Lyu, Safwan Wshah, Chen Chen

机构 * Institute of Artificial Intelligence, University of Central Florida(中佛罗里达大学人工智能研究所) University of Vermont(佛蒙特大学)

专题命中 文生图 :image synthesis(title,abstract);分类 cs.CV

AI总结 本文提出Geo²框架,利用几何先验知识联合完成跨视角地理定位和双向图像合成,通过共享3D感知潜在空间和GeoFlow模型提升性能。

Journal ref 2026 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09867 2026-03-30 cs.HC cs.AI 78%

DesignWeaver: Dimensional Scaffolding for Text-to-Image Product Design

DesignWeaver:基于维度的文本到图像产品设计 scaffolding

Sirui Tao, Ivan Liang, Cindy Peng, Zhiqing Wang, Srishti Palani, Steven P. Dow

机构 * UC San Diego(加州大学圣迭戈分校) Carnegie Mellon University(卡内基梅隆大学) Tableau Research

专题命中 文生图 :text-to-image(title,abstract)

AI总结 DesignWeaver 通过从生成图像中提取关键产品设计维度,帮助新手生成更专业的提示,从而提升产品设计的多样性和创新性。

Comments 26 pages, 22 figures, CHI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25891 2026-03-30 cs.CV 57%

Few Shots Text to Image Retrieval: New Benchmarking Dataset and Optimization Methods

少样本文本到图像检索:新基准数据集和优化方法

Ofer Idan, Vladi Vexler, Gil Lederman, Dima Sivov, Aviad Cohen Zada, Shir Niego Komforti

机构 * Huawei Tel-Aviv Research Center(华为特拉维夫研究中心)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 本文提出FSIR任务及FSIR-BD数据集,通过少样本学习方法提升图像检索性能,实验表明其基准挑战性及优化方法优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏