arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86350 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

1808.06801 2018-08-22 cs.CV 88%

Text-to-image Synthesis via Symmetrical Distillation Networks

Mingkuan Yuan, Yuxin Peng

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);分类 cs.CV

Comments 9 pages, accepted as an oral paper of ACM Multimedia 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.05091 2018-07-27 cs.CV 88%

Inferring Semantic Layout for Hierarchical Text-to-Image Synthesis

Seunghoon Hong, Dingdong Yang, Jongwook Choi, Honglak Lee

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);分类 cs.CV

Comments CVPR 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1708.09321 2017-08-31 cs.CV 88%

Adversarial nets with perceptual losses for text-to-image synthesis

Miriam Cha, Youngjune Gwon, H. T. Kung

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00616 2026-05-14 cs.AI 88%

SPOT: Selective Prompt Projection via Total Variation for Inference-Only Safe Text-to-Image Generation

SPOT:基于总变分的选性提示投影用于仅推理的文本到图像生成

Minhyuk Lee, Hyekyung Yoon, Myungjoo Kang

机构 * Seoul National University(首尔国立大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract)

AI总结 本文提出SPOT框架,通过总变分约束生成器参考分布,实现对文本到图像生成中不安全内容的抑制,同时保持良性提示的行为,实验显示其在多个数据集上显著降低不适当评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20470 2026-03-24 cs.AI 88%

DiffGraph: An Automated Agent-driven Model Merging Framework for In-the-Wild Text-to-Image Generation

DiffGraph: 一种自动化代理驱动的模型融合框架用于真实场景的文本到图像生成

Zhuoling Li, Hossein Rahmani, Jiarui Zhang, Yu Xue, Majid Mirmehdi, Jason Kuen, Jiuxiang Gu, Jun Liu

机构 * Lancaster University(兰卡斯特大学) University of Bristol(布里斯托大学) Adobe Research(Adobe研究院)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract)

AI总结 DiffGraph通过自动化整合在线专家资源,灵活融合不同模型以满足多样化的真实用户需求,提升了文本到图像生成的效能。

Comments CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18767 2026-03-20 cs.AI 88%

A Concept is More Than a Word: Diversified Unlearning in Text-to-Image Diffusion Models

一个概念远不止一个词:文本到图像扩散模型中的多样化去学习

Duc Hao Pham, Van Duy Truong, Duy Khanh Dinh, Tien Cuong Nguyen, Dien Hy Ngo, Tuan Anh Bui

机构 * VNPT AI(VNPT人工智能研究院) VNPT Group(VNPT集团) Independent Researcher(独立研究员)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 本文提出多样化去学习框架,通过多样化提示集而非单一关键词表示概念,提升去学习的精度与鲁棒性,实验表明其在多个基准和最新基线中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12004 2026-02-13 cs.AI 88%

CSEval: A Framework for Evaluating Clinical Semantics in Text-to-Image Generation

CSEval: 一个用于评估文本到图像生成中临床语义的框架

Robert Cronshaw, Konstantinos Vilouras, Junyu Yan, Yuning Du, Feng Chen, Steven McDonagh, Sotirios A. Tsaftaris

机构 * School of Engineering, University of Edinburgh, United Kingdom(爱丁堡大学工程学院)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

AI总结 CSEval通过语言模型评估文本到图像生成中临床语义的一致性,弥补现有方法在临床相关性评估上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20391 2026-01-29 cs.IR 88%

Eliminating Hallucination in Diffusion-Augmented Interactive Text-to-Image Retrieval

消除扩散增强交互式文本到图像检索中的幻觉

Zhuocheng Zhang, Kangheng Liang, Guanxuan Li, Paul Henderson, Richard Mccreadie, Zijun Long

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 本文提出DMCL框架,通过引入语义一致性和扩散感知对比目标,有效消除DAI-TIR中的幻觉问题,提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06837 2026-01-22 cs.CR 88%

Towards Effective Prompt Stealing Attack against Text-to-Image Diffusion Models

面向文本到图像扩散模型的有效提示窃取攻击

Shiqian Zhao, Chong Wang, Yiming Li, Yihao Huang, Wenjie Qu, Siew-Kei Lam, Yi Xie, Kangjie Chen, Jie Zhang, Tianwei Zhang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 Prometheus通过动态修饰符和上下文匹配算法,实现无需训练的提示窃取攻击,有效提升对多种扩散模型的攻击成功率。

Comments This paper proposes an effective training-free, proxy-in-the-loop, and search-based prompt-stealing scheme against T2I models

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13462 2026-01-21 cs.AI 88%

SpatialBench-UC: Uncertainty-Aware Evaluation of Spatial Prompt Following in Text-to-Image Generation

SpatialBench-UC: 文本到图像生成中空间提示遵循的不确定性感知评估

Amine Rostane

机构 * ESIEA

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract)

AI总结 SpatialBench-UC通过评估文本到图像生成中空间提示遵循的不确定性,提出了一个可重复的基准测试,以提高模型在空间指令下的表现和置信度评估。

Comments 19 pages, includes figures and tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13933 2025-11-27 cs.CR 88%

EnTruth: Enhancing the Traceability of Unauthorized Dataset Usage in Text-to-image Diffusion Models with Minimal and Robust Alterations

EnTruth:通过最小和稳健的修改增强文本到图像扩散模型中未经授权数据集使用的可追溯性

Jie Ren, Yingqian Cui, Chen Chen, Yue Xing, Hui Liu, Lingjuan Lyu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 EnTruth通过模板记忆技术,提升文本到图像扩散模型中未经授权数据集使用的可追溯性,实现版权保护与生成模型检测的创新应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24012 2025-10-29 cs.LG cs.AI 88%

Training-Free Safe Text Embedding Guidance for Text-to-Image Diffusion Models

Byeonghu Na, Mina Kang, Jiseok Kwak, Minsang Park, Jiwoo Shin, SeJoon Jun, Gayoung Lee, Jin-Hwa Kim, Il-Chul Moon

机构 * KAIST(韩国科学技术院) NAVER AI Lab(NAVER人工智能实验室) SNU AIIS(首尔国立大学人工智能研究所)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12910 2025-10-15 cs.AI 88%

Taming Text-to-Image Synthesis for Novices: User-centric Prompt Generation via Multi-turn Guidance

Yilun Liu, Minggui He, Feiyu Yao, Yuhe Ji, Shimin Tao, Jingzhou Du, Duan Li, Jian Gao, Li Zhang, Hao Yang, Boxing Chen, Osamu Yoshie

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract)

Comments Accepted by EMNLP 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10633 2025-10-14 cs.AI 88%

Collaborative Text-to-Image Generation via Multi-Agent Reinforcement Learning and Semantic Fusion

Jiabao Shi, Minfeng Qi, Lefeng Zhang, Di Wang, Yingjie Zhao, Ziying Li, Yalong Xing, Ningran Li

机构 * Minzu University of China(民族大学) City University of Macau(澳门城市大学) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(计算能力网络与信息安全重点实验室,教育部,山东计算机科学中心(济南国家超级计算机中心),齐鲁工业大学(山东省科学院)) The University of Adelaide(阿德莱德大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02814 2025-10-06 cs.HC 88%

PromptMap: Supporting Exploratory Text-to-Image Generation

Yuhan Guo, Xingyou Liu, Xiaoru Yuan, Kai Xu

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17790 2025-09-23 physics.med-ph eess.IV 88%

Conditional Diffusion Models for CT Image Synthesis from CBCT: A Systematic Review

Alzahra Altalib, Chunhui Li, Alessandro Perelli

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract)

Comments 36 pages, 8 figures, 3 tables, submitted to Elsevier Computerized Medical Imaging and Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06453 2025-08-05 cs.CR 88%

Efficient Input-level Backdoor Defense on Text-to-Image Synthesis via Neuron Activation Variation

Shengfang Zhai, Jiajun Li, Yue Liu, Huanran Chen, Zhihua Tian, Wenjie Qu, Qingni Shen, Ruoxi Jia, Yinpeng Dong, Jiaheng Zhang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract)

Comments 20 pages. ICCV 2025 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12036 2025-07-02 cs.LG cs.AI 88%

A Minimalist Method for Fine-tuning Text-to-Image Diffusion Models

Yanting Miao, William Loh, Pacal Poupart, Suraj Kothawade

机构 * Department of Computer Science University of Waterloo, Vector Institute(计算机科学系 温哥华大学,向量研究所)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16092 2025-06-03 cs.CL cs.CY cs.LG 88%

Multilingual Text-to-Image Generation Magnifies Gender Stereotypes and Prompt Engineering May Not Help You

Felix Friedrich, Katharina Hämmerl, Patrick Schramowski, Manuel Brack, Jindrich Libovicky, Kristian Kersting, Alexander Fraser

机构 * TU Darmstadt(图宾根大学) Ontocord(Ontocord公司) Technical University of Munich (TUM)(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) CERTAIN(CERTAIN公司) DFKI(德意志联邦防务研究院) Charles University Prague(布拉格查理大学) Centre for Cognitive Science, Darmstadt(达姆施塔特认知科学中心) Munich Data Science Institute(慕尼黑数据科学研究所)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10329 2025-04-16 cs.CR cs.AI cs.CL 88%

Safe Text-to-Image Generation: Simply Sanitize the Prompt Embedding

Huming Qiu, Guanxu Chen, Mi Zhang, Xiaohan Zhang, Xiaoyu You, Min Yang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10166 2025-04-03 cs.LG cs.AI 88%

Automated Filtering of Human Feedback Data for Aligning Text-to-Image Diffusion Models

Yongjin Yang, Sihyeon Kim, Hojung Jung, Sangmin Bae, SangMook Kim, Se-Young Yun, Kimin Lee

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments ICLR 2025; Project Page available at : https://sprain02.github.io/FiFA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10164 2024-11-18 cs.RO 88%

Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data

Thomas Lips, Francis wyffels

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments Submitted to RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07728 2024-09-13 cs.CR 88%

Moderator: Moderating Text-to-Image Diffusion Models through Fine-grained Context-based Policies

Peiran Wang, Qiyu Li, Longxuan Yu, Ziyao Wang, Ang Li, Haojian Jin

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments Accepted by ACM CCS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11393 2024-09-04 cs.CY cs.AI 88%

The Cultivated Practices of Text-to-Image Generation

Jonas Oppenlaender

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

Comments In "Humane autonomous technology - Re-thinking experience with and in intelligent systems", Palgrave Macmillan, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15238 2024-08-20 cs.CL cs.AI cs.LG 88%

Learning Using Generated Privileged Information by Text-to-Image Diffusion Models

Rafael-Edy Menadil, Mariana-Iuliana Georgescu, Radu Tudor Ionescu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments Accepted at ICPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00230 2024-08-06 cs.AI cs.CL 88%

Lost in Translation: Latent Concept Misalignment in Text-to-Image Diffusion Models

Juntu Zhao, Junyu Deng, Yixin Ye, Chongxuan Li, Zhijie Deng, Dequan Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract)

Comments Accepted by the 18th European Conference on Computer Vision ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09923 2024-04-16 cs.CR cs.LG 88%

Prompt Stealing Attacks Against Text-to-Image Generation Models

Xinyue Shen, Yiting Qu, Michael Backes, Yang Zhang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07562 2024-02-14 cs.CR cs.AI 88%

Discovering Universal Semantic Triggers for Text-to-Image Synthesis

Shengfang Zhai, Weilong Wang, Jiajun Li, Yinpeng Dong, Hang Su, Qingni Shen

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract)

Comments 9 pages, 5 figures. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11127 2023-09-21 eess.SP cs.AI cs.CL 88%

Language-Oriented Communication with Semantic Coding and Knowledge Distillation for Text-to-Image Generation

Hyelin Nam, Jihong Park, Jinho Choi, Mehdi Bennis, Seong-Lyun Kim

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

Comments 5 pages, 4 figures, submitted to 2024 IEEE International Conference on Acoustics, Speech and Signal Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08363 2023-08-21 cs.HC cs.AI cs.CY 88%

Perceptions and Realities of Text-to-Image Generation

Jonas Oppenlaender, Johanna Silvennoinen, Ville Paananen, Aku Visuri

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract)

Comments ACM Academic Mindtrek 2023

详情

展开后加载摘要…

URL PDF HTML 收藏