arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3474 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2506.18946 2025-06-25 cs.CV cs.AI 88%

DiffRIS: Enhancing Referring Remote Sensing Image Segmentation with Pre-trained Text-to-Image Diffusion Models

Zhe Dong, Yuzhe Sun, Tianzhu Liu, Yanfeng Gu

机构 * School of Electronics and Information Engineering, Harbin Institute of Technology(电子信息工程学院,哈尔滨工业大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18325 2025-06-24 cs.CV 88%

NSFW-Classifier Guided Prompt Sanitization for Safe Text-to-Image Generation

Yu Xie, Chengjie Zeng, Lingyun Zhang, Yanwei Fu

机构 * Purple Mountain Laboratories(紫金山实验室) Fudan University(复旦大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12633 2025-06-17 cs.CV cs.LG 88%

Performance Plateaus in Inference-Time Scaling for Text-to-Image Diffusion Without External Models

Changhyun Choi, Sungha Kim, H. Jin Kim

机构 * Interdisciplinary Program in Artificial Intelligence, Seoul National University(人工智能交叉学科项目,首尔国立大学) Aerospace Engineering, Seoul National University(航空航天工程,首尔国立大学) ASRI, AIIS, Seoul National University(ASRI、AIIS,首尔国立大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments MOSS workshop at ICML 2025 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11434 2025-06-16 cs.CV 88%

Auditing Data Provenance in Real-world Text-to-Image Diffusion Models for Privacy and Copyright Protection

Jie Zhu, Leye Wang

机构 * Key Lab of High Confidence Software Technologies (Peking University)(高可信软件技术重点实验室(北京大学)) Ministry of Education(教育部) School of Computer Science(计算机学院)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Under Review; A user-level accuracy of 90% in a real-world auditing scenario

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16368 2025-06-04 cs.CV 88%

Concept Corrector: Erase concepts on the fly for text-to-image diffusion models

Zheling Meng, Bo Peng, Xiaochuan Jin, Yueming Lyu, Wei Wang, Jing Dong, Tieniu Tan

机构 * NLPR, Institute of Automation CAS(自动化研究所国家工程实验室) School of Artificial Intelligence UCAS(自动化学院人工智能学院) Nanjing University(南京大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23493 2025-05-30 cs.CV cs.CL 88%

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Kaijie Chen, Zihao Lin, Zhiyang Xu, Ying Shen, Yuguang Yao, Joy Rimchala, Jiaxin Zhang, Lifu Huang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments Project Page: https://r2i-bench.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19063 2025-05-28 cs.CV 88%

Training-free Stylized Text-to-Image Generation with Fast Inference

Xin Ma, Yaohui Wang, Xinyuan Chen, Tien-Tsin Wong, Cunjian Chen

机构 * Department of Data Science & AI, Faculty of Information Technology, Monash University(莫纳什大学数据科学与人工智能系,信息科技学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 文生图 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

Comments Project Page: https://maxin-cn.github.io/omnipainter_project

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03187 2025-05-27 cs.CV cs.AI cs.HC cs.LG 88%

FERGI: Automatic Scoring of User Preferences for Text-to-Image Generation from Spontaneous Facial Expression Reaction

Shuangquan Feng, Junhua Ma, Virginia R. de Sa

机构 * Neurosciences Graduate Program, University of California San Diego(加州大学圣地亚哥分校神经科学研究生项目) Department of Computer Science and Engineering, University of California San Diego(加州大学圣地亚哥分校计算机科学与工程系) Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系) Halıcıoğlu Data Science Institute, University of California San Diego(加州大学圣地亚哥分校Halıcıoğlu数据科学研究所)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15779 2025-05-22 cs.CV cs.AI 88%

IA-T2I: Internet-Augmented Text-to-Image Generation

Chuanhao Li, Jianwen Sun, Yukang Feng, Mingliang Zhai, Yifan Chang, Kaipeng Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Nankai University(南开大学) Beijing Institute of Technology(北京理工大学) University of Science and Technology of China(中国科学技术大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments 12 pages, 7 figures, a framework that integrates reference images from the Internet into T2I/TI2I models

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14232 2025-05-21 cs.CV cs.AI cs.CL cs.LG 88%

CRCE: Coreference-Retention Concept Erasure in Text-to-Image Diffusion Models

Yuyang Xue, Edward Moroshko, Feng Chen, Jingyu Sun, Steven McDonagh, Sotirios A. Tsaftaris

机构 * School of Engineering University of Edinburgh(工程学院 苏格兰爱丁堡大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10743 2025-05-19 cs.CV 88%

IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation

Amritanshu Tiwari, Cherish Puniani, Kaustubh Sharma, Ojasva Nema

机构 * Indian Institute of Technology Roorkee(印度理工学院罗尔基分校)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11824 2025-05-14 cs.CV 88%

TextCenGen: Attention-Guided Text-Centric Background Adaptation for Text-to-Image Generation

Tianyi Liang, Jiangqi Liu, Yifei Huang, Shiqi Jiang, Jianshen Shi, Changbo Wang, Chenhui Li

机构 * Chenhui Li(李晨辉)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04851 2025-05-09 cs.AI cs.CL cs.CV cs.CY cs.LG 88%

CRAFT: Cultural Russian-Oriented Dataset Adaptation for Focused Text-to-Image Generation

Viacheslav Vasilev, Vladimir Arkhipkin, Julia Agafonova, Tatiana Nikulina, Evelina Mironova, Alisa Shichanina, Nikolai Gerasimenko, Mikhail Shoytov, Denis Dimitrov

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments This is arxiv version of the paper which was accepted for the Doklady Mathematics Journal in 2024

Journal ref Doklady Mathematics, 110 (Suppl 1), S137-S150, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04650 2025-05-09 cs.GR cs.AI cs.IR cs.LG 88%

Multimodal Benchmarking and Recommendation of Text-to-Image Generation Models

Kapil Wanaskar, Gaytri Jena, Magdalini Eirinaki

机构 * Computer Engineering Dept. San José State University(计算机工程系圣何塞州立大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01490 2025-05-06 cs.CV 88%

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Daoan Zhang, Che Jiang, Ruoshi Xu, Biaoxiang Chen, Zijian Jin, Yutian Lu, Jianguo Zhang, Liang Yong, Jiebo Luo, Shengda Luo

机构 * University of Rochester(罗切斯特大学) Chinese Medicine Guangdong Laboratory(广东中医实验室) Southern University of Science and Technology(南方科技大学) New York University(纽约大学) Datawhale org(Datawhale组织)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01104 2025-05-05 cs.CV 88%

VSC: Visual Search Compositional Text-to-Image Diffusion Model

Do Huu Dat, Nam Hyeonu, Po-Yuan Mao, Tae-Hyun Oh

机构 * VinUniversity(文大学) POSTECH(POSTECH大学) Academia Sinica(学术院) KAIST(韩国科学技术院)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09503 2025-05-02 cs.CV 88%

AnyStory: Towards Unified Single and Multiple Subject Personalization in Text-to-Image Generation

Junjie He, Yuxiang Tuo, Binghui Chen, Chongyang Zhong, Yifeng Geng, Liefeng Bo

机构 * Institute for Intelligent Computing, Alibaba Tongyi Lab(智能计算研究院,阿里通义实验室)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments Tech report; Project page: https://aigcdesigngroup.github.io/AnyStory/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18159 2025-05-01 cs.CV 88%

Type-R: Automatically Retouching Typos for Text-to-Image Generation

Wataru Shimoda, Naoto Inoue, Daichi Haraguchi, Hayato Mitani, Seiichi Uchida, Kota Yamaguchi

机构 * CyberAgent Kyushu University(九州大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2025. Codes: https://github.com/CyberAgentAILab/Type-R

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14554 2025-04-22 cs.CR cs.CV 88%

REDEditing: Relationship-Driven Precise Backdoor Poisoning on Text-to-Image Diffusion Models

Chongye Guo, Jinhu Fu, Junfeng Fang, Kun Wang, Guorui Feng

机构 * Shanghai University(上海大学) Beijing University of Posts and Telecommunications(北京邮电大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);image generation(abstract);分类 cs.CV

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14534 2025-04-22 cs.CV 88%

SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization

Liang Peng, Boxi Wu, Haoran Cheng, Yibo Zhao, Xiaofei He

机构 * FABU Inc.(FABU公司) Zhejiang University(浙江大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21943 2025-04-08 cs.CV cs.AI eess.IV 88%

Parametric Shadow Control for Portrait Generation in Text-to-Image Diffusion Models

Haoming Cai, Tsung-Wei Huang, Shiv Gehlot, Brandon Y. Feng, Sachin Shah, Guan-Ming Su, Christopher Metzler

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ShadowDirector Arxiv Version. Fix the arxiv title text issue

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11706 2025-04-08 cs.CV 88%

FRAP: Faithful and Realistic Text-to-Image Generation with Adaptive Prompt Weighting

Liyao Jiang, Negar Hassanpour, Mohammad Salameh, Mohan Sai Singamsetti, Fengyu Sun, Wei Lu, Di Niu

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments TMLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07838 2025-04-07 cs.CV cs.AI cs.LG 88%

Minority-Focused Text-to-Image Generation via Prompt Optimization

Soobin Um, Jong Chul Ye

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments CVPR 2025 (Oral), 21 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01819 2025-04-03 cs.CV cs.AI 88%

Implicit Bias Injection Attacks against Text-to-Image Diffusion Models

Huayang Huang, Xiangye Jin, Jiaxu Miao, Yu Wu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accept to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16807 2025-04-03 cs.CV 88%

STEREO: A Two-Stage Framework for Adversarially Robust Concept Erasing from Text-to-Image Diffusion Models

Koushik Srivatsan, Fahad Shamshad, Muzammal Naseer, Vishal M. Patel, Karthik Nandakumar

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR-2025. Code: https://github.com/koushiksrivats/robust-concept-erasing

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04852 2025-04-01 cs.CV 88%

SleeperMark: Towards Robust Watermark against Fine-Tuning Text-to-image Diffusion Models

Zilan Wang, Junfeng Guo, Jiacheng Zhu, Yiming Li, Heng Huang, Muhao Chen, Zhengzhong Tu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16257 2025-03-31 cs.CV cs.AI cs.CR 88%

PromptLA: Towards Integrity Verification of Black-box Text-to-Image Diffusion Models

Zhuomeng Zhang, Fangqi Li, Chong Di, Hongyu Zhu, Hanyi Wang, Shilin Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19937 2025-03-27 cs.CV cs.AI 88%

Reverse Prompt: Cracking the Recipe Inside Text-to-Image Generation

Zhiyao Ren, Yibing Zhan, Baosheng Yu, Dacheng Tao

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19783 2025-03-26 cs.CV 88%

Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models

Kartik Thakral, Tamar Glaser, Tal Hassner, Mayank Vatsa, Richa Singh

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Published in CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02168 2025-03-26 cs.CV 88%

Generative Photography: Scene-Consistent Camera Control for Realistic Text-to-Image Synthesis

Yu Yuan, Xijun Wang, Yichen Sheng, Prateek Chennuri, Xingguang Zhang, Stanley Chan

专题命中 文生图 :text-to-image(title);image synthesis(title);image generation(abstract);diffusion(abstract)

Comments Accepted by CVPR 2025. Project page: https://generative-photography.github.io/project/

详情

展开后加载摘要…

URL PDF HTML 收藏