arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3480 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2410.22725 2025-05-30 cs.CV cs.CR 83%

One Prompt to Verify Your Models: Black-Box Text-to-Image Models Verification via Non-Transferable Adversarial Attacks

Ji Guo, Wenbo Jiang, Rui Zhang, Guoming Lu, Hongwei Li

机构 * Laboratory of Intelligent Collaborative Computing, University of Electronic Science and Technology of China(电子科技大学智能协同计算实验室,电子科技大学) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院,电子科技大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05359 2025-05-28 cs.CV 83%

SC-Pro: Training-Free Framework for Defending Unsafe Image Synthesis Attack

Junha Park, Jaehui Hwang, Ian Ryu, Hyungkeun Park, Jiyoon Kim, Jong-Seok Lee

机构 * Yonsei University(延世大学)

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16875 2025-05-23 cs.CV cs.AI cs.LG 83%

T2I-ConBench: Text-to-Image Benchmark for Continual Post-training

Zhehao Huang, Yuhang Liu, Yixin Lou, Zhengbao He, Mingzhen He, Wenxing Zhou, Tao Li, Kehan Li, Zeyi Huang, Xiaolin Huang

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16314 2025-05-23 cs.CV cs.AI 83%

NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment

Shuhao Han, Haotian Fan, Fangyuan Kong, Wenjie Liao, Chunle Guo, Chongyi Li, Radu Timofte, Liang Li, Tao Li, Junhui Cui, Yunqiu Wang, Yang Tai, Jingwei Sun, Jianhui Sun, Xinli Yue, Tianyi Wang, Huan Hou, Junda Lu, Xinyang Huang, Zitang Zhou, Zijian Zhang, Xuhui Zheng, Xuecheng Wu, Chong Peng, Xuezhi Cao, Trong-Hieu Nguyen-Mau, Minh-Hoang Le, Minh-Khoa Le-Phan, Duy-Nam Ly, Hai-Dang Nguyen, Minh-Triet Tran, Yukang Lin, Yan Hong, Chuanbiao Song, Siyuan Li, Jun Lan, Zhichao Zhang, Xinyue Li, Wei Sun, Zicheng Zhang, Yunhao Li, Xiaohong Liu, Guangtao Zhai, Zitong Xu, Huiyu Duan, Jiarui Wang, Guangji Ma, Liu Yang, Lu Liu, Qiang Hu, Xiongkuo Min, Zichuan Wang, Zhenchen Tang, Bo Peng, Jing Dong, Fengbin Guan, Zihao Yu, Yiting Lu, Wei Luo, Xin Li, Minhao Lin, Haofeng Chen, Xuanxuan He, Kele Xu, Qisheng Xu, Zijian Gao, Tianjiao Wan, Bo-Cheng Qiu, Chih-Chung Hsu, Chia-ming Lee, Yu-Fan Lin, Bo Yu, Zehao Wang, Da Mu, Mingxiu Chen, Junkang Fang, Huamei Sun, Wending Zhao, Zhiyu Wang, Wang Liu, Weikang Yu, Puhong Duan, Bin Sun, Xudong Kang, Shutao Li, Shuai He, Lingzhi Fu, Heng Cong, Rongyu Zhang, Jiarong He, Zhishan Qiao, Yongqing Huang, Zewen Chen, Zhe Pang, Juan Wang, Jian Guo, Zhizhuo Shao, Ziyu Feng, Bing Li, Weiming Hu, Hesong Li, Dehua Liu, Zeming Liu, Qingsong Xie, Ruichen Wang, Zhihao Li, Yuqi Liang, Jianqi Bi, Jun Luo, Junfeng Yang, Can Li, Jing Fu, Hongwei Xu, Mingrui Long, Lulin Tang

机构 * NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment(NTIRE 2025挑战)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14202 2025-05-23 cs.CV cs.AI 83%

Learning Joint ID-Textual Representation for ID-Preserving Image Synthesis

Zichuan Liu, Liming Jiang, Qing Yan, Yumin Jia, Hao Kang, Xin Lu

机构 * ByteDance Intelligent Creation(字节跳动智能创作)

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05678 2025-05-20 cs.CV 83%

InstanceGen: Image Generation with Instance-level Instructions

Etai Sella, Yanir Kleiman, Hadar Averbuch-Elor

机构 * Tel Aviv University(特拉维夫大学) Meta AI Cornell University(康奈尔大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to SIGGRAPH 2025. Project page: https://tau-vailab.github.io/InstanceGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03844 2025-05-13 eess.IV cs.AI cs.CV 83%

From Spaceborne to Airborne: SAR Image Synthesis Using Foundation Models for Multi-Scale Adaptation

Solene Debuysere, Nicolas Trouve, Nathan Letheule, Olivier Leveque, Elise Colin

机构 * ONERA - DEMR Université Paris Saclay(巴黎萨克雷大学) ONERA - DTIS

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05501 2025-05-12 cs.CV cs.AI eess.IV 83%

Preliminary Explorations with GPT-4o(mni) Native Image Generation

Pu Cao, Feng Zhou, Junyi Ji, Qingye Kong, Zhixiang Lv, Mingjian Zhang, Xuekun Zhao, Siqi Wu, Yinghui Lin, Qing Song, Lu Yang

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05538 2025-05-01 cs.CV cs.PF 83%

Not Just Text: Uncovering Vision Modality Typographic Threats in Image Generation Models

Hao Cheng, Erjia Xiao, Jiayan Yang, Jiahang Cao, Qiang Zhang, Jize Zhang, Kaidi Xu, Jindong Gu, Renjing Xu

机构 * CVPR Proceedings(CVPR会议)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments This paper is accept by CVPR2025 (https://cvpr.thecvf.com/virtual/2025/poster/34964)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16719 2025-04-29 cs.CV cs.LG 83%

Progressive Compositionality in Text-to-Image Generative Models

Evans Xu Han, Linghao Jin, Xiaofeng Liu, Paul Pu Liang

机构 * Yale University(耶鲁大学) University of Southern California(南加州大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10329 2025-04-22 cs.CV 83%

InstructEngine: Instruction-driven Text-to-Image Alignment

Xingyu Lu, Yuhang Hu, YiFan Zhang, Kaiyu Jiang, Changyi Liu, Tianke Zhang, Jinpeng Wang, Chun Yuan, Bin Wen, Fan Yang, Tingting Gao, Di Zhang

机构 * Tsinghua University(清华大学) Kuaishou Technology(快手科技) CASIA(中国科学院自动化研究所)

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11707 2025-04-17 cs.CV cs.AI 83%

Towards Safe Synthetic Image Generation On the Web: A Multimodal Robust NSFW Defense and Million Scale Dataset

Muhammad Shahid Muneer, Simon S. Woo

专题命中 文生图 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Short Paper The Web Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15240 2025-04-02 cs.CV 83%

BIGbench: A Unified Benchmark for Evaluating Multi-dimensional Social Biases in Text-to-Image Models

Hanjun Luo, Haoyu Huang, Ziye Deng, Xinfeng Li, Hewei Wang, Yingbin Jin, Yang Liu, Wenyuan Xu, Zuozhu Liu

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2405.17814

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16071 2025-03-31 cs.CV cs.AI 83%

Semantic Image Synthesis via Class-Adaptive Cross-Attention

Tomaso Fontanini, Claudio Ferrari, Giuseppe Lisanti, Massimo Bertozzi, Andrea Prati

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Code and models available at https://github.com/TFonta/CA2SIS The paper is under consideration at Computer Vision and Image Understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01128 2025-03-27 cs.CV 83%

SSP: A Simple and Safe automatic Prompt engineering method towards realistic image synthesis on LVM

Weijin Cheng, Jianzhi Liu, Jiawen Deng, Fuji Ren

专题命中 文生图 :image synthesis(title);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 10 pages, 8 figures

Journal ref 2024 IEEE International Conference on Systems, Man, and Cybernetics (SMC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19312 2025-03-26 cs.CV 83%

ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning

Jiaqi Liao, Zhengyuan Yang, Linjie Li, Dianqi Li, Kevin Lin, Yu Cheng, Lijuan Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Project Page: https://ImageGen-CoT.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12018 2025-03-18 cs.CV cs.AI 83%

Compose Your Aesthetics: Empowering Text-to-Image Models with the Principles of Art

Zhe Jin, Tat-Seng Chua

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08520 2025-03-18 cs.CV 83%

GroundingBooth: Grounding Text-to-Image Customization

Zhexiao Xiong, Wei Xiong, Jing Shi, He Zhang, Yizhi Song, Nathan Jacobs

专题命中 文生图 :text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Project page: https://groundingbooth.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08464 2025-03-11 cs.CV 83%

CC-Diff: Enhancing Contextual Coherence in Remote Sensing Image Synthesis

Mu Zhang, Yunfan Liu, Yue Liu, Yuzhong Zhao, Qixiang Ye

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19227 2025-02-27 cs.CV cs.CR 83%

Espresso: Robust Concept Filtering in Text-to-Image Models

Anudeep Das, Vasisht Duddu, Rui Zhang, N. Asokan

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments ACM Conference on Data and Application Security and Privacy (CODASPY), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20759 2025-02-12 cs.LG cs.CV 83%

Information Theoretic Text-to-Image Alignment

Chao Wang, Giulio Franzese, Alessandro Finamore, Massimo Gallo, Pietro Michiardi

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments to appear at ICLR25

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11071 2025-02-07 cs.CR cs.AI cs.CV 83%

DiffZOO: A Purely Query-Based Black-Box Attack for Red-teaming Text-to-Image Generative Model via Zeroth Order Optimization

Pucheng Dang, Xing Hu, Dong Li, Rui Zhang, Qi Guo, Kaidi Xu

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14599 2025-01-09 cs.CV 83%

Stylebreeder: Exploring and Democratizing Artistic Styles through Text-to-Image Models

Matthew Zheng, Enis Simsar, Hidir Yesiltepe, Federico Tombari, Joel Simon, Pinar Yanardag

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at NeurIPS 2024 D&B Track, Project page: https://stylebreeder.github.io HuggingFace DB Page: https://huggingface.co/datasets/stylebreeder/stylebreeder

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01633 2025-01-06 cs.CV 83%

ACE: Anti-Editing Concept Erasure in Text-to-Image Models

Zihao Wang, Yuxiang Wei, Fan Li, Renjing Pei, Hang Xu, Wangmeng Zuo

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 25 pages, code available at https://github.com/120L020904/ACE

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03168 2024-12-30 cs.CL cs.CV 83%

Composition and Deformance: Measuring Imageability with a Text-to-Image Model

Si Wu, David A. Smith

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18302 2024-12-25 cs.CV cs.CR cs.LG 83%

FameBias: Embedding Manipulation Bias Attack in Text-to-Image Models

Jaechul Roh, Andrew Yuan, Jinsong Mao

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13896 2024-12-17 cs.CV cs.CR 83%

HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models

Sensen Gao, Xiaojun Jia, Yihao Huang, Ranjie Duan, Jindong Gu, Yang Bai, Yang Liu, Qing Guo

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09619 2024-12-13 cs.CV 83%

SnapGen: Taming High-Resolution Text-to-Image Models for Mobile Devices with Efficient Architectures and Training

Dongting Hu, Jierun Chen, Xijie Huang, Huseyin Coskun, Arpit Sahni, Aarush Gupta, Anujraaj Goyal, Dishani Lahiri, Rajesh Singh, Yerlan Idelbayev, Junli Cao, Yanyu Li, Kwang-Ting Cheng, S. -H. Gary Chan, Mingming Gong, Sergey Tulyakov, Anil Kag, Yanwu Xu, Jian Ren

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09169 2024-12-13 cs.CV 83%

DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization

Geonhui Jang, Jin-Hwa Kim, Yong-Hyun Park, Junho Kim, Gayoung Lee, Yonghyun Jeong

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04296 2024-12-06 eess.IV cs.CV cs.LG 83%

Structure-Aware Stylized Image Synthesis for Robust Medical Image Segmentation

Jie Bao, Zhixin Zhou, Wen Jung Li, Rui Luo

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏