arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3474 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2503.18324 2025-03-25 cs.CV cs.AI 88%

Plug-and-Play Interpretable Responsible Text-to-Image Generation via Dual-Space Multi-facet Concept Control

Basim Azam, Naveed Akhtar

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09230 2025-03-24 cs.CV 88%

Surgical Text-to-Image Generation

Chinedu Innocent Nwoye, Rupak Bose, Kareem Elgohary, Lorenzo Arboit, Giorgio Carlino, Joël L. Lavanchy, Pietro Mascagni, Nicolas Padoy

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments 13 pages, 13 figures, 3 tables, published in Pattern Recognition Letters 2025, project page at https://camma-public.github.io/endogen/

Journal ref Pattern Recognition Letters, Volume 190, April 2025, Pages 73-80

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13576 2025-03-19 cs.CV 88%

A Comprehensive Survey on Visual Concept Mining in Text-to-image Diffusion Models

Ziqiang Li, Jun Li, Lizhi Xiong, Zhangjie Fu, Zechao Li

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12526 2025-03-18 cs.CV 88%

EditID: Training-Free Editable ID Customization for Text-to-Image Generation

Guandong Li, Zhaobin Chu

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11122 2025-03-17 cs.CV 88%

DriveGEN: Generalized and Robust 3D Detection in Driving via Controllable Text-to-Image Diffusion Generation

Hongbin Lin, Zilu Guo, Yifan Zhang, Shuaicheng Niu, Yafeng Li, Ruimao Zhang, Shuguang Cui, Zhen Li

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09669 2025-03-14 cs.CV cs.AI cs.CR 88%

Silent Branding Attack: Trigger-free Data Poisoning Attack on Text-to-Image Diffusion Models

Sangwon Jang, June Suk Choi, Jaehyeong Jo, Kimin Lee, Sung Ju Hwang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025. Project page: https://silent-branding.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01699 2025-03-05 cs.CV 88%

Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding

Yao Teng, Han Shi, Xian Liu, Xuefei Ning, Guohao Dai, Yu Wang, Zhenguo Li, Xihui Liu

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments ICLR 2025; Codes: https://github.com/tyshiwo1/Accelerating-T2I-AR-with-SJD/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14070 2025-02-21 cs.CV cs.AI 88%

DiffExp: Efficient Exploration in Reward Fine-tuning for Text-to-Image Diffusion Models

Daewon Chae, June Suk Choi, Jinkyu Kim, Kimin Lee

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12527 2025-02-19 cs.CV 88%

Comprehensive Assessment and Analysis for NSFW Content Erasure in Text-to-Image Diffusion Models

Die Chen, Zhiwen Li, Cen Chen, Xiaodan Li, Jinyan Ye

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09064 2025-02-14 cs.CV 88%

StyleBlend: Enhancing Style-Specific Content Creation in Text-to-Image Diffusion Models

Zichong Chen, Shijin Wang, Yang Zhou

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to Eurographics 2025. Project page: https://zichongc.github.io/StyleBlend/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08690 2025-02-14 cs.LG cs.AI cs.CV 88%

Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation

Hoigi Seo, Wongi Jeong, Jae-sun Seo, Se Young Chun

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04304 2025-02-13 cs.CV cs.LG 88%

DGQ: Distribution-Aware Group Quantization for Text-to-Image Diffusion Models

Hyogon Ryu, NaHyeon Park, Hyunjung Shim

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted ICLR 2025. Project page: https://ugonfor.kr/DGQ

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00700 2025-02-11 cs.CV cs.AI 88%

Mining Your Own Secrets: Diffusion Classifier Scores for Continual Personalization of Text-to-Image Diffusion Models

Saurav Jha, Shiqi Yang, Masato Ishii, Mengjie Zhao, Christian Simon, Muhammad Jehanzeb Mirza, Dong Gong, Lina Yao, Shusuke Takahashi, Yuki Mitsufuji

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01309 2025-02-04 cs.CV 88%

Heterogeneous Image GNN: Graph-Conditioned Diffusion for Image Synthesis

Rupert Menneer, Christos Margadji, Sebastian W. Pattinson

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12910 2025-01-23 cs.CV cs.AI cs.LG 88%

PreciseCam: Precise Camera Control for Text-to-Image Generation

Edurne Bernal-Berdun, Ana Serrano, Belen Masia, Matheus Gadelha, Yannick Hold-Geoffroy, Xin Sun, Diego Gutierrez

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00580 2025-01-16 cs.CV 88%

Continuous Concepts Removal in Text-to-image Diffusion Models

Tingxu Han, Weisong Sun, Yanrong Hu, Chunrong Fang, Yonglong Zhang, Shiqing Ma, Tao Zheng, Zhenyu Chen, Zhenting Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17155 2025-01-13 cs.CV cs.AI 88%

Discriminative Class Tokens for Text-to-Image Diffusion Models

Idan Schwartz, Vésteinn Snæbjarnarson, Hila Chefer, Ryan Cotterell, Serge Belongie, Lior Wolf, Sagie Benaim

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12198 2025-01-07 cs.CV cs.AI 88%

CCIS-Diff: A Generative Model with Stable Diffusion Prior for Controlled Colonoscopy Image Synthesis

Yifan Xie, Jingge Wang, Tao Feng, Fei Ma, Yang Li

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11594 2024-12-31 cs.CV 88%

VersaGen: Unleashing Versatile Visual Control for Text-to-Image Synthesis

Zhipeng Chen, Lan Yang, Yonggang Qi, Honggang Zhang, Kaiyue Pang, Ke Li, Yi-Zhe Song

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract);分类 cs.CV

Comments The paper has been accepted by AAAI 2025. Paper code: https://github.com/FelixChan9527/VersaGen_official

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00633 2024-12-30 cs.LG cs.AI cs.CV stat.ML 88%

Improving GFlowNets for Text-to-Image Diffusion Alignment

Dinghuai Zhang, Yizhe Zhang, Jiatao Gu, Ruixiang Zhang, Josh Susskind, Navdeep Jaitly, Shuangfei Zhai

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18604 2024-12-25 cs.CV 88%

Explaining in Diffusion: Explaining a Classifier Through Hierarchical Semantics with Text-to-Image Diffusion Models

Tahira Kazimi, Ritika Allada, Pinar Yanardag

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12004 2024-12-13 cs.CV 88%

Direct Consistency Optimization for Robust Customization of Text-to-Image Diffusion Models

Kyungmin Lee, Sangkyung Kwak, Kihyuk Sohn, Jinwoo Shin

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2024. Project page: https://dco-t2i.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08639 2024-12-12 cs.CL cs.CV 88%

Fast Prompt Alignment for Text-to-Image Generation

Khalil Mrini, Hanlin Lu, Linjie Yang, Weilin Huang, Heng Wang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments TikTok Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07540 2024-12-12 cs.CV cs.LG 88%

Ctrl-X: Controlling Structure and Appearance for Text-To-Image Generation Without Guidance

Kuan Heng Lin, Sicheng Mo, Ben Klingher, Fangzhou Mu, Bolei Zhou

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments 22 pages, 17 figures, see project page at https://genforce.github.io/ctrl-x

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07674 2024-12-11 cs.CV 88%

FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models

Tong Wu, Yinghao Xu, Ryan Po, Mengchen Zhang, Guandao Yang, Jiaqi Wang, Ziwei Liu, Dahua Lin, Gordon Wetzstein

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);image generation(abstract);分类 cs.CV

Comments NeurIPS 2024 (Datasets and Benchmarks Track); Project page: https://fiva-dataset.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04460 2024-12-06 cs.CV 88%

LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors

Yusuf Dalva, Yijun Li, Qing Liu, Nanxuan Zhao, Jianming Zhang, Zhe Lin, Pinar Yanardag

专题命中 文生图 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

Comments Project page: https://layerfusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03315 2024-12-05 cs.CV 88%

Geometry-guided Cross-view Diffusion for One-to-many Cross-view Image Synthesis

Tao Jun Lin, Wenqing Wang, Yujiao Shi, Akhil Perincherry, Ankit Vora, Hongdong Li

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03178 2024-12-05 cs.AI cs.CV cs.LG 88%

Towards Understanding and Quantifying Uncertainty for Text-to-Image Generation

Gianni Franchi, Dat Nguyen Trong, Nacim Belkhir, Guoxuan Xia, Andrea Pilzer

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments 28 pages and 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00357 2024-12-03 cs.AI cs.CV 88%

Safety Alignment Backfires: Preventing the Re-emergence of Suppressed Concepts in Fine-tuned Text-to-Image Diffusion Models

Sanghyun Kim, Moonseok Choi, Jinwoo Shin, Juho Lee

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 20 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00122 2024-12-03 cs.CV 88%

Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback

Xuexiang Niu, Jinping Tang, Lei Wang, Ge Zhu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏