arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3474 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2502.00433 2025-02-04 cs.CV 89%

CAT Pruning: Cluster-Aware Token Pruning For Text-to-Image Diffusion Models

Xinle Cheng, Zhuoming Chen, Zhihao Jia

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09055 2025-01-17 cs.CV 89%

SHYI: Action Support for Contrastive Learning in High-Fidelity Text-to-Image Generation

Tianxiang Xia, Lin Xiao, Yannick Montorfani, Francesco Pavia, Enis Simsar, Thomas Hofmann

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Main content 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12888 2024-12-19 cs.CV cs.AI 89%

ArtAug: Enhancing Text-to-Image Generation through Synthesis-Understanding Interaction

Zhongjie Duan, Qianyi Zhao, Cen Chen, Daoyuan Chen, Wenmeng Zhou, Yaliang Li, Yingda Chen

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);image synthesis(abstract)

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15367 2024-11-28 cs.CV cs.AI 89%

Exploiting Watermark-Based Defense Mechanisms in Text-to-Image Diffusion Models for Unauthorized Data Usage

Soumil Datta, Shih-Chieh Dai, Leo Yu, Guanhong Tao

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03653 2024-11-28 cs.CV cs.AI cs.CL 89%

CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching

Dongzhi Jiang, Guanglu Song, Xiaoshi Wu, Renrui Zhang, Dazhong Shen, Zhuofan Zong, Yu Liu, Hongsheng Li

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17203 2024-11-27 eess.IV cs.CV 89%

cWDM: Conditional Wavelet Diffusion Models for Cross-Modality 3D Medical Image Synthesis

Paul Friedrich, Alicia Durrer, Julia Wolleb, Philippe C. Cattin

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments BraTS 2024 (Global Synthesis) submission. Code: https://github.com/pfriedri/cwdm

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08482 2024-11-27 cs.CV cs.CL 89%

Words Worth a Thousand Pictures: Measuring and Understanding Perceptual Variability in Text-to-Image Generation

Raphael Tang, Xinyu Zhang, Lixinyu Xu, Yao Lu, Wenyan Li, Pontus Stenetorp, Jimmy Lin, Ferhan Ture

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Published at EMNLP 2024; outstanding paper award; 14 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15113 2024-11-25 cs.CV cs.AI cs.CL cs.LG 89%

Efficient Pruning of Text-to-Image Models: Insights from Pruning Stable Diffusion

Samarth N Ramesh, Zhixue Zhao

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00570 2024-11-20 cs.CV cs.AI cs.LG 89%

Rethinking cluster-conditioned diffusion models for label-free image synthesis

Nikolas Adaloglou, Tim Kaiser, Felix Michels, Markus Kollmann

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted in WAVC2025 (21 pages, 15 figures). Code is available at https://github.com/HHU-MMBS/cedm-official-wavc2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02485 2024-11-06 cs.CV 89%

Stable-Pose: Leveraging Transformers for Pose-Guided Text-to-Image Generation

Jiajun Wang, Morteza Ghahremani, Yitong Li, Björn Ommer, Christian Wachinger

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);image synthesis(abstract)

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23332 2024-11-01 cs.CV cs.AI cs.LG 89%

MoLE: Enhancing Human-centric Text-to-image Diffusion via Mixture of Low-rank Experts

Jie Zhu, Yixiong Chen, Mingyu Ding, Ping Luo, Leye Wang, Jingdong Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Published at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22362 2024-10-31 eess.IV cs.AI cs.CV 89%

MMM-RS: A Multi-modal, Multi-GSD, Multi-scene Remote Sensing Dataset and Benchmark for Text-to-Image Generation

Jialin Luo, Yuanzhi Wang, Ziqi Gu, Yide Qiu, Shuaizhen Yao, Fuyun Wang, Chunyan Xu, Wenhua Zhang, Dan Wang, Zhen Cui

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16422 2024-10-30 cs.CV cs.AI 89%

Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation

Sanyam Lakhanpal, Shivang Chopra, Vinija Jain, Aman Chadha, Man Luo

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05125 2024-10-29 cs.CV cs.AI 89%

Evaluating Text-to-Image Generative Models: An Empirical Study on Human Image Synthesis

Muxi Chen, Yi Liu, Jian Yi, Changran Xu, Qiuxia Lai, Hongliang Wang, Tsung-Yi Ho, Qiang Xu

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14800 2024-10-29 cs.CR cs.CV 89%

Membership Inference on Text-to-Image Diffusion Models via Conditional Likelihood Discrepancy

Shengfang Zhai, Huanran Chen, Yinpeng Dong, Jiajun Li, Qingni Shen, Yansong Gao, Hang Su, Yang Liu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 18 pages, 5 figures. NeurIPS 2024. Code will be released at: https://github.com/zhaisf/CLiD

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09792 2024-10-22 cs.CV 89%

Generating Intermediate Representations for Compositional Text-To-Image Generation

Ran Galun, Sagie Benaim

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024 Workshop on Compositional Learning: Perspectives, Methods, and Paths Forward

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08612 2024-10-14 cs.CV cs.AI cs.LG 89%

Synth-SONAR: Sonar Image Synthesis with Enhanced Diversity and Realism via Dual Diffusion Models and GPT Prompting

Purushothaman Natarajan, Kamal Basha, Athira Nambiar

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages, 5 tables and 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07389 2024-10-10 cs.CV 89%

Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models

Yasi Zhang, Peiyu Yu, Ying Nian Wu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments Accepted to ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01638 2024-10-03 cs.CV cs.AI 89%

Data Extrapolation for Text-to-image Generation on Small Datasets

Senmao Ye, Fei Liu

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08887 2024-10-02 cs.CV cs.LG 89%

SpeedUpNet: A Plug-and-Play Adapter Network for Accelerating Text-to-Image Diffusion Models

Weilong Chai, DanDan Zheng, Jiajiong Cao, Zhiquan Chen, Changbao Wang, Chenguang Ma

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16174 2024-09-25 cs.CV 89%

Fine Tuning Text-to-Image Diffusion Models for Correcting Anomalous Images

Hyunwoo Yoo

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08746 2024-09-25 cs.CV 89%

DreamDrone: Text-to-Image Diffusion Models are Zero-shot Perpetual View Generators

Hanyang Kong, Dongze Lian, Michael Bi Mi, Xinchao Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 16 pages, 12 figures, project page: https://hyokong.github.io/dreamdrone-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16272 2024-09-24 cs.CV cs.AI 89%

Repairing Catastrophic-Neglect in Text-to-Image Diffusion Models via Attention-Guided Feature Enhancement

Zhiyuan Chang, Mingyang Li, Junjie Wang, Yi Liu, Qing Wang, Yang Liu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15313 2024-09-20 cs.CV 89%

Enhancing Text-to-Image Editing via Hybrid Mask-Informed Fusion

Aoxue Li, Mingyang Yi, Zhenguo Li

专题命中 文生图 :text-to-image(title,abstract);image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15861 2024-09-16 cs.CR cs.AI cs.CV 89%

Adversarial Attacks and Defenses on Text-to-Image Diffusion Models: A Survey

Chenyu Zhang, Mingwang Hu, Wenhui Li, Lanjun Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted for Information Fusion. Related benchmarks and codes are available at \url{https://github.com/datar001/Awesome-AD-on-T2IDM}

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00492 2024-09-04 cs.CV 89%

Accurate Compression of Text-to-Image Diffusion Models via Vector Quantization

Vage Egiazarian, Denis Kuznedelev, Anton Voronov, Ruslan Svirschevski, Michael Goin, Daniil Pavlov, Dan Alistarh, Dmitry Baranchuk

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments project page: https://yandex-research.github.io/vqdm

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00737 2024-08-28 cs.CV 89%

LLM4GEN: Leveraging Semantic Representation of LLMs for Text-to-Image Generation

Mushui Liu, Yuhang Ma, Yang Zhen, Jun Dan, Yunlong Yu, Zeng Zhao, Zhipeng Hu, Bai Liu, Changjie Fan

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 11 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09305 2024-08-09 cs.CV 89%

Toffee: Efficient Million-Scale Dataset Construction for Subject-Driven Text-to-Image Generation

Yufan Zhou, Ruiyi Zhang, Kaizhi Zheng, Nanxuan Zhao, Jiuxiang Gu, Zichao Wang, Xin Eric Wang, Tong Sun

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14982 2024-07-23 cs.CV cs.AI 89%

GreenStableYolo: Optimizing Inference Time and Image Quality of Text-to-Image Generation

Jingzhi Gong, Sisi Li, Giordano d'Aloisio, Zishuo Ding, Yulong Ye, William B. Langdon, Federica Sarro

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments This paper is published in the SSBSE Challenge Track 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14111 2024-07-23 cs.CV 89%

Image Synthesis with Graph Conditioning: CLIP-Guided Diffusion Models for Scene Graphs

Rameshwar Mishra, A V Subramanyam

专题命中 文生图 :diffusion(title,abstract);image synthesis(title);image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏