arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86504 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2409.19111 2024-10-03 cs.CV 85%

Fusion is all you need: Face Fusion for Customized Identity-Preserving Image Synthesis

Salaheldin Mohamed, Dong Han, Yong Li

专题命中 文生图 :image synthesis(title);image generation(abstract);text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19937 2024-10-01 cs.CV 85%

MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation

Wenchao Chen, Liqiang Niu, Ziyao Lu, Fandong Meng, Jie Zhou

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16232 2024-08-30 cs.CV cs.AI cs.LG 85%

Enhancing Conditional Image Generation with Explainable Latent Space Manipulation

Kshitij Pathania

专题命中 文生图 :image generation(title);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)

Comments 7 pages , 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18459 2024-08-28 cs.CV 85%

DiffuseHigh: Training-free Progressive High-Resolution Image Synthesis through Structure Guidance

Younghyun Kim, Geunmin Hwang, Junyu Zhang, Eunbyung Park

专题命中 文生图 :image synthesis(title);image generation(abstract);text-to-image(abstract);diffusion(abstract)

Comments Project page: https://yhyun225.github.io/DiffuseHigh/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02157 2024-08-06 cs.CV 85%

PanoFree: Tuning-Free Holistic Multi-view Image Generation with Cross-view Self-Guidance

Aoming Liu, Zhong Li, Zhang Chen, Nannan Li, Yi Xu, Bryan A. Plummer

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05602 2024-06-11 cs.CV cs.CL 85%

Can Prompt Modifiers Control Bias? A Comparative Analysis of Text-to-Image Generative Models

Philip Wootaek Shin, Jihyun Janice Ahn, Wenpeng Yin, Jack Sampson, Vijaykrishnan Narayanan

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18762 2024-05-31 cs.CV cs.AI 85%

Inpaint Biases: A Pathway to Accurate and Unbiased Image Generation

Jiyoon Myung, Jihyeon Park

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments Paper accepted in CVPRW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07754 2024-04-12 cs.CV cs.AI cs.HC cs.LG 85%

Generating Synthetic Satellite Imagery With Deep-Learning Text-to-Image Models -- Technical Challenges and Implications for Monitoring and Verification

Tuong Vy Nguyen, Alexander Glaser, Felix Biessmann

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments https://resources.inmm.org/annual-meeting-proceedings/generating-synthetic-satellite-imagery-deep-learning-text-image-models

Journal ref Presented at the Annual Meeting of the Institute of Nuclear Materials Management (INMM), Vienna, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18551 2024-04-12 cs.CV 85%

Attention Calibration for Disentangled Text-to-Image Personalization

Yanbing Zhang, Mengping Yang, Qin Zhou, Zhe Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments CVPR 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16074 2024-04-12 cs.CV 85%

RePoseDM: Recurrent Pose Alignment and Gradient Guidance for Pose Guided Image Synthesis

Anant Khandelwal

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at CVPR 2024 SyntaGen Workshop, 13 pages, 4 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03913 2024-04-08 cs.CV cs.AI cs.LG 85%

Concept Weaver: Enabling Multi-Concept Fusion in Text-to-Image Models

Gihyun Kwon, Simon Jenni, Dingzeyu Li, Joon-Young Lee, Jong Chul Ye, Fabian Caba Heilbron

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03144 2024-04-05 cs.CV 85%

Diverse and Tailored Image Generation for Zero-shot Multi-label Classification

Kaixin Zhang, Zhixiang Yuan, Tao Huang

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12963 2024-03-20 cs.CV 85%

FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis

Linjiang Huang, Rongyao Fang, Aiping Zhang, Guanglu Song, Si Liu, Yu Liu, Hongsheng Li

专题命中 文生图 :image synthesis(title);image generation(abstract);text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14707 2024-02-27 cs.CV 85%

Two-stage Cytopathological Image Synthesis for Augmenting Cervical Abnormality Screening

Zhenrong Shen, Manman Fei, Xin Wang, Jiangdong Cai, Sheng Wang, Lichi Zhang, Qian Wang

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11631 2024-01-23 cs.CV cs.CL cs.LG 85%

Text-to-Image Cross-Modal Generation: A Systematic Review

Maciej Żelaszczyk, Jacek Mańdziuk

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07277 2023-12-22 cs.CV cs.LG 85%

Limitations of Face Image Generation

Harrison Rosenberg, Shimaa Ahmed, Guruprasad V Ramesh, Ramya Korlakai Vinayak, Kassem Fawaz

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to The 38th Annual AAAI Conference on Artificial Intelligence (AAAI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15296 2023-12-21 cs.CV cs.AI cs.LG 85%

MultiFusion: Fusing Pre-Trained Models for Multi-Lingual, Multi-Modal Image Generation

Marco Bellagente, Manuel Brack, Hannah Teufel, Felix Friedrich, Björn Deiseroth, Constantin Eichenberg, Andrew Dai, Robert Baldock, Souradeep Nanda, Koen Oostermeijer, Andres Felipe Cruz-Salinas, Patrick Schramowski, Kristian Kersting, Samuel Weinbach

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Proceedings of Advances in Neural Information Processing Systems: Annual Conference on Neural Information Processing Systems (NeurIPS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07833 2023-12-14 cs.CV cs.LG 85%

Stable Rivers: A Case Study in the Application of Text-to-Image Generative Models for Earth Sciences

C Kupferschmidt, A. D. Binns, K. L. Kupferschmidt, G. W Taylor

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07550 2023-12-14 cs.CV cs.CL cs.CR cs.LG 85%

Understanding (Un)Intended Memorization in Text-to-Image Generative Models

Ali Naseh, Jaechul Roh, Amir Houmansadr

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13620 2023-11-27 cs.CV 85%

The Challenges of Image Generation Models in Generating Multi-Component Images

Tham Yik Foong, Shashank Kotyan, Po Yuan Mao, Danilo Vasconcellos Vargas

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 10 pages, 6 figures, and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05390 2023-11-27 cs.CV cs.AI cs.LG 85%

HRS-Bench: Holistic, Reliable and Scalable Benchmark for Text-to-Image Models

Eslam Mohamed Bakr, Pengzhan Sun, Xiaoqian Shen, Faizan Farooq Khan, Li Erran Li, Mohamed Elhoseiny

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16656 2023-10-26 cs.CV cs.AI cs.LG 85%

A Picture is Worth a Thousand Words: Principled Recaptioning Improves Image Generation

Eyal Segalis, Dani Valevski, Danny Lumen, Yossi Matias, Yaniv Leviathan

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13730 2023-10-24 cs.CV 85%

Localizing and Editing Knowledge in Text-to-Image Generative Models

Samyadeep Basu, Nanxuan Zhao, Vlad Morariu, Soheil Feizi, Varun Manjunatha

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments 61 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09247 2023-10-16 cs.CV cs.CL cs.LG 85%

Hypernymy Understanding Evaluation of Text-to-Image Models via WordNet Hierarchy

Anton Baryshnikov, Max Ryabinin

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.16489 2023-09-06 cs.CV cs.AI cs.CR 85%

BAGM: A Backdoor Attack for Manipulating Text-to-Image Generative Models

Jordan Vice, Naveed Akhtar, Richard Hartley, Ajmal Mian

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments This research was supported by National Intelligence and Security Discovery Research Grants (project# NS220100007), funded by the Department of Defence Australia

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08525 2023-08-17 cs.CV 85%

Likelihood-Based Text-to-Image Evaluation with Patch-Level Perceptual and Semantic Credit Assignment

Qi Chen, Chaorui Deng, Zixiong Huang, Bowen Zhang, Mingkui Tan, Qi Wu

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.07292 2023-05-24 cs.CV cs.LG 85%

A Novel Sampling Scheme for Text- and Image-Conditional Image Synthesis in Quantized Latent Spaces

Dominic Rampas, Pablo Pernias, Marc Aubreville

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10834 2023-05-19 cs.AI cs.CL cs.HC cs.MM 85%

AIwriting: Relations Between Image Generation and Digital Writing

Scott Rettberg, Talan Memmott, Jill Walker Rettberg, Jason Nelson, Patrick Lichty

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.MM

Comments Extended abstract for panel presented at ISEA 2023, Paris 16-22 May 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12208 2023-03-23 cs.CV cs.CL cs.LG 85%

MAGVLT: Masked Generative Vision-and-Language Transformer

Sungwoong Kim, Daejin Jo, Donghoon Lee, Jongmin Kim

专题命中 文生图 :generative vision(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03185 2023-03-10 cs.CV 85%

Rethinking the Objectives of Vector-Quantized Tokenizers for Image Synthesis

Yuchao Gu, Xintao Wang, Yixiao Ge, Ying Shan, Xiaohu Qie, Mike Zheng Shou

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏