arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86350 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2311.12067 2024-03-19 cs.CV 88%

Quality and Quantity: Unveiling a Million High-Quality Images for Text-to-Image Synthesis in Fashion Design

Jia Yu, Lichao Zhang, Zijie Chen, Fayu Pan, MiaoMiao Wen, Yuming Yan, Fangsheng Weng, Shuai Zhang, Lili Pan, Zhenzhong Lan

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07604 2024-03-18 cs.LG cs.AI cs.CV cs.CY 88%

Finetuning Text-to-Image Diffusion Models for Fairness

Xudong Shen, Chao Du, Tianyu Pang, Min Lin, Yongkang Wong, Mohan Kankanhalli

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ICLR 2024 oral presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05438 2024-03-11 cs.CV 88%

VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models

Yabo Zhang, Yuxiang Wei, Xianhui Lin, Zheng Hui, Peiran Ren, Xuansong Xie, Xiangyang Ji, Wangmeng Zuo

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Project page: https://videoelevator.github.io Code: https://github.com/YBYBZhang/VideoElevator

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00587 2024-03-04 cs.CV cs.AI 88%

Improving Explicit Spatial Relationships in Text-to-Image Generation through an Automatically Derived Dataset

Ander Salaberria, Gorka Azkune, Oier Lopez de Lacalle, Aitor Soroa, Eneko Agirre, Frank Keller

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments 12 pages and 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14577 2024-02-23 cs.CV 88%

Debiasing Text-to-Image Diffusion Models

Ruifei He, Chuhui Xue, Haoru Tan, Wenqing Zhang, Yingchen Yu, Song Bai, Xiaojuan Qi

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09966 2024-02-16 cs.CV 88%

Textual Localization: Decomposing Multi-concept Images for Subject-Driven Text-to-Image Generation

Junjie Shentu, Matthew Watson, Noura Al Moubayed

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03011 2024-02-16 cs.CV cs.AI 88%

InstructBooth: Instruction-following Personalized Text-to-Image Generation

Daewon Chae, Nokyung Park, Jinkyu Kim, Kimin Lee

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19216 2024-02-16 cs.CL cs.AI cs.CV cs.LG 88%

Translation-Enhanced Multilingual Text-to-Image Generation

Yaoyiran Li, Ching-Yun Chang, Stephen Rawls, Ivan Vulić, Anna Korhonen

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments ACL 2023 (Main)

Journal ref Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), 2023, pages 9174-9193

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08200 2024-02-14 cs.CV 88%

Fine-Tuning Text-To-Image Diffusion Models for Class-Wise Spurious Feature Generation

AprilPyone MaungMaung, Huy H. Nguyen, Hitoshi Kiya, Isao Echizen

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05375 2024-02-09 cs.CV 88%

Get What You Want, Not What You Don't: Image Content Suppression for Text-to-Image Diffusion Models

Senmao Li, Joost van de Weijer, Taihang Hu, Fahad Shahbaz Khan, Qibin Hou, Yaxing Wang, Jian Yang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ICLR 2024. Our code is available in https://github.com/sen-mao/SuppressEOT

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01701 2024-02-08 cs.CV cs.AI 88%

Transcending Domains through Text-to-Image Diffusion: A Source-Free Approach to Domain Adaptation

Shivang Chopra, Suraj Kothawade, Houda Aynaou, Aman Chadha

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Revamped the whole paper; new version will be re-submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15964 2024-01-31 cs.CV cs.AI 88%

Semantic Guidance Tuning for Text-To-Image Diffusion Models

Hyun Kang, Dohae Lee, Myungjin Shin, In-Kwon Lee

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Rework is being done

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01141 2024-01-24 cs.CV 88%

VGDiffZero: Text-to-image Diffusion Models Can Be Zero-shot Visual Grounders

Xuyang Liu, Siteng Huang, Yachen Kang, Honggang Chen, Donglin Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICASSP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.01339 2024-01-23 cs.CV 88%

DSE-GAN: Dynamic Semantic Evolution Generative Adversarial Network for Text-to-Image Generation

Mengqi Huang, Zhendong Mao, Penghui Wang, Quan Wang, Yongdong Zhang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Journal ref ACM Multimedia 2022 Best Student Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09611 2024-01-01 cs.CL cs.CV 88%

Optimizing Prompts for Text-to-Image Generation

Yaru Hao, Zewen Chi, Li Dong, Furu Wei

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments Accepted by NeurIPS-23

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16720 2023-12-29 cs.CV 88%

Prompt Expansion for Adaptive Text-to-Image Generation

Siddhartha Datta, Alexander Ku, Deepak Ramachandran, Peter Anderson

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15905 2023-12-27 cs.CV 88%

Cross Initialization for Personalized Text-to-Image Generation

Lianyu Pang, Jian Yin, Haoran Xie, Qiping Wang, Qing Li, Xudong Mao

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06933 2023-12-19 cs.CV 88%

DreamStyler: Paint by Style Inversion with Text-to-Image Diffusion Models

Namhyuk Ahn, Junsoo Lee, Chunggi Lee, Kunhee Kim, Daesik Kim, Seung-Hun Nam, Kibeom Hong

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);image synthesis(abstract);分类 cs.CV

Comments AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10997 2023-12-19 cs.CV cs.AI cs.LG 88%

MarkovGen: Structured Prediction for Efficient Text-to-Image Generation

Sadeep Jayasumana, Daniel Glasner, Srikumar Ramalingam, Andreas Veit, Ayan Chakrabarti, Sanjiv Kumar

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06059 2023-12-12 cs.CV cs.AI cs.LG 88%

CONFORM: Contrast is All You Need For High-Fidelity Text-to-Image Diffusion Models

Tuna Han Salih Meral, Enis Simsar, Federico Tombari, Pinar Yanardag

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04655 2023-12-11 cs.CV 88%

ECLIPSE: A Resource-Efficient Text-to-Image Prior for Image Generations

Maitreya Patel, Changhoon Kim, Sheng Cheng, Chitta Baral, Yezhou Yang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments Project Page: https://eclipse-t2i.vercel.app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19784 2023-12-08 cs.CV cs.AI 88%

CustomNet: Zero-shot Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models

Ziyang Yuan, Mingdeng Cao, Xintao Wang, Zhongang Qi, Chun Yuan, Ying Shan

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);image generation(abstract);分类 cs.CV

Comments Project webpage available at https://jiangyzy.github.io/CustomNet/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17946 2023-12-01 cs.CV cs.AI cs.CL 88%

DreamSync: Aligning Text-to-Image Generation with Image Understanding Feedback

Jiao Sun, Deqing Fu, Yushi Hu, Su Wang, Royi Rassin, Da-Cheng Juan, Dana Alon, Charles Herrmann, Sjoerd van Steenkiste, Ranjay Krishna, Cyrus Rashtchian

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17126 2023-11-30 cs.CV cs.CL 88%

Reason out Your Layout: Evoking the Layout Master from Large Language Models for Text-to-Image Synthesis

Xiaohui Chen, Yongfei Liu, Yingxiang Yang, Jianbo Yuan, Quanzeng You, Li-Ping Liu, Hongxia Yang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract);分类 cs.CV

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08872 2023-11-28 cs.CV 88%

R&B: Region and Boundary Aware Zero-shot Grounded Text-to-image Generation

Jiayu Xiao, Henglei Lv, Liang Li, Shuhui Wang, Qingming Huang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments Preprint. Under review. Project page: https://sagileo.github.io/Region-and-Boundary

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.01569 2023-11-27 cs.CV cs.AI 88%

Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation

Yuval Kirstain, Adam Polyak, Uriel Singer, Shahbuland Matiana, Joe Penna, Omer Levy

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.13988 2023-11-27 cs.MM cs.CL cs.HC 88%

A Taxonomy of Prompt Modifiers for Text-To-Image Generation

Jonas Oppenlaender

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.MM

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00755 2023-11-16 cs.LG cs.CL cs.CV cs.CY 88%

The Bias Amplification Paradox in Text-to-Image Generation

Preethi Seshadri, Sameer Singh, Yanai Elazar

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18840 2023-11-09 cs.CV 88%

Customizing 360-Degree Panoramas through Text-to-Image Diffusion Models

Hai Wang, Xiaoyu Xiang, Yuchen Fan, Jing-Hao Xue

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted by WACV 2024, Project Page: https://littlewhitesea.github.io/stitchdiffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16381 2023-11-02 cs.LG cs.CV 88%

DPOK: Reinforcement Learning for Fine-tuning Text-to-Image Diffusion Models

Ying Fan, Olivia Watkins, Yuqing Du, Hao Liu, Moonkyung Ryu, Craig Boutilier, Pieter Abbeel, Mohammad Ghavamzadeh, Kangwook Lee, Kimin Lee

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏