arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3474 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2305.15328 2023-10-30 cs.CV cs.AI cs.CL cs.LG 88%

Visual Programming for Text-to-Image Generation and Evaluation

Jaemin Cho, Abhay Zala, Mohit Bansal

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments NeurIPS 2023; Project website: https://vp-t2i.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.10015 2023-10-30 cs.CV cs.AI cs.CL 88%

Benchmarking Spatial Relationships in Text-to-Image Generation

Tejas Gokhale, Hamid Palangi, Besmira Nushi, Vibhav Vineet, Eric Horvitz, Ece Kamar, Chitta Baral, Yezhou Yang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV

Comments preprint; Code and Data at https://github.com/microsoft/VISOR and https://huggingface.co/datasets/tgokhale/sr2d_visor

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14623 2023-09-28 cs.CV 88%

Text-to-Image Generation for Abstract Concepts

Jiayi Liao, Xu Chen, Qiang Fu, Lun Du, Xiangnan He, Xiang Wang, Shi Han, Dongmei Zhang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05793 2023-09-13 cs.CV cs.AI 88%

PhotoVerse: Tuning-Free Image Customization with Text-to-Image Diffusion Models

Li Chen, Mengyi Zhao, Yiheng Liu, Mingxu Ding, Yangyang Song, Shizun Wang, Xu Wang, Hao Yang, Jing Liu, Kang Du, Min Zheng

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05569 2023-09-12 cs.CV cs.AI cs.CL cs.LG 88%

ITI-GEN: Inclusive Text-to-Image Generation

Cheng Zhang, Xuanbai Chen, Siqi Chai, Chen Henry Wu, Dmitry Lagun, Thabo Beeler, Fernando De la Torre

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2023 (Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15233 2023-09-07 cs.CV cs.AI cs.LG 88%

Text-to-Image Diffusion Models are Zero-Shot Classifiers

Kevin Clark, Priyank Jaini

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16805 2023-09-04 cs.CV cs.CL cs.LG 88%

CLIPAG: Towards Generator-Free Text-to-Image Generation

Roy Ganz, Michael Elad

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09991 2023-08-24 cs.CV 88%

AltDiffusion: A Multilingual Text-to-Image Diffusion Model

Fulong Ye, Guang Liu, Xinya Wu, Ledell Wu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 15 pages; 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.13848 2023-08-21 cs.CV 88%

ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation

Yuxiang Wei, Yabo Zhang, Zhilong Ji, Jinfeng Bai, Lei Zhang, Wangmeng Zuo

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2023, oral presentation. Code: https://github.com/csyxwei/ELITE

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02971 2023-07-07 cs.CV cs.AI cs.CL 88%

On the Cultural Gap in Text-to-Image Generation

Bingshuai Liu, Longyue Wang, Chenyang Lyu, Yong Zhang, Jinsong Su, Shuming Shi, Zhaopeng Tu

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments Equal contribution: Bingshuai Liu and Longyue Wang. Work done while Bingshuai Liu and Chengyang Lyu were interning at Tencent AI Lab. Zhaopeng Tu is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14544 2023-06-27 cs.CV 88%

A-STAR: Test-time Attention Segregation and Retention for Text-to-image Synthesis

Aishwarya Agarwal, Srikrishna Karanam, K J Joseph, Apoorv Saxena, Koustava Goswami, Balaji Vasan Srinivasan

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract);分类 cs.CV

Comments 15 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13103 2023-06-26 cs.CR cs.AI cs.CV cs.LG 88%

Evaluating the Robustness of Text-to-image Diffusion Models against Real-world Attacks

Hongcheng Gao, Hao Zhang, Yinpeng Dong, Zhijie Deng

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.03759 2023-06-08 cs.CL cs.CV 88%

Easily Accessible Text-to-Image Generation Amplifies Demographic Stereotypes at Large Scale

Federico Bianchi, Pratyusha Kalluri, Esin Durmus, Faisal Ladhak, Myra Cheng, Debora Nozza, Tatsunori Hashimoto, Dan Jurafsky, James Zou, Aylin Caliskan

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments FAccT 2023 paper. The published version is available at 10.1145/3593013.3594095

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00905 2023-06-02 cs.CL cs.AI cs.CV 88%

T2IAT: Measuring Valence and Stereotypical Biases in Text-to-Image Generation

Jialu Wang, Xinyue Gabby Liu, Zonglin Di, Yang Liu, Xin Eric Wang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17431 2023-05-30 cs.CV cs.AI 88%

Towards Consistent Video Editing with Text-to-Image Diffusion Models

Zicheng Zhang, Bonan Li, Xuecheng Nie, Congying Han, Tiande Guo, Luoqi Liu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13579 2023-05-24 cs.CV 88%

Enhancing Detail Preservation for Customized Text-to-Image Generation: A Regularization-Free Approach

Yufan Zhou, Ruiyi Zhang, Tong Sun, Jinhui Xu

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12252 2023-05-23 cs.CV 88%

Boosting Human-Object Interaction Detection with Text-to-Image Diffusion Model

Jie Yang, Bingliang Li, Fengyu Yang, Ailing Zeng, Lei Zhang, Ruimao Zhang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11116 2023-05-19 cs.CV cs.CL 88%

LLMScore: Unveiling the Power of Large Language Models in Text-to-Image Synthesis Evaluation

Yujie Lu, Xianjun Yang, Xiujun Li, Xin Eric Wang, William Yang Wang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.09337 2023-04-20 cs.HC cs.AI cs.MM 88%

Promptify: Text-to-Image Generation through Interactive Prompt Exploration with Large Language Models

Stephen Brade, Bryan Wang, Mauricio Sousa, Sageev Oore, Tovi Grossman

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06297 2023-04-14 cs.CV 88%

ALR-GAN: Adaptive Layout Refinement for Text-to-Image Synthesis

Hongchen Tan, Baocai Yin, Kun Wei, Xiuping Liu, Xin Li

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

Comments Accepted by TMM

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06034 2023-04-14 cs.CY cs.AI cs.CL cs.CV 88%

Social Biases through the Text-to-Image Generation Lens

Ranjita Naik, Besmira Nushi

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02642 2023-04-06 cs.CV 88%

Taming Encoder for Zero Fine-tuning Image Customization with Text-to-Image Diffusion Models

Xuhui Jia, Yang Zhao, Kelvin C. K. Chan, Yandong Li, Han Zhang, Boqing Gong, Tingbo Hou, Huisheng Wang, Yu-Chuan Su

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.04803 2023-04-06 cs.CV 88%

Open-Vocabulary Panoptic Segmentation with Text-to-Image Diffusion Models

Jiarui Xu, Sifei Liu, Arash Vahdat, Wonmin Byeon, Xiaolong Wang, Shalini De Mello

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments CVPR 2023 Highlight. Project page and code: https://jerryxu.net/ODISE

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01816 2023-04-05 cs.CV 88%

Toward Verifiable and Reproducible Human Evaluation for Text-to-Image Generation

Mayu Otani, Riku Togashi, Yu Sawai, Ryosuke Ishigami, Yuta Nakashima, Esa Rahtu, Janne Heikkilä, Shin'ichi Satoh

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.16374 2023-04-03 cs.CV cs.AI 88%

DATID-3D: Diversity-Preserved Domain Adaptation Using Text-to-Image Diffusion for 3D Generative Model

Gwanghyun Kim, Se Young Chun

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2023, Project page: https://gwang-kim.github.io/datid_3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.16105 2023-03-29 cs.CV cs.LG 88%

Variational Distribution Learning for Unsupervised Text-to-Image Generation

Minsoo Kang, Doyup Lee, Jiseob Kim, Saehoon Kim, Bohyung Han

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments Accepted at CVPR2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13821 2023-03-27 cs.MM cs.LG 88%

Factor Decomposed Generative Adversarial Networks for Text-to-Image Synthesis

Jiguo Li, Xiaobin Liu, Lirong Zheng

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.04587 2023-03-17 cs.HC cs.AI cs.CV cs.IR 88%

A Prompt Log Analysis of Text-to-Image Generation Systems

Yutong Xie, Zhaoying Pan, Jinge Ma, Luo Jie, Qiaozhu Mei

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03800 2023-03-08 cs.CV 88%

Lformer: Text-to-Image Generation with L-shape Block Parallel Decoding

Jiacheng Li, Longhui Wei, ZongYuan Zhan, Xin He, Siliang Tang, Qi Tian, Yueting Zhuang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02094 2023-03-06 eess.IV cs.CV 88%

Bi-parametric prostate MR image synthesis using pathology and sequence-conditioned stable diffusion

Shaheer U. Saeed, Tom Syer, Wen Yan, Qianye Yang, Mark Emberton, Shonit Punwani, Matthew J. Clarkson, Dean C. Barratt, Yipeng Hu

专题命中 文生图 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

Comments Accepted at MIDL 2023 (The Medical Imaging with Deep Learning conference, 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏