arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86539 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2209.14792 2022-09-30 cs.CV cs.AI cs.LG 70%

Make-A-Video: Text-to-Video Generation without Text-Video Data

Uriel Singer, Adam Polyak, Thomas Hayes, Xi Yin, Jie An, Songyang Zhang, Qiyuan Hu, Harry Yang, Oron Ashual, Oran Gafni, Devi Parikh, Sonal Gupta, Yaniv Taigman

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08104 2022-09-23 cs.CV cs.CL 70%

Understanding Attention for Vision-and-Language Tasks

Feiqi Cao, Soyeon Caren Han, Siqu Long, Changwei Xu, Josiah Poon

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted in COLING 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.12512 2022-05-26 cs.CV 70%

Text-to-Face Generation with StyleGAN2

D. M. A. Ayanthi, Sarasi Munasinghe

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 16 pages, 5 figures, for conference, https://aircconline.com/csit/papers/vol12/csit120805.pdf

Journal ref David C. Wyld et al. (Eds): FCST, CMIT, SE, SIPM, SAIM, SNLP - 2022pp. 49-64, 2022. CS & IT - CSCP 2022 May 21~22, 2022, Zurich, Switzerland

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.11480 2022-05-03 cs.CV cs.CL 70%

WuDaoMM: A large-scale Multi-Modal Dataset for Pre-training models

Sha Yuan, Shuai Zhao, Jiahong Leng, Zhao Xue, Hanyu Zhao, Peiyu Liu, Zheng Gong, Wayne Xin Zhao, Junyi Li, Jie Tang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Some data problems cannot be obtained

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.02624 2022-05-02 cs.CV cs.AI 70%

CLIP-Forge: Towards Zero-Shot Text-to-Shape Generation

Aditya Sanghi, Hang Chu, Joseph G. Lambourne, Ye Wang, Chin-Yi Cheng, Marco Fumero, Kamal Rahimi Malekshan

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.11133 2022-04-07 cs.CV cs.CL cs.LG 70%

L-Verse: Bidirectional Generation Between Image and Text

Taehoon Kim, Gwangmo Song, Sihaeng Lee, Sangyun Kim, Yewon Seo, Soonyoung Lee, Seung Hwan Kim, Honglak Lee, Kyunghoon Bae

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2022 as Oral Presentation (18 pages, 14 figures, 4 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.01099 2022-04-05 cs.CV cs.LG 70%

Adversarially robust segmentation models learn perceptually-aligned gradients

Pedro Sandoval-Segura

专题命中 文生图 :inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.09052 2022-03-18 cs.CV cs.AI cs.CL 70%

DU-VLG: Unifying Vision-and-Language Generation via Dual Sequence-to-Sequence Pre-training

Luyang Huang, Guocheng Niu, Jiachen Liu, Xinyan Xiao, Hua Wu

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments To appear at Findings of ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.08376 2022-02-18 cs.LG cs.CV 70%

How to Fill the Optimum Set? Population Gradient Descent with Harmless Diversity

Chengyue Gong, Lemeng Wu, Qiang Liu

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.12417 2021-11-25 cs.CV cs.AI 70%

NÜWA: Visual Synthesis Pre-training for Neural visUal World creAtion

Chenfei Wu, Jian Liang, Lei Ji, Fan Yang, Yuejian Fang, Daxin Jiang, Nan Duan

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.01965 2021-11-04 cs.CV 70%

Adversarially Perturbed Wavelet-based Morphed Face Generation

Kelsey O'Haire, Sobhan Soleymani, Baaria Chaudhary, Poorya Aghdaie, Jeremy Dawson, Nasser M. Nasrabadi

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.10834 2021-10-22 cs.CL cs.AI cs.CV cs.LG 70%

Integrating Visuospatial, Linguistic and Commonsense Structure into Story Visualization

Adyasha Maharana, Mohit Bansal

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments EMNLP 2021 (16 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.02514 2021-10-19 cs.CV eess.IV 70%

The Image Local Autoregressive Transformer

Chenjie Cao, Yuxin Hong, Xiang Li, Chengrong Wang, Chengming Xu, XiangYang Xue, Yanwei Fu

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by NeurIPS2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.11100 2021-10-12 cs.CV cs.LG eess.IV 70%

Multi-Attributed and Structured Text-to-Face Synthesis

Rohan Wadhawan, Tanuj Drall, Shubham Singh, Shampa Chakraverty

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by IEEE TEMSMET 2020, Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.00404 2021-10-04 eess.IV cs.CV 70%

Learning of Inter-Label Geometric Relationships Using Self-Supervised Learning: Application To Gleason Grade Segmentation

Dwarikanath Mahapatra

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2106.10230

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.11682 2021-09-29 cs.CV cs.AI 70%

Paint4Poem: A Dataset for Artistic Visualization of Classical Chinese Poems

Dan Li, Shuai Wang, Jie Zou, Chang Tian, Elisha Nieuwburg, Fengyuan Sun, Evangelos Kanoulas

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.09120 2021-09-21 cs.CV cs.LG 70%

ComicGAN: Text-to-Comic Generative Adversarial Network

Ben Proven-Bessel, Zilong Zhao, Lydia Chen

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05884 2021-08-13 cs.CV 70%

Unconditional Scene Graph Generation

Sarthak Garg, Helisa Dhamo, Azade Farshad, Sabrina Musatian, Nassir Navab, Federico Tombari

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments accepted for publication at ICCV 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.02018 2021-06-29 cs.CV 70%

TiVGAN: Text to Image to Video Generation with Step-by-Step Evolutionary Generator

Doyeon Kim, Donggyu Joo, Junmo Kim

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.01981 2021-06-02 cs.CL cs.AI cs.CV 70%

Open Domain Dialogue Generation with Latent Images

Ze Yang, Wei Wu, Huang Hu, Can Xu, Wei Wang, Zhoujun Li

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments AAAI2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.15397 2021-01-01 eess.IV cs.CV 70%

FREA-Unet: Frequency-aware U-net for Modality Transfer

Hajar Emami, Qiong Liu, Ming Dong

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.00744 2020-12-03 cs.CV 70%

A Framework and Dataset for Abstract Art Generation via CalligraphyGAN

Jinggang Zhuo, Ling Fan, Harry Jiannan Wang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2020 Workshop on Machine Learning for Creativity and Design, Vancouver, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.07533 2020-08-18 cs.CV cs.CR cs.LG 70%

FakePolisher: Making DeepFakes More Detection-Evasive by Shallow Reconstruction

Yihao Huang, Felix Juefei-Xu, Run Wang, Qing Guo, Lei Ma, Xiaofei Xie, Jianwen Li, Weikai Miao, Yang Liu, Geguang Pu

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments 9 pages, accepted by ACM MM 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.13408 2020-08-03 eess.IV cs.CV cs.LG 70%

XCAT-GAN for Synthesizing 3D Consistent Labeled Cardiac MR Images on Anatomically Variable XCAT Phantoms

Sina Amirrajab, Samaneh Abbasi-Sureshjani, Yasmina Al Khalil, Cristian Lorenz, Juergen Weese, Josien Pluim, Marcel Breeuwer

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted for MICCAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.03977 2020-07-15 cs.AI cs.CL cs.CV cs.LG 70%

Multimodal Intelligence: Representation Learning, Information Fusion, and Applications

Chao Zhang, Zichao Yang, Xiaodong He, Li Deng

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.06661 2020-02-18 cs.CV 70%

Latent Normalizing Flows for Many-to-Many Cross-Domain Mappings

Shweta Mahajan, Iryna Gurevych, Stefan Roth

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Published as a conference paper at ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.02544 2019-11-06 cs.CV cs.LG stat.ML 70%

Large Scale Adversarial Representation Learning

Jeff Donahue, Karen Simonyan

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments 32 pages. In proceedings of NeurIPS 2019. This is the camera-ready version of the paper, with supplementary material included as appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.09845 2019-09-24 cs.CV 70%

Tell, Draw, and Repeat: Generating and Modifying Images Based on Continual Linguistic Instruction

Alaaeldin El-Nouby, Shikhar Sharma, Hannes Schulz, Devon Hjelm, Layla El Asri, Samira Ebrahimi Kahou, Yoshua Bengio, Graham W. Taylor

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at ICCV 2019

Journal ref Proceedings of the 2019 IEEE International Conference on Computer Vision (ICCV)

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.07094 2019-08-21 cs.CV 70%

Unpaired Image-to-Speech Synthesis with Multimodal Information Bottleneck

Shuang Ma, Daniel McDuff, Yale Song

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments ICCV 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.03047 2019-08-09 cs.CV 70%

Editing Text in the Wild

Liang Wu, Chengquan Zhang, Jiaming Liu, Junyu Han, Jingtuo Liu, Errui Ding, Xiang Bai

专题命中 文生图 :inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments accepted by ACM MM 2019

详情

展开后加载摘要…

URL PDF HTML 收藏