arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86539 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2306.16934 2023-07-03 cs.CV 70%

DreamDiffusion: Generating High-Quality Images from Brain EEG Signals

Yunpeng Bai, Xintao Wang, Yan-pei Cao, Yixiao Ge, Chun Yuan, Ying Shan

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16928 2023-06-30 cs.CV cs.AI cs.RO 70%

One-2-3-45: Any Single Image to 3D Mesh in 45 Seconds without Per-Shape Optimization

Minghua Liu, Chao Xu, Haian Jin, Linghao Chen, Mukund Varma T, Zexiang Xu, Hao Su

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments project website: one-2-3-45.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09329 2023-06-16 cs.CV 70%

DreamHuman: Animatable 3D Avatars from Text

Nikos Kolotouros, Thiemo Alldieck, Andrei Zanfir, Eduard Gabriel Bazavan, Mihai Fieraru, Cristian Sminchisescu

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Project website at https://dream-human.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07579 2023-06-14 cs.CV 70%

Parametric Implicit Face Representation for Audio-Driven Facial Reenactment

Ricong Huang, Peiwen Lai, Yipeng Qin, Guanbin Li

专题命中 文生图 :inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.13107 2023-06-14 cs.CV 70%

The Nuts and Bolts of Adopting Transformer in GANs

Rui Xu, Xiangyu Xu, Kai Chen, Bolei Zhou, Chen Change Loy

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR2023 Workshop AI4CC. Project Page: https://nbei.github.io/stransgan.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07257 2023-06-13 cs.CV 70%

MovieFactory: Automatic Movie Creation from Text using Large Generative Models for Language and Images

Junchen Zhu, Huan Yang, Huiguo He, Wenjing Wang, Zixi Tuo, Wen-Huang Cheng, Lianli Gao, Jingkuan Song, Jianlong Fu

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07200 2023-06-13 cs.CV cs.LG 70%

Fill-Up: Balancing Long-Tailed Data with Generative Models

Joonghyuk Shin, Minguk Kang, Jaesik Park

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 32 pages, 19 Figures, and 10 Tables. Project webpage at https://alex4727.github.io/Fill-Up/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12561 2023-06-07 cs.CV cs.CL cs.LG 70%

Retrieval-Augmented Multimodal Language Modeling

Michihiro Yasunaga, Armen Aghajanyan, Weijia Shi, Rich James, Jure Leskovec, Percy Liang, Mike Lewis, Luke Zettlemoyer, Wen-tau Yih

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Published at ICML 2023. Blog post available at https://cs.stanford.edu/~myasu/blog/racm3/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02776 2023-06-06 cs.CV 70%

Cheap-fake Detection with LLM using Prompt Engineering

Guangyang Wu, Weijie Wu, Xiaohong Liu, Kele Xu, Tianjiao Wan, Wenyi Wang

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments ICME2023 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09898 2023-06-05 cs.CV 70%

MetaCLUE: Towards Comprehensive Visual Metaphors Research

Arjun R. Akula, Brendan Driscoll, Pradyumna Narayana, Soravit Changpinyo, Zhiwei Jia, Suyash Damle, Garima Pruthi, Sugato Basu, Leonidas Guibas, William T. Freeman, Yuanzhen Li, Varun Jampani

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted in CVPR 2023. Project page: https://metaclue.github.io/ , Video summary: https://youtu.be/V3TmeNETL-o

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12799 2023-05-23 cs.CV 70%

Interactive Data Synthesis for Systematic Vision Adaptation via LLMs-AIGCs Collaboration

Qifan Yu, Juncheng Li, Wentao Ye, Siliang Tang, Yueting Zhuang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 11 pages, 6 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.00070 2023-05-16 cs.LG cs.CV 70%

Debiasing Vision-Language Models via Biased Prompts

Ching-Yao Chuang, Varun Jampani, Yuanzhen Li, Antonio Torralba, Stefanie Jegelka

专题命中 文生图 :text-to-image(abstract);generative vision(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13221 2023-05-15 cs.CV 70%

Explore the Power of Synthetic Data on Few-shot Object Detection

Shaobo Lin, Kun Wang, Xingyu Zeng, Rui Zhao

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Journal ref CVPR2023 Workshop on Generative Models for Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05275 2023-04-24 cs.CV 70%

Detecting Images Generated by Diffusers

Davide Alessandro Coccomini, Andrea Esuli, Fabrizio Falchi, Claudio Gennaro, Giuseppe Amato

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10261 2023-04-21 cs.CV 70%

Anything-3D: Towards Single-view Anything Reconstruction in the Wild

Qiuhong Shen, Xingyi Yang, Xinchao Wang

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05818 2023-04-13 cs.CV 70%

Gradient-Free Textual Inversion

Zhengcong Fei, Mingyuan Fan, Junshi Huang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02234 2023-04-11 cs.LG cs.CR cs.CV 70%

JPEG Compressed Images Can Bypass Protections Against AI Editing

Pedro Sandoval-Segura, Jonas Geiping, Tom Goldstein

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03119 2023-04-07 cs.CV 70%

Zero-shot Generative Model Adaptation via Image-specific Prompt Learning

Jiayi Guo, Chaofei Wang, You Wu, Eric Zhang, Kai Wang, Xingqian Xu, Shiji Song, Humphrey Shi, Gao Huang

专题命中 文生图 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by CVPR 2023. GitHub: https://github.com/Picsart-AI-Research/IPL-Zero-Shot-Generative-Model-Adaptation

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02828 2023-04-07 cs.CV cs.CY 70%

Uncurated Image-Text Datasets: Shedding Light on Demographic Bias

Noa Garcia, Yusuke Hirota, Yankun Wu, Yuta Nakashima

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13455 2023-03-24 cs.CV cs.CL 70%

CoBIT: A Contrastive Bi-directional Image-Text Generation Model

Haoxuan You, Mandy Guo, Zhecan Wang, Kai-Wei Chang, Jason Baldridge, Jiahui Yu

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04493 2023-03-23 cs.CV cs.LG 70%

SDFusion: Multimodal 3D Shape Completion, Reconstruction, and Generation

Yen-Chi Cheng, Hsin-Ying Lee, Sergey Tulyakov, Alexander Schwing, Liangyan Gui

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments In CVPR 2023. Project page and code is available at: https://yccyenchicheng.github.io/SDFusion/. Fix some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.00750 2023-03-02 cs.CV 70%

StraIT: Non-autoregressive Generation with Stratified Image Transformer

Shengju Qian, Huiwen Chang, Yuanzhen Li, Zizhao Zhang, Jiaya Jia, Han Zhang

专题命中 文生图 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12066 2023-02-24 cs.CV 70%

Teaching CLIP to Count to Ten

Roni Paiss, Ariel Ephrat, Omer Tov, Shiran Zada, Inbar Mosseri, Michal Irani, Tali Dekel

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.07574 2023-02-16 cs.CV 70%

Is synthetic data from generative models ready for image recognition?

Ruifei He, Shuyang Sun, Xin Yu, Chuhui Xue, Wenqing Zhang, Philip Torr, Song Bai, Xiaojuan Qi

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICLR 2023, spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.08751 2022-12-20 cs.CV cs.LG 70%

Point-E: A System for Generating 3D Point Clouds from Complex Prompts

Alex Nichol, Heewoo Jun, Prafulla Dhariwal, Pamela Mishkin, Mark Chen

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 8 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.00847 2022-12-05 cs.CV cs.AI 70%

Weakly Supervised Annotations for Multi-modal Greeting Cards Dataset

Sidra Hanif, Longin Jan Latecki

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted for poster presentation at Pretrain@WACV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.02138 2022-11-07 cs.CV 70%

Book Cover Synthesis from the Summary

Emdadul Haque, Md. Faraz Kabir Khan, Mohammad Imrul Jubair, Jarin Anjum, Abrar Zahir Niloy

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted as a full paper in AICCSA2022 (19th ACS/IEEE International Conference on Computer Systems and Applications)

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.14632 2022-10-27 cs.CR cs.MM 70%

Cover Reproducible Steganography via Deep Generative Models

Kejiang Chen, Hang Zhou, Yaofei Wang, Menghan Li, Weiming Zhang, Nenghai Yu

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.MM

Comments Accepted by IEEE TDSC

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12261 2022-10-25 cs.CL cs.CV 70%

Z-LaVI: Zero-Shot Language Solver Fueled by Visual Imagination

Yue Yang, Wenlin Yao, Hongming Zhang, Xiaoyang Wang, Dong Yu, Jianshu Chen

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.06886 2022-10-14 cs.CV 70%

ImaginaryNet: Learning Object Detectors without Real Images and Annotations

Minheng Ni, Zitong Huang, Kailai Feng, Wangmeng Zuo

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏