arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69953 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69953 篇

2305.11281 2023-09-25 cs.CV cs.LG 85%

SlotDiffusion: Object-Centric Generative Modeling with Diffusion Models

Ziyi Wu, Jingyu Hu, Wuyue Lu, Igor Gilitschenski, Animesh Garg

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments NeurIPS 2023 Spotlight. Project page: https://slotdiffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16582 2023-09-12 cs.CV 85%

Any-Size-Diffusion: Toward Efficient Text-Driven Synthesis for Any-Size HD Images

Qingping Zheng, Yuanfan Guo, Jiankang Deng, Jianhua Han, Ying Li, Songcen Xu, Hang Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09306 2023-08-21 cs.CV 85%

DiffDis: Empowering Generative Diffusion Model with Cross-Modal Discrimination Capability

Runhui Huang, Jianhua Han, Guansong Lu, Xiaodan Liang, Yihan Zeng, Wei Zhang, Hang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06713 2023-08-15 cs.CV 85%

LAW-Diffusion: Complex Scene Generation by Diffusion with Layouts

Binbin Yang, Yi Luo, Ziliang Chen, Guangrun Wang, Xiaodan Liang, Liang Lin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06101 2023-08-14 cs.CV 85%

Taming the Power of Diffusion Models for High-Quality Virtual Try-On with Appearance Flow

Junhong Gou, Siyu Sun, Jianfu Zhang, Jianlou Si, Chen Qian, Liqing Zhang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08702 2023-07-18 cs.CV 85%

Diffusion Models Beat GANs on Image Classification

Soumik Mukhopadhyay, Matthew Gwilliam, Vatsal Agarwal, Namitha Padmanabhan, Archana Swaminathan, Srinidhi Hegde, Tianyi Zhou, Abhinav Shrivastava

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments 15 pages, 7 figures, 10 tables, submission under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06272 2023-07-13 cs.CV cs.CR cs.LG 85%

Exposing the Fake: Effective Diffusion-Generated Images Detection

Ruipeng Ma, Jinhao Duan, Fei Kong, Xiaoshuang Shi, Kaidi Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments AdvML-Frontiers@ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08257 2023-06-16 cs.CV cs.CR 85%

On the Robustness of Latent Diffusion Models

Jianping Zhang, Zhuoer Xu, Shiwen Cui, Changhua Meng, Weibin Wu, Michael R. Lyu

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05182 2023-06-14 cs.CV cs.LG 85%

Interactive Fashion Content Generation Using LLMs and Latent Diffusion Models

Krishna Sri Ipsit Mantri, Nevasini Sasikumar

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Third Workshop on Ethical Considerations in Creative applications of Computer Vision (EC3V) at CVPR 2023. arXiv admin note: substantial text overlap with arXiv:2301.02110, arXiv:2112.10752 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.06013 2023-06-01 cs.CV cs.AI cs.LG 85%

The Stable Artist: Steering Semantics in Diffusion Latent Space

Manuel Brack, Patrick Schramowski, Felix Friedrich, Dominik Hintersdorf, Kristian Kersting

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments This is a report of preliminary results. A full version of the paper is available at: arXiv:2301.12247

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18726 2023-05-31 cs.CV 85%

Diffusion-Stego: Training-free Diffusion Generative Steganography via Message Projection

Daegyu Kim, Chaehun Shin, Jooyoung Choi, Dahuin Jung, Sungroh Yoon

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06555 2023-05-31 cs.LG cs.CV 85%

One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale

Fan Bao, Shen Nie, Kaiwen Xue, Chongxuan Li, Shi Pu, Yaole Wang, Gang Yue, Yue Cao, Hang Su, Jun Zhu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to ICML2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.01316 2023-05-31 cs.CV cs.AI cs.CR cs.LG 85%

Are Diffusion Models Vulnerable to Membership Inference Attacks?

Jinhao Duan, Fei Kong, Shiqi Wang, Xiaoshuang Shi, Kaidi Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments To appear in ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11540 2023-05-22 cs.CV cs.CL 85%

Efficient Cross-Lingual Transfer for Chinese Stable Diffusion with Images as Pivots

Jinyi Hu, Xu Han, Xiaoyuan Yi, Yutong Chen, Wenhao Li, Zhiyuan Liu, Maosong Sun

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04651 2023-05-09 cs.CV 85%

ReGeneration Learning of Diffusion Models with Rich Prompts for Zero-Shot Image Translation

Yupei Lin, Sen Zhang, Xiaojun Yang, Xiao Wang, Yukai Shi

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

Comments https://yupeilin2388.github.io/publication/ReDiffuser

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08477 2023-04-19 cs.CV 85%

Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation

Jie An, Songyang Zhang, Harry Yang, Sonal Gupta, Jia-Bin Huang, Jiebo Luo, Xi Yin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments https://latent-shift.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03298 2023-04-18 cs.CV cs.AI 85%

Diversity is Definitely Needed: Improving Model-Agnostic Zero-shot Classification via Stable Diffusion

Jordan Shipard, Arnold Wiliem, Kien Nguyen Thanh, Wei Xiang, Clinton Fookes

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments (10 pages, 6 figures, 3 tables, preprint)

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12152 2023-03-28 cs.CV cs.AI cs.LG 85%

All are Worth Words: A ViT Backbone for Diffusion Models

Fan Bao, Shen Nie, Kaiwen Xue, Yue Cao, Chongxuan Li, Hang Su, Jun Zhu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05830 2023-02-14 eess.IV cs.CV cs.LG 85%

NephroNet: A Novel Program for Identifying Renal Cell Carcinoma and Generating Synthetic Training Images with Convolutional Neural Networks and Diffusion Models

Yashvir Sabharwal

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 22 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03900 2023-02-09 cs.CV cs.AI cs.LG stat.ML 85%

Zero-shot Generation of Coherent Storybook from Plain Text Story using Diffusion Models

Hyeonho Jeong, Gihyun Kwon, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.16007 2023-02-09 cs.CV 85%

Improved Vector Quantized Diffusion Models

Zhicong Tang, Shuyang Gu, Jianmin Bao, Dong Chen, Fang Wen

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments update reference

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.04802 2023-01-13 cs.LG cs.CV eess.IV 85%

Diffusion-based Data Augmentation for Skin Disease Classification: Impact Across Original Medical Datasets to Fully Synthetic Images

Mohamed Akrout, Bálint Gyepesi, Péter Holló, Adrienn Poór, Blága Kincső, Stephen Solis, Katrina Cirone, Jeremy Kawahara, Dekker Slade, Latif Abid, Máté Kovács, István Fazekas

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04885 2022-12-09 cs.CV cs.CL 85%

What the DAAM: Interpreting Stable Diffusion Using Cross Attention

Raphael Tang, Linqing Liu, Akshat Pandey, Zhiying Jiang, Gefei Yang, Karun Kumar, Pontus Stenetorp, Jimmy Lin, Ferhan Ture

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments First two authors contributed equally. 13 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.17106 2022-12-01 cs.CV eess.IV 85%

Diffusion Probabilistic Model Made Slim

Xingyi Yang, Daquan Zhou, Jiashi Feng, Xinchao Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12572 2022-11-24 cs.CV cs.AI 85%

Plug-and-Play Diffusion Features for Text-Driven Image-to-Image Translation

Narek Tumanyan, Michal Geyer, Shai Bagon, Tali Dekel

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.10950 2022-11-22 cs.CV 85%

Synthesizing Coherent Story with Auto-Regressive Latent Diffusion Models

Xichen Pan, Pengda Qin, Yuhong Li, Hui Xue, Wenhu Chen

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.09795 2022-11-18 cs.CV 85%

Conffusion: Confidence Intervals for Diffusion Models

Eliahu Horwitz, Yedid Hoshen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.07793 2022-11-16 eess.IV cs.CV 85%

Extreme Generative Image Compression by Learning Text Embedding from Diffusion Models

Zhihong Pan, Xin Zhou, Hao Tian

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.11058 2022-10-21 cs.CV 85%

Representation Learning with Diffusion Models

Jeremias Traub

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.14988 2022-09-30 cs.CV cs.LG stat.ML 85%

DreamFusion: Text-to-3D using 2D Diffusion

Ben Poole, Ajay Jain, Jonathan T. Barron, Ben Mildenhall

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments see project page at https://dreamfusion3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏