arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69868 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69868 篇

2407.15270 2024-07-23 eess.IV cs.CV 89%

MedEdit: Counterfactual Diffusion-based Image Editing on Brain MRI

Malek Ben Alaya, Daniel M. Lang, Benedikt Wiestler, Julia A. Schnabel, Cosmin I. Bercea

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted at MICCAI24 Simulation and Synthesis in Medical Imaging (SASHIMI) workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00752 2024-07-02 cs.CV cs.AI 89%

Chest-Diffusion: A Light-Weight Text-to-Image Model for Report-to-CXR Generation

Peng Huang, Xue Gao, Lihong Huang, Jing Jiao, Xiaokang Li, Yuanyuan Wang, Yi Guo

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16333 2024-06-25 cs.CV cs.AI 89%

Prompt-Consistency Image Generation (PCIG): A Unified Framework Integrating LLMs, Knowledge Graphs, and Controllable Diffusion Models

Yichen Sun, Zhixuan Chu, Zhan Qin, Kui Ren

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03626 2024-06-25 cs.CV 89%

TokenCompose: Text-to-Image Diffusion with Token-level Supervision

Zirui Wang, Zhizhou Sha, Zheng Ding, Yilin Wang, Zhuowen Tu

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2024, 21 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13388 2024-06-07 cs.CV 89%

UNIMO-G: Unified Image Generation through Multimodal Conditional Diffusion

Wei Li, Xue Xu, Jiachen Liu, Xinyan Xiao

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by ACL 2024, Main Conference, Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12531 2024-05-22 cs.CV cs.LG 89%

CustomText: Customized Textual Image Generation using Diffusion Models

Shubham Paliwal, Arushi Jain, Monika Sharma, Vikram Jamwal, Lovekesh Vig

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by AI for Content Creation (AI4CC) workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13127 2024-04-30 cs.CV cs.AI cs.CR 89%

MetaCloak: Preventing Unauthorized Subject-driven Text-to-image Diffusion-based Synthesis via Meta-learning

Yixin Liu, Chenrui Fan, Yutong Dai, Xun Chen, Pan Zhou, Lichao Sun

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);personalized generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18608 2024-04-02 cs.CV cs.AI cs.LG 89%

Contrastive Denoising Score for Text-guided Latent Diffusion Image Editing

Hyelin Nam, Gihyun Kwon, Geon Yeong Park, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2024 (poster); Project page: https://hyelinnam.github.io/CDS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05239 2024-03-11 cs.CV cs.AI cs.LG 89%

Towards Effective Usage of Human-Centric Priors in Diffusion Models for Text-based Human Image Generation

Junyan Wang, Zhenhong Sun, Zhiyu Tan, Xuanbai Chen, Weihua Chen, Hao Li, Cheng Zhang, Yang Song

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01212 2024-03-05 cs.CV 89%

TCIG: Two-Stage Controlled Image Generation with Quality Enhancement through Diffusion

Salaheldin Mohamed

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.01799 2024-03-01 cs.CV cs.LG 89%

Global Context with Discrete Diffusion in Vector Quantised Modelling for Image Generation

Minghui Hu, Yujie Wang, Tat-Jen Cham, Jianfei Yang, P. N. Suganthan

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.09869 2024-02-22 cs.CV cs.LG 89%

RenderDiffusion: Image Diffusion for 3D Reconstruction, Inpainting and Generation

Titas Anciukevičius, Zexiang Xu, Matthew Fisher, Paul Henderson, Hakan Bilen, Niloy J. Mitra, Paul Guerrero

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at CVPR 2023. Project page: https://github.com/Anciukevicius/RenderDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14153 2024-01-17 cs.CV 89%

DomainStudio: Fine-Tuning Diffusion Models for Domain-Driven Image Generation using Limited Data

Jingyuan Zhu, Huimin Ma, Jiansheng Chen, Jian Yuan

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments extended from DDPM-PA (arXiv:2211.03264), 33 pages, 34 figures. arXiv admin note: substantial text overlap with arXiv:2211.03264

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15707 2024-01-05 cs.CV 89%

High-Fidelity Diffusion-based Image Editing

Chen Hou, Guoqiang Wei, Zhibo Chen

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03540 2023-12-07 cs.CV 89%

FoodFusion: A Latent Diffusion Model for Realistic Food Image Generation

Olivia Markham, Yuhao Chen, Chi-en Amy Tai, Alexander Wong

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19066 2023-10-31 cs.CV 89%

Nested Diffusion Processes for Anytime Image Generation

Noam Elata, Bahjat Kawar, Tomer Michaeli, Michael Elad

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00224 2023-10-03 cs.CV cs.AI cs.LG 89%

Steered Diffusion: A Generalized Framework for Plug-and-Play Conditional Image Synthesis

Nithin Gopalakrishnan Nair, Anoop Cherian, Suhas Lohit, Ye Wang, Toshiaki Koike-Akino, Vishal M. Patel, Tim K. Marks

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);inpainting(abstract)

Comments Accepted at ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09614 2023-09-19 cs.CV cs.AI cs.LG 89%

Gradpaint: Gradient-Guided Inpainting with Diffusion Models

Asya Grechka, Guillaume Couairon, Matthieu Cord

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09781 2023-07-20 cs.CV cs.AI cs.LG 89%

Text2Layer: Layered Image Generation using Latent Diffusion Model

Xinyang Zhang, Wentian Zhao, Xin Lu, Jeff Chien

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments Preprint. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01952 2023-07-06 cs.CV cs.AI 89%

SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis

Dustin Podell, Zion English, Kyle Lacey, Andreas Blattmann, Tim Dockhorn, Jonas Müller, Joe Penna, Robin Rombach

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11984 2023-06-22 eess.IV cs.AI cs.CV 89%

TauPETGen: Text-Conditional Tau PET Image Synthesis Based on Latent Diffusion Models

Se-In Jang, Cristina Lois, Emma Thibault, J. Alex Becker, Yafei Dong, Marc D. Normandin, Julie C. Price, Keith A. Johnson, Georges El Fakhri, Kuang Gong

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10804 2023-06-21 cs.CV 89%

Conditional Text Image Generation with Diffusion Models

Yuanzhi Zhu, Zhaohai Li, Tianwei Wang, Mengchao He, Cong Yao

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13050 2023-05-23 cs.SD cs.CV cs.LG eess.AS 89%

AudioToken: Adaptation of Text-Conditioned Diffusion Models for Audio-to-Image Generation

Guy Yariv, Itai Gat, Lior Wolf, Yossi Adi, Idan Schwartz

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to INTERSPEECH 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.15257 2023-03-29 cs.CV cs.AI 89%

ERNIE-ViLG 2.0: Improving Text-to-Image Diffusion Model with Knowledge-Enhanced Mixture-of-Denoising-Experts

Zhida Feng, Zhenyu Zhang, Xintong Yu, Yewei Fang, Lanxin Li, Xuyi Chen, Yuxiang Lu, Jiaxiang Liu, Weichong Yin, Shikun Feng, Yu Sun, Li Chen, Hao Tian, Hua Wu, Haifeng Wang

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2023, highlight. Project page: https://wenxin.baidu.com/ernie-vilg

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09319 2023-03-17 cs.CV 89%

Unified Multi-Modal Latent Diffusion for Joint Subject and Text Conditional Image Generation

Yiyang Ma, Huan Yang, Wenjing Wang, Jianlong Fu, Jiaying Liu

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12500 2023-03-02 cs.CV 89%

Person Image Synthesis via Denoising Diffusion Model

Ankan Kumar Bhunia, Salman Khan, Hisham Cholakkal, Rao Muhammad Anwer, Jorma Laaksonen, Mubarak Shah, Fahad Shahbaz Khan

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08113 2023-02-17 cs.CV 89%

MultiDiffusion: Fusing Diffusion Paths for Controlled Image Generation

Omer Bar-Tal, Lior Yariv, Yaron Lipman, Tali Dekel

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.07771 2023-02-17 cs.CV 89%

Discrete Contrastive Diffusion for Cross-Modal Music and Image Generation

Ye Zhu, Yu Wu, Kyle Olszewski, Jian Ren, Sergey Tulyakov, Yan Yan

专题命中 扩散模型 :diffusion(title,abstract);image generation(title);text-to-image(abstract);image synthesis(abstract)

Comments ICLR 2023. Project at https://github.com/L-YeZhu/CDCD

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.03859 2022-05-10 cs.CV cs.LG 89%

On Conditioning the Input Noise for Controlled Image Generation with Diffusion Models

Vedant Singh, Surgan Jandial, Ayush Chopra, Siddharth Ramesh, Balaji Krishnamurthy, Vineeth N. Balasubramanian

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments Accepted at the workshop on AI for Content Creation at CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.10752 2022-04-14 cs.CV 89%

High-Resolution Image Synthesis with Latent Diffusion Models

Robin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser, Björn Ommer

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);inpainting(abstract)

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏