arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69953 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69953 篇

2403.18103 2025-01-09 cs.LG cs.CV 85%

Tutorial on Diffusion Models for Imaging and Vision

Stanley H. Chan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21117 2025-01-03 cs.CV 85%

Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation

Yuanbo Yang, Jiahao Shao, Xinyang Li, Yujun Shen, Andreas Geiger, Yiyi Liao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00375 2025-01-03 cs.CV cs.LG 85%

Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free

Evelyn Zhang, Bang Xiao, Jiayi Tang, Qianli Ma, Chang Zou, Xuefei Ning, Xuming Hu, Linfeng Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00234 2024-12-31 cs.CV 85%

Grid Diffusion Models for Text-to-Video Generation

Taegyeong Lee, Soyeong Kwon, Taehwan Kim

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments This paper is being withdrawn due to issues of misconduct in the experiments presented in Table 1 and 5. We recognize this as an ethical concern and sincerely apologize to the research community for any inconvenience it may have caused

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18797 2024-12-30 cs.CV 85%

DRDM: A Disentangled Representations Diffusion Model for Synthesizing Realistic Person Images

Enbo Huang, Yuan Zhang, Faliang Huang, Guangyu Zhang, Yang Liu

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05780 2024-12-24 cs.CV cs.AI 85%

BudgetFusion: Perceptually-Guided Adaptive Diffusion Models

Qinchan Li, Kenneth Chen, Changyue Su, Qi Sun

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12550 2024-12-18 cs.CV 85%

Consistent Diffusion: Denoising Diffusion Model with Data-Consistent Training for Image Restoration

Xinlong Cheng, Tiantian Cao, Guoan Cheng, Bangxuan Huang, Xinghan Tian, Ye Wang, Xiaoyu He, Weixin Li, Tianfan Xue, Xuan Dong

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09324 2024-12-16 cs.CV 85%

Are Conditional Latent Diffusion Models Effective for Image Restoration?

Yunchen Yuan, Junyuan Xiao, Xinjie Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03756 2024-12-06 cs.CV cs.AI 85%

Multi-view Image Diffusion via Coordinate Noise and Fourier Attention

Justin Theiss, Norman Müller, Daeil Kim, Aayush Prakash

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11831 2024-12-06 cs.CV 85%

Exploring the Role of Large Language Models in Prompt Encoding for Diffusion Models

Bingqi Ma, Zhuofan Zong, Guanglu Song, Hongsheng Li, Yu Liu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10162 2024-12-06 eess.IV cs.CV cs.LG physics.med-ph 85%

Learning to Reconstruct Accelerated MRI Through K-space Cold Diffusion without Noise

Guoyao Shen, Mengyu Li, Chad W. Farris, Stephan Anderson, Xin Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments 21 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03400 2024-12-05 cs.CV 85%

Implicit Priors Editing in Stable Diffusion via Targeted Token Adjustment

Feng He, Chao Zhang, Zhixue Zhao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01821 2024-12-03 cs.CV 85%

World-consistent Video Diffusion with Explicit 3D Modeling

Qihang Zhang, Shuangfei Zhai, Miguel Angel Bautista, Kevin Miao, Alexander Toshev, Joshua Susskind, Jiatao Gu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00100 2024-12-03 cs.CV cs.LG stat.ML 85%

Steering Rectified Flow Models in the Vector Field for Controlled Image Generation

Maitreya Patel, Song Wen, Dimitris N. Metaxas, Yezhou Yang

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Project Page: https://flowchef.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13720 2024-12-02 cs.CV 85%

Simultaneous Image-to-Zero and Zero-to-Noise: Diffusion Models with Analytical Image Attenuation

Yuhang Huang, Zheng Qin, Xinwang Liu, Kai Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05595 2024-11-27 cs.CV 85%

UniFL: Improve Latent Diffusion Model via Unified Feedback Learning

Jiacheng Zhang, Jie Wu, Yuxi Ren, Xin Xia, Huafeng Kuang, Pan Xie, Jiashi Li, Xuefeng Xiao, Weilin Huang, Shilei Wen, Lean Fu, Guanbin Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by Neurips2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16079 2024-11-26 cs.CV cs.AI 85%

Debiasing Classifiers by Amplifying Bias with Latent Diffusion and Large Language Models

Donggeun Ko, Dongjun Lee, Namjun Park, Wonkyeong Shim, Jaekwang Kim

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 8 pages + Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00777 2024-11-22 cs.CV cs.AI 85%

Diffusion Features to Bridge Domain Gap for Semantic Segmentation

Yuxiang Ji, Boyong He, Chenyuan Qu, Zhuoyue Tan, Chuan Qin, Liaoni Wu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments The code is released at https://github.com/Yux1angJi/DIFF

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15287 2024-11-19 cs.CV 85%

ArtWeaver: Advanced Dynamic Style Integration via Diffusion Model

Chengming Xu, Kai Hu, Qilin Wang, Donghao Luo, Jiangning Zhang, Xiaobin Hu, Yanwei Fu, Chengjie Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09174 2024-11-15 cs.CV cs.AI cs.LG eess.IV 85%

Advancing Diffusion Models: Alias-Free Resampling and Enhanced Rotational Equivariance

Md Fahim Anjum

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24006 2024-11-15 cs.CV cs.LG 85%

DiffPAD: Denoising Diffusion-based Adversarial Patch Decontamination

Jia Fu, Xiao Zhang, Sepideh Pashami, Fatemeh Rahimian, Anders Holst

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted to 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08196 2024-11-14 cs.CV 85%

Latent Space Disentanglement in Diffusion Transformers Enables Precise Zero-shot Semantic Editing

Zitao Shuai, Chenwei Wu, Zhengxu Tang, Bowen Song, Liyue Shen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2408.13335

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11288 2024-11-13 eess.IV cs.AI cs.CV cs.LG 85%

Zero-Shot Adaptation for Approximate Posterior Sampling of Diffusion Models in Inverse Problems

Yaşar Utku Alçalar, Mehmet Akçakaya

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments European Conference on Computer Vision (ECCV), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02395 2024-11-05 cs.CV 85%

Training-free Regional Prompting for Diffusion Transformers

Anthony Chen, Jianjin Xu, Wenzhao Zheng, Gaole Dai, Yida Wang, Renrui Zhang, Haofan Wang, Shanghang Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Code is available at https://github.com/antonioo-c/Regional-Prompting-FLUX

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11208 2024-10-31 cs.CV cs.LG 85%

DreamSteerer: Enhancing Source Image Conditioned Editability using Personalized Diffusion Models

Zhengyang Yu, Zhaoyuan Yang, Jing Zhang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);personalized generation(abstract);分类 cs.CV

Comments Published as a conference paper at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20165 2024-10-29 cs.CV cs.AI 85%

Diff-CXR: Report-to-CXR generation through a disease-knowledge enhanced diffusion model

Peng Huang, Bowen Guo, Shuyu Liang, Junhu Fu, Yuanyuan Wang, Yi Guo

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16657 2024-10-23 cs.LG cs.CV 85%

Dual-Model Defense: Safeguarding Diffusion Models from Membership Inference Attacks through Disjoint Data Splitting

Bao Q. Tran, Viet Nguyen, Anh Tran, Toan Tran

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01472 2024-10-22 cs.CV cs.CL cs.LG 85%

Reverse Stable Diffusion: What prompt was used to generate this image?

Florinel-Alin Croitoru, Vlad Hondru, Radu Tudor Ionescu, Mubarak Shah

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted for publication in Computer Vision and Image Understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14429 2024-10-21 cs.CV cs.AI cs.LG 85%

FashionR2R: Texture-preserving Rendered-to-Real Image Translation with Diffusion Models

Rui Hu, Qian He, Gaofeng He, Jiedong Zhuang, Huang Chen, Huafeng Liu, Huamin Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13122 2024-10-18 cs.CV cs.LG 85%

Boosting Imperceptibility of Stable Diffusion-based Adversarial Examples Generation with Momentum

Nashrah Haque, Xiang Li, Zhehui Chen, Yanzhao Wu, Lei Yu, Arun Iyengar, Wenqi Wei

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 10 pages, 12 figures. To be published in IEEE TPS 2024 Proceedings. Code available on GitHub: https://github.com/nashrahhaque/SD-MIAE

详情

展开后加载摘要…

URL PDF HTML 收藏