arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69868 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69868 篇

2503.16835 2025-03-24 cs.CV cs.LG 85%

Safe and Reliable Diffusion Models via Subspace Projection

Huiqiang Chen, Tianqing Zhu, Linlin Wang, Xin Yu, Longxiang Gao, Wanlei Zhou

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14487 2025-03-19 cs.CV cs.AI 85%

DiffMoE: Dynamic Token Selection for Scalable Diffusion Transformers

Minglei Shi, Ziyang Yuan, Haotian Yang, Xintao Wang, Mingwu Zheng, Xin Tao, Wenliang Zhao, Wenzhao Zheng, Jie Zhou, Jiwen Lu, Pengfei Wan, Di Zhang, Kun Gai

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Project Page: https://shiml20.github.io/DiffMoE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12891 2025-03-19 cs.CV 85%

Text-Guided Texturing by Synchronized Multi-View Diffusion

Yuxin Liu, Minshan Xie, Hanyuan Liu, Tien-Tsin Wong

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments 11 pages, 11 figures, technical papers, "Text, Texturing, and Stylization"@SIGGRAPH Asia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12838 2025-03-18 cs.CV 85%

DreamLayer: Simultaneous Multi-Layer Generation via Diffusion Mode

Junjia Huang, Pengxiang Yan, Jinhang Cai, Jiyang Liu, Zhao Wang, Yitong Wang, Xinglong Wu, Guanbin Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12590 2025-03-18 cs.CV 85%

Personalize Anything for Free with Diffusion Transformer

Haoran Feng, Zehuan Huang, Lin Li, Hairong Lv, Lu Sheng

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments https://fenghora.github.io/Personalize-Anything-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11071 2025-03-18 cs.CV 85%

Harnessing Frequency Spectrum Insights for Image Copyright Protection Against Diffusion Models

Zhenguang Liu, Chao Shuai, Shaojing Fan, Ziping Dong, Jinwu Hu, Zhongjie Ba, Kui Ren

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Received by CVPR 2025 (10 pages, 11 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07589 2025-03-14 cs.CV 85%

DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation

Jianzong Wu, Chao Tang, Jingbo Wang, Yanhong Zeng, Xiangtai Li, Yunhai Tong

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments [CVPR 2025] The project page is https://jianzongwu.github.io/projects/diffsensei/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14871 2025-03-14 cs.CV cs.AI cs.CL cs.LG 85%

Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation

Dingyuan Shi, Yong Wang, Hangyu Li, Xiangxiang Chu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06652 2025-03-13 cs.CV 85%

Adding Additional Control to One-Step Diffusion with Joint Distribution Matching

Yihong Luo, Tianyang Hu, Yifan Song, Jiacheng Sun, Zhenguo Li, Jing Tang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08116 2025-03-12 cs.CV 85%

ACE: Concept Editing in Diffusion Models without Performance Degradation

Ruipeng Wang, Junfeng Fang, Jiaqi Li, Hao Chen, Jie Shi, Kun Wang, Xiang Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02127 2025-03-05 cs.CV 85%

HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage

Qifan Fu, Xu Chen, Muhammad Asad, Shanxin Yuan, Changjae Oh, Gregory Slabaugh

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05760 2025-02-28 cs.CV cs.AI cs.LG math.OC stat.ML 85%

Training-free Diffusion Model Alignment with Sampling Demons

Po-Hung Yeh, Kuang-Huei Lee, Jun-Cheng Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 35 pages

Journal ref Proceedings of the Thirteenth International Conference on Learning Representations (ICLR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19094 2025-02-25 cs.CV eess.IV 85%

Ambient Denoising Diffusion Generative Adversarial Networks for Establishing Stochastic Object Models from Noisy Image Data

Xichen Xu, Wentao Chen, Weimin Zhou

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments SPIE Medical Imaging 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07627 2025-02-18 cs.CV 85%

Leveraging Previous Steps: A Training-free Fast Solver for Flow Diffusion

Kaiyu Song, Hanjiang Lai

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01014 2025-02-18 cs.CV 85%

Growth Inhibitors for Suppressing Inappropriate Image Concepts in Diffusion Models

Die Chen, Zhiwen Li, Mingyuan Fan, Cen Chen, Wenmeng Zhou, Yanhao Wang, Yaliang Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11810 2025-02-18 cs.CV 85%

Pixel Is Not a Barrier: An Effective Evasion Attack for Pixel-Domain Diffusion Models

Chun-Yen Shih, Li-Xuan Peng, Jia-Wei Liao, Ernie Chu, Cheng-Fu Chou, Jun-Cheng Chen

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10348 2025-02-12 cs.CV cs.LG 85%

Denoising Task Difficulty-based Curriculum for Training Diffusion Models

Jin-Young Kim, Hyojun Go, Soonwoo Kwon, Hyun-Gyoon Kim

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04412 2025-02-10 cs.CV cs.AI cs.CL 85%

Decoder-Only LLMs are Better Controllers for Diffusion Models

Ziyi Dong, Yao Xiao, Pengxu Wei, Liang Lin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03426 2025-02-06 cs.CV cs.AI 85%

TruePose: Human-Parsing-guided Attention Diffusion for Full-ID Preserving Pose Transfer

Zhihong Xu, Dongxia Wang, Peng Du, Yang Cao, Qing Guo

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16764 2025-01-29 cs.CV 85%

DiffSplat: Repurposing Image Diffusion Models for Scalable Gaussian Splat Generation

Chenguo Lin, Panwang Pan, Bangbang Yang, Zeming Li, Yadong Mu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to ICLR 2025; Project page: https://chenguolin.github.io/projects/DiffSplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14677 2025-01-28 cs.CV 85%

Reflecting Reality: Enabling Diffusion Models to Produce Faithful Mirror Reflections

Ankit Dhiman, Manan Shah, Rishubh Parihar, Yash Bhalgat, Lokesh R Boregowda, R Venkatesh Babu

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to 3DV 2025. First two authors contributed equally. Project Page: https://val.cds.iisc.ac.in/reflecting-reality.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03177 2025-01-22 cs.CV cs.AI 85%

On Improved Conditioning Mechanisms and Pre-training Strategies for Diffusion Models

Tariq Berrada Ifriqi, Pietro Astolfi, Melissa Hall, Reyhane Askari-Hemmat, Yohann Benchetrit, Marton Havasi, Matthew Muckley, Karteek Alahari, Adriana Romero-Soriano, Jakob Verbeek, Michal Drozdzal

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted as a conference paper (poster) for NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18124 2025-01-22 cs.CV 85%

Lotus: Diffusion-based Visual Foundation Model for High-quality Dense Prediction

Jing He, Haodong Li, Wei Yin, Yixun Liang, Leheng Li, Kaiqiang Zhou, Hongbo Zhang, Bingbing Liu, Ying-Cong Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments The first two authors contributed equally. Project page: https://lotus3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18103 2025-01-09 cs.LG cs.CV 85%

Tutorial on Diffusion Models for Imaging and Vision

Stanley H. Chan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21117 2025-01-03 cs.CV 85%

Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation

Yuanbo Yang, Jiahao Shao, Xinyang Li, Yujun Shen, Andreas Geiger, Yiyi Liao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00375 2025-01-03 cs.CV cs.LG 85%

Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free

Evelyn Zhang, Bang Xiao, Jiayi Tang, Qianli Ma, Chang Zou, Xuefei Ning, Xuming Hu, Linfeng Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00234 2024-12-31 cs.CV 85%

Grid Diffusion Models for Text-to-Video Generation

Taegyeong Lee, Soyeong Kwon, Taehwan Kim

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments This paper is being withdrawn due to issues of misconduct in the experiments presented in Table 1 and 5. We recognize this as an ethical concern and sincerely apologize to the research community for any inconvenience it may have caused

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18797 2024-12-30 cs.CV 85%

DRDM: A Disentangled Representations Diffusion Model for Synthesizing Realistic Person Images

Enbo Huang, Yuan Zhang, Faliang Huang, Guangyu Zhang, Yang Liu

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05780 2024-12-24 cs.CV cs.AI 85%

BudgetFusion: Perceptually-Guided Adaptive Diffusion Models

Qinchan Li, Kenneth Chen, Changyue Su, Qi Sun

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12550 2024-12-18 cs.CV 85%

Consistent Diffusion: Denoising Diffusion Model with Data-Consistent Training for Image Restoration

Xinlong Cheng, Tiantian Cao, Guoan Cheng, Bangxuan Huang, Xinghan Tian, Ye Wang, Xiaoyu He, Weixin Li, Tianfan Xue, Xuan Dong

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏