arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70051 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70051 篇

2503.07677 2025-07-22 cs.LG cs.AI 82%

PLADIS: Pushing the Limits of Attention in Diffusion Models at Inference Time by Leveraging Sparsity

Kwanyoung Kim, Byeongsu Sim

机构 * Samsung Research(三星研究)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

Comments Camera ready version for ICCV 2025, 30 pages, 20 figures, project page : https://cubeyoung.github.io/pladis-proejct/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10861 2025-07-16 cs.LG 82%

Visually grounded emotion regulation via diffusion models and user-driven reappraisal

Edoardo Pinzuti, Oliver Tüscher, André Ferreira Castro

机构 * Leibniz Institute for Resilience Research(莱比锡韧性研究所) University Medicine Halle (Saale) of the Martin Luther University Halle-Wittenberg (MLU)(马尔堡-哈雷大学哈雷-萨勒医学院) German Center for Mental Health (DZPG)(德国心理健康中心) School of Life Sciences, Technical University of Munich(慕尼黑技术大学生命科学学院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15213 2025-07-08 cs.LG cs.AI cs.CR 82%

Backdooring Bias ($B^2$) into Stable Diffusion Models

Ali Naseh, Jaechul Roh, Eugene Bagdasarian, Amir Houmansadr

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

Comments Accepted to USENIX Security '25

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06405 2025-07-08 cs.CR 82%

White-box Membership Inference Attacks against Diffusion Models

Yan Pang, Tianhao Wang, Xuhui Kang, Mengdi Huai, Yang Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

Journal ref Proceedings on Privacy Enhancing Technologies Symposium 2025 2 398-415

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04971 2025-06-26 cs.IR 82%

Diffusion Recommender Model

Wenjie Wang, Yiyan Xu, Fuli Feng, Xinyu Lin, Xiangnan He, Tat-Seng Chua

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

Comments 10 pages, 7 figures, accepted for publication in SIGIR'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18290 2025-06-24 cs.LG 82%

Instability in Diffusion ODEs: An Explanation for Inaccurate Image Reconstruction

Han Zhang, Jinghong Mao, Shangwen Zhu, Zhantao Yang, Lianghua Huang, Yu Liu, Deli Zhao, Ruili Feng, Fan Cheng

机构 * Shanghai Jiao Tong University(上海交通大学) Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15385 2025-06-19 cs.LG 82%

Provable Maximum Entropy Manifold Exploration via Diffusion Models

Riccardo De Santi, Marin Vlastelica, Ya-Ping Hsieh, Zebang Shen, Niao He, Andreas Krause

机构 * ETH Zurich, 8092 Zurich, Switzerland(苏黎世联邦理工学院) ETH AI Center, Zurich, Switzerland(苏黎世联邦理工学院人工智能中心)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23612 2025-06-13 cs.LG 82%

Diffusion-Free Graph Generation with Next-Scale Prediction

Samuel Belkadi, Steve Hong, Marian Chen, Miruna Cretu, Charles Harris, Pietro Lio

机构 * Department of Engineering, University of Cambridge, UK(工程系,剑桥大学,英国) Department of Computer Science, University of Cambridge, UK(计算机科学系,剑桥大学,英国)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

Comments Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07706 2025-06-10 cs.LG 82%

Evaluating Robustness in Latent Diffusion Models via Embedding Level Augmentation

Boris Martirosyan, Alexey Karmanov

机构 * American University of Armenia(亚美尼亚美国大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19824 2025-06-10 cs.CV cs.GR cs.MM 82%

AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers

Jiazhi Guan, Kaisiyuan Wang, Zhiliang Xu, Quanwei Yang, Yasheng Sun, Shengyi He, Borong Liang, Yukang Cao, Yingying Li, Haocheng Feng, Errui Ding, Jingdong Wang, Youjian Zhao, Hang Zhou, Ziwei Liu

机构 * DCST, Tsinghua University(清华大学智能驾驶实验室) Baidu Inc.(百度公司) S-Lab, Nanyang Technological University(南洋理工大学S实验室) Zhongguancun Laboratory(中关村实验室) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR、cs.MM

Comments Accepted to IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025. Project page: https://guanjz20.github.io/projects/AudCast

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05340 2025-06-09 cs.LG cs.AI 82%

Exploring Diffusion Transformer Designs via Grafting

Keshigeyan Chandrasegaran, Michael Poli, Daniel Y. Fu, Dongjun Kim, Lea M. Hadzic, Manling Li, Agrim Gupta, Stefano Massaroli, Azalia Mirhoseini, Juan Carlos Niebles, Stefano Ermon, Li Fei-Fei

机构 * Stanford University(斯坦福大学) Liquid AI Together AI UC San Diego(加州大学圣地亚哥分校) Northwestern University(西北大学) Google DeepMind(谷歌DeepMind) Salesforce Research(Salesforce研究)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

Comments 22 pages; Project website: https://grafting.stanford.edu

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09430 2025-06-06 cs.RO cs.LG 82%

Mini Diffuser: Fast Multi-task Diffusion Policy Training Using Two-level Mini-batches

Yutong Hu, Pinhao Song, Kehan Wen, Renaud Detry

机构 * KU Leuven(卢森堡大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04244 2025-06-06 cs.AI 82%

Zero-Shot Adaptation of Parameter-Efficient Fine-Tuning in Diffusion Models

Farzad Farhadzadeh, Debasmit Das, Shubhankar Borse, Fatih Porikli

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02039 2025-06-04 cs.LG cs.AI 82%

Dynamic Search for Inference-Time Alignment in Diffusion Models

Xiner Li, Masatoshi Uehara, Xingyu Su, Gabriele Scalia, Tommaso Biancalani, Aviv Regev, Sergey Levine, Shuiwang Ji

机构 * Texas A&M University(德克萨斯A&M大学) Genentech(基因泰克) UC Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14250 2025-06-04 cs.LG eess.IV math.PR 82%

Diffusion models for Gaussian distributions: Exact solutions and Wasserstein errors

Emile Pierret, Bruno Galerne

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01541 2025-06-03 cs.LG stat.ML 82%

Adaptive Destruction Processes for Diffusion Samplers

Timofei Gritsaev, Nikita Morozov, Kirill Tamogashev, Daniil Tiapkin, Sergey Samsonov, Alexey Naumov, Dmitry Vetrov, Nikolay Malkin

机构 * Constructor University(Constructor大学) HSE University(俄罗斯高等经济大学) University of Edinburgh(爱丁堡大学) CNRS(法国国家科学研究中心) École polytechnique(巴黎政治学院) LMO, Université Paris-Saclay(巴黎萨克雷大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08598 2025-06-03 cs.LG stat.ML 82%

Disentangling Total-Variance and Signal-to-Noise-Ratio Improves Diffusion Models

Khaled Kahouli, Winfried Ripken, Stefan Gugler, Oliver T. Unke, Klaus-Robert Müller, Shinichi Nakajima

机构 * BIFOLD – Berlin Institute for the Foundations of Learning and Data Machine Learning Group, Technische Universität Berlin(柏林学习与数据基础研究所机器学习组,柏林技术大学) Technische Universität Berlin(柏林技术大学) Google DeepMind(谷歌DeepMind) Department of Artificial Intelligence, Korea University(韩国大学人工智能系) Max-Planck Institute for Informatics(马克斯·普朗克信息研究所) RIKEN Center for Advanced Intelligence Project(理化学研究所高级智能项目中心)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17146 2025-05-26 math.DG 82%

Diffusion-Shock Filtering on the Space of Positions and Orientations

Finn M. Sherry, Kristina Schaefer, Remco Duits

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract)

Comments Accepted in 10th International Conference on Scale Space and Variational Methods in Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18052 2025-05-23 cs.LG cs.AI 82%

SAeUron: Interpretable Concept Unlearning in Diffusion Models with Sparse Autoencoders

Bartosz Cywiński, Kamil Deja

机构 * Bartosz Cywiński(独立研究者) Kamil Deja(独立研究者)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10510 2025-05-23 cs.LG 82%

SmoothCache: A Universal Inference Acceleration Technique for Diffusion Transformers

Joseph Liu, Joshua Geddes, Ziyu Guo, Haomiao Jiang, Mahesh Kumar Nandwana

机构 * Roblox(Roblox公司) Queen’s University(女王大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

Comments Code can be found at https://github.com/Roblox/SmoothCache. Accepted at CVPR eLVM workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15506 2025-05-21 cs.LG 82%

Learning to Discretize Denoising Diffusion ODEs

Vinh Tong, Hoang Trung-Dung, Anji Liu, Guy Van den Broeck, Mathias Niepert

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11853 2025-05-20 eess.IV cs.LG 82%

Measurement Score-Based Diffusion Model

Chicago Y. Park, Shirin Shoushtari, Hongyu An, Ulugbek S. Kamilov

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10950 2025-05-19 cs.LG 82%

Shackled Dancing: A Bit-Locked Diffusion Algorithm for Lossless and Controllable Image Steganography

Tianshuo Zhang, Gao Jia, Wenzhe Zhai, Rui Yann, Xianglei Xing

机构 * Harbin Engineering University(哈尔滨工程大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08803 2025-05-15 cs.LG cs.AI 82%

Multi-modal Synthetic Data Training and Model Collapse: Insights from VLMs and Diffusion Models

Zizhao Hu, Mohammad Rostami, Jesse Thomason

机构 * University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04639 2025-05-09 cs.CL cs.AI 82%

Language translation, and change of accent for speech-to-speech task using diffusion model

Abhishek Mishra, Ritesh Sur Chowdhury, Vartul Bahuguna, Isha Pandey, Ganesh Ramakrishnan

机构 * CMINDS, IIT Bombay(CMINDS,IIT博亚学院) CSE, IIT Bombay(计算机科学与工程系,IIT博亚学院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03314 2025-05-07 cs.SD cs.AI eess.AS 82%

Mamba-Diffusion Model with Learnable Wavelet for Controllable Symbolic Music Generation

Jincheng Zhang, György Fazekas, Charalampos Saitis

机构 * Centre for Digital Music Queen Mary University of London(数字音乐中心 威廉玛丽大学伦敦分校)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20625 2025-04-30 cs.SD cs.AI eess.AS 82%

DiffusionRIR: Room Impulse Response Interpolation using Diffusion Models

Sagi Della Torre, Mirco Pezzoli, Fabio Antonacci, Sharon Gannot

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17323 2025-04-25 eess.SP 82%

CKMDiff: A Generative Diffusion Model for CKM Construction via Inverse Problems with Learned Priors

Shen Fu, Yong Zeng, Zijian Wu, Di Wu, Shi Jin, Cheng-Xiang Wang, Xiqi Gao

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17308 2025-04-25 physics.geo-ph 82%

Physics-based super-resolved simulation of 3D elastic wave propagation adopting scalable Diffusion Transformer

Hugo Gabrielidis, Filippo Gatti, Stéphane Vialle

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

Comments Submitted at CMAME

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11094 2025-04-24 cs.NI 82%

Reinforcement Learning With LLMs Interaction For Distributed Diffusion Model Services

Hongyang Du, Ruichen Zhang, Dusit Niyato, Jiawen Kang, Zehui Xiong, Shuguang Cui, Xuemin Shen, Dong In Kim

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏