arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69989 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69989 篇

2509.26436 2025-10-01 cs.CV 83%

Post-Training Quantization via Residual Truncation and Zero Suppression for Diffusion Models

Donghoon Kim, Dongyoung Lee, Ik Joon Chang, Sung-Ho Bae

机构 * Department of Artificial Intelligence(人工智能系) Kyung Hee University(庆尚大学) Department of Electrical Engineering(电气工程系) Department of Computer Science(计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25705 2025-10-01 cs.CV 83%

How Diffusion Models Memorize

Juyeop Kim, Songkuk Kim, Jong-Seok Lee

机构 * Yonsei University(延世大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13915 2025-10-01 cs.CV 83%

Binary Diffusion Probabilistic Model

Vitaliy Kinakh, Slava Voloshynovskiy

机构 * Department of Computer Science University of Geneva(计算机科学系日内瓦大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24128 2025-09-30 cs.CV 83%

GANji: A Framework for Introductory AI Image Generation

Chandon Hamel, Mike Busch

机构 * Anderson College of Business and Computing(安德森商学院与计算学院) Regis University(雷吉大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07936 2025-09-30 cs.CV eess.IV 83%

Feature Space Analysis by Guided Diffusion Model

Kimiaki Shirahama, Miki Yanobu, Kaduki Yamashita, Miho Ohsaki

机构 * Department of Information Systems Design, Doshisha University(信息系统设计系,多智大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 37 pages, 13 figures, codes: https://github.com/KimiakiShirahama/FeatureSpaceAnalysisByGuidedDiffusionModel

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17324 2025-09-30 cs.LG cs.CV 83%

Origins of Creativity in Attention-Based Diffusion Models

Emma Finn, T. Anderson Keller, Manos Theodosis, Demba E. Ba

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22376 2025-09-30 cs.LG cs.AI cs.CL cs.CV 83%

Rare-to-Frequent: Unlocking Compositional Generation Power of Diffusion Models on Rare Concepts with LLM Guidance

Dongmin Park, Sebin Kim, Taehong Moon, Minkyu Kim, Kangwook Lee, Jaewoong Cho

机构 * KRAFTON Seoul National University(首尔国立大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments ICLR 2025 (spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23605 2025-09-30 cs.CV 83%

VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis

Zeren Xiong, Yue Yu, Zedong Zhang, Shuo Chen, Jian Yang, Jun Li

机构 * Nanjing University of Science and Technology(南京理工大学) Nanjing University(南京大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01467 2025-09-30 cs.CV 83%

Representation Entanglement for Generation: Training Diffusion Transformers Is Much Easier Than You Think

Ge Wu, Shen Zhang, Ruijing Shi, Shanghua Gao, Zhenyuan Chen, Lei Wang, Zhaowei Chen, Hongcheng Gao, Yao Tang, Jian Yang, Ming-Ming Cheng, Xiang Li

机构 * NKIARI, Shenzhen Futian(NKIARI,深圳福田) VCIP, CS, Nankai University(VCIP,计算机科学,南开大学) JIIOV Technology(JIIOV技术) Harvard University(哈佛大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22300 2025-09-29 cs.CV cs.AI cs.LG 83%

HiGS: History-Guided Sampling for Plug-and-Play Enhancement of Diffusion Models

Seyedmorteza Sadat, Farnood Salehi, Romann M. Weber

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05827 2025-09-29 cs.CV 83%

Self-Guidance: Boosting Flow and Diffusion Generation on Their Own

Tiancheng Li, Weijian Luo, Zhiyang Chen, Liyuan Ma, Guo-Jun Qi

机构 * Zhejiang University(浙江大学) MAPLE Lab, Westlake University(西湖大学MAPLE实验室) Peking University(北京大学) Institute of Advanced Technology, Westlake Institute for Advanced Study(西湖研究院先进技术研究所)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13674 2025-09-29 cs.CV cs.AI 83%

Diffusion Curriculum: Synthetic-to-Real Data Curriculum via Image-Guided Diffusion

Yijun Liang, Shweta Bhardwaj, Tianyi Zhou

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted in ICCV2025. 22 pages, including references and appendix. Code is available at http://github.com/tianyi-lab/DisCL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08074 2025-09-29 cs.LG cs.CR cs.CV 83%

Unstable Unlearning: The Hidden Risk of Concept Resurgence in Diffusion Models

Vinith M. Suriyakumar, Rohan Alur, Ayush Sekhari, Manish Raghavan, Ashia C. Wilson

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 30 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16968 2025-09-24 cs.CV 83%

Penalizing Boundary Activation for Object Completeness in Diffusion Models

Haoyang Xu, Tianhao Zhao, Sibei Yang, Yutian Lin

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03485 2025-09-24 cs.CV 83%

LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation

Lianwei Yang, Haokun Lin, Tianchen Zhao, Yichen Wu, Hongyu Zhu, Ruiqi Xie, Zhenan Sun, Yu Wang, Qingyi Gu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16131 2025-09-23 cs.LG cs.CV 83%

Dynamic Classifier-Free Diffusion Guidance via Online Feedback

Pinelopi Papalampidi, Olivia Wiles, Ira Ktena, Aleksandar Shtedritski, Emanuele Bugliarello, Ivana Kajic, Isabela Albuquerque, Aida Nematzadeh

机构 * Google DeepMind(谷歌DeepMind) Ellison Institute of Technology(埃利森技术研究所) University of Oxford(牛津大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02363 2025-09-23 cs.CV 83%

Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods

Marian Lupascu, Mihai-Sorin Stupariu

机构 * Department of Computer Science, University of Bucharest(计算机科学系,布加勒斯特大学)

专题命中 扩散模型 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 27 pages, 26 figures, WACV conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12974 2025-09-23 cs.CV 83%

Attentive Eraser: Unleashing Diffusion Model's Object Removal Potential via Self-Attention Redirection Guidance

Wenhao Sun, Benlei Cui, Xue-Mei Dong, Jingqun Tang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2025(Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15678 2025-09-22 cs.CV 83%

Layout Stroke Imitation: A Layout Guided Handwriting Stroke Generation for Style Imitation with Diffusion Model

Sidra Hanif, Longin Jan Latecki

机构 * Temple University, Philadelphia PA, USA(特拉华大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14780 2025-09-19 cs.CV 83%

Radiology Report Conditional 3D CT Generation with Multi Encoder Latent diffusion Model

Sina Amirrajab, Zohaib Salahuddin, Sheng Kuang, Henry C. Woodruff, Philippe Lambin

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21448 2025-09-19 cs.CV 83%

OmniSync: Towards Universal Lip Synchronization via Diffusion Transformers

Ziqiao Peng, Jiwen Liu, Haoxian Zhang, Xiaoqiang Liu, Songlin Tang, Pengfei Wan, Di Zhang, Hongyan Liu, Jun He

机构 * Renmin University of China(中国人民大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted as NeurIPS 2025 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13034 2025-09-18 q-bio.NC cs.CV 83%

Synthesis and Perceptual Scaling of High Resolution Naturalistic Images Using Stable Diffusion

Leonardo Pettini, Carsten Bogler, Christian Doeller, John-Dylan Haynes

机构 * Department of Psychology, Humboldt-Universität zu Berlin(柏林洪堡大学心理学系) Bernstein Center for Computational Neuroscience Berlin and Berlin Center for Advanced Neuroimaging, Charité Universitätsmedizin Berlin(柏林伯恩斯坦计算神经科学中心和柏林先进神经成像中心,查理医学院) Max Planck Institute for Human Cognitive and Brain Sciences, Leipzig, Germany(马克斯·普朗克人类认知与脑科学研究所,莱比锡,德国) Max Planck School of Cognition, Leipzig, Germany(马克斯·普朗克认知学校,莱比锡,德国) Kavli Institute for Systems Neuroscience, Centre for Neural Computation, The Egil and Pauline Braathen and Fred Kavli Centre for Cortical Microcircuits, Jebsen Centre for Alzheimer’s Disease, Norwegian University of Science and Technology, Trondheim, Norway(凯斯琳系统神经科学研究所,神经计算中心,埃吉和保罗·布雷athen及弗雷德·卡维利微电路中心,朱贝森阿尔茨海默病中心,挪威科学与技术大学,特罗姆瑟,挪威) Clinic of Neurology, Charité-Universitätsmedizin Berlin, Berlin, Germany(柏林查理医学院神经科诊所) Berlin Center for Advanced Neuroimaging, Charité-Universitätsmedizin Berlin, Berlin, Germany(柏林先进神经成像中心,查理医学院) Research Cluster of Excellence “Science of Intelligence”, Technische(卓越研究集群“智能科学”,技术)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 80 pages, 26 Figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13936 2025-09-18 cs.CV 83%

Noise-Level Diffusion Guidance: Well Begun is Half Done

Harvey Mannering, Zhiwu Huang, Adam Prugel-Bennett

机构 * Vision, Learning, and Control (VLC) Research Group(视觉、学习与控制研究组)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13336 2025-09-17 cs.CV eess.IV 83%

Gradient-Free Adversarial Purification with Diffusion Models

Xuelong Dai, Dong Wang, Xiuzhen Cheng, Bin Xiao

机构 * School of Artificial Intelligence, Shandong University(人工智能学院,山东大学) Department of Computing, The Hong Kong Polytechnic University(计算机学院,香港理工大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04719 2025-09-16 cs.DC cs.CV 83%

STADI: Fine-Grained Step-Patch Diffusion Parallelism for Heterogeneous GPUs

Han Liang, Jiahui Zhou, Zicheng Zhou, Xiaoxi Zhang, Xu Chen

机构 * Sun Yat-sen University(中山大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19808 2025-09-16 cs.CV 83%

SeeDiff: Off-the-Shelf Seeded Mask Generation from Diffusion Models

Joon Hyun Park, Kumju Jo, Sungyong Baik

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13389 2025-09-16 cs.CV cs.LG 83%

Marigold-DC: Zero-Shot Monocular Depth Completion with Guided Diffusion

Massimiliano Viola, Kevin Qu, Nando Metzger, Bingxin Ke, Alexander Becker, Konrad Schindler, Anton Obukhov

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07890 2025-09-15 cs.CV 83%

Can Generative Geospatial Diffusion Models Excel as Discriminative Geospatial Foundation Models?

Yuru Jia, Valerio Marsocci, Ziyang Gong, Xue Yang, Maarten Vergauwen, Andrea Nascetti

机构 * KU Leuven(鲁汶大学) KTH(皇家理工学院) European Space Agency(欧洲航天局) Shanghai AI Lab(上海人工智能实验室) SJTU(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments ICCV 2025, camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21471 2025-09-15 cs.CV cs.AI 83%

AdvI2I: Adversarial Image Attack on Image-to-Image Diffusion models

Yaopei Zeng, Yuanpu Cao, Bochuan Cao, Yurui Chang, Jinghui Chen, Lu Lin

机构 * College of Information Sciences and Technology, Pennsylvania State University, State College PA, USA(信息科学与技术学院,宾夕法尼亚州立大学,州立学院PA,美国)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09054 2025-09-12 cs.CV 83%

Integrating Anatomical Priors into a Causal Diffusion Model

Binxu Li, Wei Peng, Mingjie Li, Ehsan Adeli, Kilian M. Pohl

机构 * Department of Electrical Engineering, Stanford University, Stanford, CA, USA(电气工程系,斯坦福大学) Department of Psychiatry and Behavioral Sciences, Stanford University, Stanford, CA, USA(精神病学与行为科学系,斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏