arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69989 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69989 篇

2505.17955 2025-11-04 cs.CV 83%

Diffusion Classifiers Understand Compositionality, but Conditions Apply

Yujin Jeong, Arnas Uselis, Seong Joon Oh, Anna Rohrbach

机构 * TU Darmstadt(图恩大学) University of Tübingen(图宾根大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments NeurIPS 2025 Datasets and Benchmarks

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12245 2025-11-04 cs.CV 83%

Scalable Autoregressive Image Generation with Mamba

Haopeng Li, Jinyue Yang, Kexin Wang, Xuerui Qiu, Yuhong Chou, Xin Li, Guoqi Li

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04687 2025-11-04 cs.CV cs.AI 83%

Targeted Attack Improves Protection against Unauthorized Diffusion Customization

Boyang Zheng, Chumeng Liang, Xiaoyu Wu

机构 * Shanghai Jiao Tong University(上海交通大学) University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments ICLR 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12935 2025-11-04 cs.LG cs.AI cs.CV 83%

ERA-Solver: Error-Robust Adams Solver for Fast Sampling of Diffusion Probabilistic Models

Shengming Li, Luping Liu, Runnan Li, Xu Tan

机构 * Zhejiang University(浙江大学) Microsoft Azure Speech(微软Azure语音) Microsoft Research Asia(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00011 2025-11-04 cs.CV cs.AI cs.HC 83%

Generative human motion mimicking through feature extraction in denoising diffusion settings

Alexander Okupnik, Johannes Schneider, Kyriakos Flouris

机构 * University of Liechtenstein(列支敦士登大学) University of Cambridge(剑桥大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26391 2025-10-31 cs.CV 83%

EEG-Driven Image Reconstruction with Saliency-Guided Diffusion Models

Igor Abramov, Ilya Makarov

机构 * Ivannikov Institute for System Programming of the Russian Academy of Sciences(俄罗斯科学院伊万诺夫系统编程研究所) Research Center for Trusted Artificial Intelligence(可信人工智能研究中心) AI Talent Hub, ITMO University(ITMO大学人工智能人才中心) Moscow, Russia(俄罗斯莫斯科)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Demo paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24805 2025-10-30 q-bio.QM cs.AI cs.CV 83%

CT-Less Attenuation Correction Using Multiview Ensemble Conditional Diffusion Model on High-Resolution Uncorrected PET Images

Alexandre St-Georges, Gabriel Richard, Maxime Toussaint, Christian Thibaudeau, Etienne Auger, Étienne Croteau, Stephen Cunnane, Roger Lecomte, Jean-Baptiste Michaud

机构 * Department of Medical Imaging and Radiation Sciences(医学影像与放射科学系) Université de Sherbrooke(Sherbrooke大学) Sherbrooke Molecular Imaging Center(Sherbrooke分子影像中心) CRCHUS Nantes Université(Nantes大学) Laboratoire CRCI2NA, INSERM, CNRS(CRCI2NA实验室,INSERM,CNRS) Imaging Research and Technology (IR&T) Inc.(影像研究与技术公司) Research Center on Aging, Department of Medicine(衰老研究中心,医学系) Department of Electrical Engineering and Computer Engineering(电气工程与计算机工程系)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments This is a preprint and not the final version of this paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22366 2025-10-28 cs.CV cs.AI 83%

T2SMark: Balancing Robustness and Diversity in Noise-as-Watermark for Diffusion Models

Jindong Yang, Han Fang, Weiming Zhang, Nenghai Yu, Kejiang Chen

机构 * University of Science and Technology of China(中国科学技术大学) Anhui Province Key Laboratory of Digital Security(安徽省数字安全重点实验室) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17131 2025-10-28 cs.CV cs.AI 83%

GOOD: Training-Free Guided Diffusion Sampling for Out-of-Distribution Detection

Xin Gao, Jiyao Liu, Guanghao Li, Yueming Lyu, Jianxiong Gao, Weichen Yu, Ningsheng Xu, Liang Wang, Caifeng Shan, Ziwei Liu, Chenyang Si

机构 * Nanjing University(南京大学) Fudan University(复旦大学) Carnegie Mellon University(卡内基梅隆大学) Chinese Academy of Sciences(中国科学院) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 28 pages, 16 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09998 2025-10-27 cs.LG cs.CV 83%

Adaptive Non-uniform Timestep Sampling for Accelerating Diffusion Model Training

Myunsoo Kim, Donghyeon Ki, Seong-Woong Shim, Byung-Jun Lee

机构 * Korea University(韩国大学) Gauss Labs Inc.(Gauss实验室公司)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09984 2025-10-23 cs.CV 83%

Latent Diffusion Models with Masked AutoEncoders

Junho Lee, Jeongwoo Shin, Hyungwook Choi, Joonseok Lee

机构 * Seoul National University(首尔国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01872 2025-10-23 cs.LG cs.AI cs.CV 83%

FairGen: Controlling Sensitive Attributes for Fair Generations in Diffusion Models via Adaptive Latent Guidance

Mintong Kang, Vinayshekhar Bannihatti Kumar, Shamik Roy, Abhishek Kumar, Sopan Khosla, Balakrishnan Murali Narayanaswamy, Rashmi Gangadharaiah

机构 * UIUC(伊利诺伊大学) AWS AI Labs(亚马逊AI实验室)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments EMNLP 2025 Main Conference (Camera Ready)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18353 2025-10-22 cs.CV 83%

Ranking-based Preference Optimization for Diffusion Models from Implicit User Feedback

Yi-Lun Wu, Bo-Kai Ruan, Chiang Tseng, Hong-Han Shuai

机构 * Institute of Electrical and Computer Engineering, National Yang Ming Chiao Tung University(电子工程学院,阳明交通大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05148 2025-10-21 eess.IV cs.CV 83%

SV-DRR: High-Fidelity Novel View X-Ray Synthesis Using Diffusion Model

Chun Xie, Yuichi Yoshii, Itaru Kitahara

机构 * Center for Computational Sciences, University of Tsukuba(茨口大学计算科学中心) Tokyo Medical University Ibaraki Medical Center(东京医科大学.ibaraki医疗中心)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by MICCAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00745 2025-10-21 eess.IV cs.CV 83%

Geodesic Diffusion Models for Efficient Medical Image Enhancement

Teng Zhang, Hongxu Jiang, Kuang Gong, Wei Shao

机构 * Department of Electrical and Computer Engineering, University of Florida(电气与计算机工程系,佛罗里达大学) Department of Biomedical Engineering, University of Florida(生物医学工程系,佛罗里达大学) Department of Medicine, University of Florida(医学系,佛罗里达大学) Intelligent Clinical Care Center, University of Florida(智能临床护理中心,佛罗里达大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13253 2025-10-20 cs.CV cs.AI cs.LG 83%

End-to-End Multi-Modal Diffusion Mamba

Chunhao Lu, Qiang Lu, Meichen Dong, Jake Luo

机构 * China University of Petroleum-Beijing(中国石油大学(北京)) Leyard Optoelectronic(莱亚德光电) University of Wisconsin-Milwaukee(威斯康星大学密尔沃基分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18033 2025-10-17 cs.CV 83%

OmnimatteZero: Fast Training-free Omnimatte with Pre-trained Video Diffusion Models

Dvir Samuel, Matan Levy, Nir Darshan, Gal Chechik, Rami Ben-Ari

机构 * Bar-Ilan University \& OriginAI Israel The Hebrew University of Jerusalem Israel Bar-Ilan University \& NVIDIA Research Israel Bar-Ilan University \& OriginAI The Hebrew University of Jerusalem Bar-Ilan University \& NVIDIA Research

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to SIGGRAPH ASIA 2025. Project Page: https://dvirsamuel.github.io/omnimattezero.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11690 2025-10-14 cs.CV cs.LG 83%

Diffusion Transformers with Representation Autoencoders

Boyang Zheng, Nanye Ma, Shengbang Tong, Saining Xie

机构 * New York University(纽约大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Technical Report; Project Page: https://rae-dit.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10918 2025-10-14 cs.CV cs.AI cs.LG 83%

DreamMakeup: Face Makeup Customization using Latent Diffusion Models

Geon Yeong Park, Inhwa Han, Serin Yang, Yeobin Hong, Seongmin Jeong, Heechan Jeon, Myeongjin Goh, Sung Won Yi, Jin Nam, Jong Chul Ye

机构 * KAIST(韩国科学技术院) Amorepacific(阿摩尔太平洋)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07392 2025-10-14 cs.CV 83%

ID-Booth: Identity-consistent Face Generation with Diffusion Models

Darian Tomašević, Fadi Boutros, Chenhao Lin, Naser Damer, Vitomir Štruc, Peter Peer

机构 * University of Ljubljana, Faculty of Computer and Information Science(卢布尔雅纳大学计算机与信息科学学院) Fraunhofer Institute for Computer Graphics Research IGD(弗劳恩霍夫计算机图形研究机构) Xi’an Jiaotong University, School of Cyber Science and Engineering(西安交通大学网络科学与工程学院) Department of Computer Science, TU Darmstadt(图腾大学计算机科学系) University of Ljubljana, Faculty of Electrical Engineering(卢布尔雅纳大学电子工程学院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments IEEE International Conference on Automatic Face and Gesture Recognition (FG) 2025, 14 pages

Journal ref IEEE International Conference on Automatic Face and Gesture Recognition (FG), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08632 2025-10-14 cs.CV 83%

RoboSwap: A GAN-driven Video Diffusion Framework For Unsupervised Robot Arm Swapping

Yang Bai, Liudi Yang, George Eskandar, Fengyi Shen, Dong Chen, Mohammad Altillawi, Ziyuan Liu, Gitta Kutyniok

机构 * Ludwig-Maximilians-Universität München (LMU Munich)(慕尼黑路德维希-马克西米利安大学) Huawei Heisenberg Research Center(华为海森堡研究中心) Technische Universität München (TUM)(慕尼黑技术大学) Albert-Ludwigs-Universität Freiburg(弗赖堡阿尔伯特-路易斯-大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12677 2025-10-14 cs.CV 83%

CURE: Concept Unlearning via Orthogonal Representation Editing in Diffusion Models

Shristi Das Biswas, Arani Roy, Kaushik Roy

机构 * Purdue University(普渡大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01428 2025-10-13 cs.CV eess.IV 83%

DiffMark: Diffusion-based Robust Watermark Against Deepfakes

Chen Sun, Haiyang Sun, Zhiqing Guo, Yunfeng Diao, Liejun Wang, Dan Ma, Gaobo Yang, Keqin Li

机构 * College of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Silk Road Multilingual Cognitive Computing International Cooperation Joint Laboratory(丝绸之路多语种认知计算国际合作联合实验室) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院) Department of Computer Science, State University of New York(纽约州立大学计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17157 2025-10-10 cs.CV 83%

DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks

Canyu Zhao, Yanlong Sun, Mingyu Liu, Huanyi Zheng, Muzhi Zhu, Zhiyue Zhao, Hao Chen, Tong He, Chunhua Shen

机构 * Zhejiang University(浙江大学) Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) Zhejiang University of Technology(浙江工业大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Homepage: https://aim-uofa.github.io/Diception, Code and Model: https://github.com/aim-uofa/Diception

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16679 2025-10-09 cs.CV 83%

Polyp-Gen: Realistic and Diverse Polyp Image Generation for Endoscopic Dataset Expansion

Shengyuan Liu, Zhen Chen, Qiushi Yang, Weihao Yu, Di Dong, Jiancong Hu, Yixuan Yuan

机构 * Department of Electronic Engineering, Chinese University of Hong Kong(香港中文大学电子工程系) Centre for Artificial Intelligence and Robotics (CAIR), Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences(香港科学院人工智能与机器人中心) Department of Electrical Engineering, The City University of Hong Kong(香港城市大学电子工程系) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) The Sixth Affiliated Hospital, Sun Yat-sen University(中山大学第六附属医院)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12024 2025-10-08 cs.CV 83%

Robust Concept Erasure in Diffusion Models: A Theoretical Perspective on Security and Robustness

Zixuan Fu, Yan Ren, Finn Carter, Chenyue Wen, Le Ku, Daheng Yu, Emily Davis, Bo Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments updated version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04668 2025-10-07 cs.CV 83%

ConceptSplit: Decoupled Multi-Concept Personalization of Diffusion Models via Token-wise Adaptation and Attention Disentanglement

Habin Lim, Yeongseob Won, Juwon Seo, Gyeong-Moon Park

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 14 pages, 13 figures, to be published in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03089 2025-10-06 cs.CV 83%

Latent Diffusion Unlearning: Protecting Against Unauthorized Personalization Through Trajectory Shifted Perturbations

Naresh Kumar Devulapally, Shruti Agarwal, Tejas Gokhale, Vishnu Suresh Lokhande

机构 * University at Buffalo, The State University of New York(布法罗大学) Adobe Research(Adobe研究) University of Maryland, Baltimore County(马里兰大学巴尔的摩分校)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01967 2025-10-03 cs.CR cs.AI cs.CV 83%

ZK-WAGON: Imperceptible Watermark for Image Generation Models using ZK-SNARKs

Aadarsh Anantha Ramakrishnan, Shubham Agarwal, Selvanayagam S, Kunwar Singh

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at AI-ML Systems 2025, Bangalore, India, https://www.aimlsystems.org/2025/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26644 2025-10-01 cs.CV cs.AI cs.LG 83%

Stitch: Training-Free Position Control in Multimodal Diffusion Transformers

Jessica Bader, Mateusz Pach, Maria A. Bravo, Serge Belongie, Zeynep Akata

机构 * Technical University of Munich(慕尼黑技术大学) Helmholtz Munich(海德堡-慕尼黑研究所) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Copenhagen(哥本哈根大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏