arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69989 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69989 篇

2502.20126 2025-02-28 cs.LG cs.CV 83%

FlexiDiT: Your Diffusion Transformer Can Easily Generate High-Quality Samples with Less Compute

Sotiris Anagnostidis, Gregor Bachmann, Yeongmin Kim, Jonas Kohler, Markos Georgopoulos, Artsiom Sanakoyeu, Yuming Du, Albert Pumarola, Ali Thabet, Edgar Schönfeld

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02574 2025-02-28 cs.CV cs.AI stat.ML 83%

Solving Video Inverse Problems Using Image Diffusion Models

Taesung Kwon, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments ICLR 2025; 25 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11835 2025-02-27 cs.CV 83%

Aligned Datasets Improve Detection of Latent Diffusion-Generated Images

Anirudh Sundara Rajan, Utkarsh Ojha, Jedidiah Schloesser, Yong Jae Lee

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14195 2025-02-26 cs.CV 83%

VideoShield: Regulating Diffusion-based Video Generation Models via Watermarking

Runyi Hu, Jie Zhang, Yiming Li, Jiwei Li, Qing Guo, Han Qiu, Tianwei Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02929 2025-02-25 cs.CV cs.AI 83%

Panoptic Diffusion Models: co-generation of images and segmentation maps

Yinghan Long, Kaushik Roy

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17465 2025-02-24 cs.CV cs.AI 83%

LaRE$^2$: Latent Reconstruction Error Based Method for Diffusion-Generated Image Detection

Yunpeng Luo, Junlong Du, Ke Yan, Shouhong Ding

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2024. Code is available at https://github.com/luo3300612/LaRE

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06527 2025-02-21 cs.CV 83%

CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers

D. She, Mushui Liu, Jingxuan Pang, Jin Wang, Zhen Yang, Wanggui He, Guanghao Zhang, Yi Wang, Qihan Huang, Haobin Tang, Yunlong Yu, Siming Fu

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Section 4 in CustomVideoX Entity Region-Aware Enhancement has description errors. The compared methods data of Table I lacks other metrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18974 2025-02-21 cs.CV cs.AI 83%

3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation

Hansheng Chen, Bokui Shen, Yulin Liu, Ruoxi Shi, Linqi Zhou, Connor Z. Lin, Jiayuan Gu, Hao Su, Gordon Wetzstein, Leonidas Guibas

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://lakonik.github.io/3d-adapter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08822 2025-02-21 cs.CV 83%

PFDiff: Training-Free Acceleration of Diffusion Models Combining Past and Future Scores

Guangyi Wang, Yuren Cai, Lijiang Li, Wei Peng, Songzhi Su

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12742 2025-02-19 cs.CV 83%

3D Shape-to-Image Brownian Bridge Diffusion for Brain MRI Synthesis from Cortical Surfaces

Fabian Bongratz, Yitong Li, Sama Elbaroudy, Christian Wachinger

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by Information Processing in Medical Imaging (IPMI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06355 2025-02-18 cs.CV 83%

DiffQRCoder: Diffusion-based Aesthetic QR Code Generation with Scanning Robustness Guided Iterative Refinement

Jia-Wei Liao, Winston Wang, Tzu-Sian Wang, Li-Xuan Peng, Ju-Hsuan Weng, Cheng-Fu Chou, Jun-Cheng Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09963 2025-02-17 cs.CV 83%

Generating on Generated: An Approach Towards Self-Evolving Diffusion Models

Xulu Zhang, Xiaoyong Wei, Jinlin Wu, Jiaxin Wu, Zhaoxiang Zhang, Zhen Lei, Qing Li

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09434 2025-02-14 cs.CV 83%

Redistribute Ensemble Training for Mitigating Memorization in Diffusion Models

Xiaoliu Guan, Yu Wu, Huayang Huang, Xiao Liu, Jiaxu Miao, Yi Yang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages,9 figures. arXiv admin note: substantial text overlap with arXiv:2407.15328

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08754 2025-02-14 cs.CV cs.AI 83%

HistoSmith: Single-Stage Histology Image-Label Generation via Conditional Latent Diffusion for Enhanced Cell Segmentation and Classification

Valentina Vadori, Jean-Marie Graïc, Antonella Peruffo, Livio Finos, Ujwala Kiran Chaudhari, Enrico Grisan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15650 2025-02-13 cs.CV 83%

ImPoster: Text and Frequency Guidance for Subject Driven Action Personalization using Diffusion Models

Divya Kothandaraman, Kuldeep Kulkarni, Sumit Shekhar, Balaji Vasan Srinivasan, Dinesh Manocha

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Journal ref COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07751 2025-02-12 cs.CV q-bio.GN 83%

CausalGeD: Blending Causality and Diffusion for Spatial Gene Expression Generation

Rabeya Tus Sadia, Md Atik Ahamed, Qiang Cheng

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08502 2025-02-12 cs.CV 83%

Efficient Image-to-Image Diffusion Classifier for Adversarial Robustness

Hefei Mei, Minjing Dong, Chang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19458 2025-02-12 cs.CV cs.AI 83%

MemControl: Mitigating Memorization in Diffusion Models via Automated Parameter Selection

Raman Dutt, Ondrej Bohdal, Pedro Sanchez, Sotirios A. Tsaftaris, Timothy Hospedales

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted into WACV 2025 (Applications Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05710 2025-02-11 cs.CV 83%

SSDD-GAN: Single-Step Denoising Diffusion GAN for Cochlear Implant Surgical Scene Completion

Yike Zhang, Eduardo Davalos, Jack Noble

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05391 2025-02-11 cs.CV 83%

Beyond and Free from Diffusion: Invertible Guided Consistency Training

Chia-Hong Hsu, Shiu-hong Kao, Randall Balestriero

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02771 2025-02-06 physics.med-ph cs.CV cs.LG eess.IV stat.AP 83%

When are Diffusion Priors Helpful in Sparse Reconstruction? A Study with Sparse-view CT

Matt Y. Cheung, Sophia Zorek, Tucker J. Netherton, Laurence E. Court, Sadeer Al-Kindi, Ashok Veeraraghavan, Guha Balakrishnan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at IEEE ISBI 2025, 5 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01572 2025-02-06 cs.CV 83%

MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation

Yiren Song, Cheng Liu, Mike Zheng Shou

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01705 2025-02-03 cs.CV cs.AI 83%

Long Tail Image Generation Through Feature Space Augmentation and Iterated Learning

Rafael Elberg, Denis Parra, Mircea Petrache

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15440 2025-02-03 cs.CV 83%

Dfilled: Repurposing Edge-Enhancing Diffusion for Guided DSM Void Filling

Daniel Panangian, Ksenia Bittner

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to IEEE/CVF Winter Conference on Applications of Computer Vision Workshops (WACVW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18593 2025-01-31 cs.CV cs.AI cs.LG 83%

Diffusion Autoencoders are Scalable Image Tokenizers

Yinbo Chen, Rohit Girdhar, Xiaolong Wang, Sai Saketh Rambhatla, Ishan Misra

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://yinboc.github.io/dito/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16330 2025-01-28 cs.CV cs.AI 83%

RelightVid: Temporal-Consistent Diffusion Model for Video Relighting

Ye Fang, Zeyi Sun, Shangzhan Zhang, Tong Wu, Yinghao Xu, Pan Zhang, Jiaqi Wang, Gordon Wetzstein, Dahua Lin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16488 2025-01-24 eess.IV cs.CV cs.LG q-bio.OT 83%

Diffusion Models to Enhance the Resolution of Microscopy Images: A Tutorial

Harshith Bachimanchi, Giovanni Volpe

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 45 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14477 2025-01-22 cs.LG cs.CV 83%

LiteVAE: Lightweight and Efficient Variational Autoencoders for Latent Diffusion Models

Seyedmorteza Sadat, Jakob Buhmann, Derek Bradley, Otmar Hilliges, Romann M. Weber

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Published as a conference paper at NeurIPS 2024

Journal ref The Thirty-Eighth Annual Conference on Neural Information Processing Systems (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11211 2025-01-22 cs.AR cs.CV cs.LG 83%

Ditto: Accelerating Diffusion Model via Temporal Value Similarity

Sungbin Kim, Hyunwuk Lee, Wonho Cho, Mincheol Park, Won Woo Ro

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted for publication at the 2025 IEEE International Symposium on High-Performance Computer Architecture (HPCA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09732 2025-01-17 cs.CV 83%

Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps

Nanye Ma, Shangyuan Tong, Haolin Jia, Hexiang Hu, Yu-Chuan Su, Mingda Zhang, Xuan Yang, Yandong Li, Tommi Jaakkola, Xuhui Jia, Saining Xie

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏