arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69868 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69868 篇

2502.19700 2025-12-30 cs.CV 88%

Language-Informed Hyperspectral Image Synthesis for Imbalanced-Small Sample Classification via Semi-Supervised Conditional Diffusion Model

基于语言引导的高光谱图像合成用于不平衡小样本分类的半监督条件扩散模型

Yimin Zhu, Lincoln Linlin Xu

机构 * Department of Geomatics Engineering, University of Calgary(测绘工程系,卡尔加里大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

AI总结 本文提出 Txt2HSI-LDM(VAE) 模型,通过语言引导的扩散模型生成高光谱图像样本,解决 HSIC 中的 ISSD 问题,优于传统模型和半监督方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21865 2025-12-29 cs.CV 88%

EasyOmnimatte: Taming Pretrained Inpainting Diffusion Models for End-to-End Video Layered Decomposition

EasyOmnimatte:驯服预训练的修复扩散模型以实现端到端的视频分层分解

Yihan Hu, Xuelin Chen, Xiaodong Cun

机构 * GVC Lab, Great Bay University(大西洋湾大学GVC实验室) Adobe Research(Adobe研究院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 EasyOmnimatte通过双专家策略实现端到端视频分层分解,利用Effect Expert和Quality Expert提升分解质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06055 2025-12-09 cs.CV 88%

RepLDM: Reprogramming Pretrained Latent Diffusion Models for High-Quality, High-Efficiency, High-Resolution Image Generation

RepLDM: 重编程预训练的潜在扩散模型以实现高质量、高效、高分辨率图像生成

Boyuan Cao, Jiaxin Ye, Yujie Wei, Hongming Shan

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 RepLDM通过重编程预训练的潜在扩散模型,实现高质量、高效、高分辨率的图像生成,优于现有方法。

Comments NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05152 2025-12-08 cs.CV 88%

EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models

EFDiT:利用扩散变换器模型实现高效的细粒度图像生成

Kun Wang, Donglin Di, Tonghua Su, Lei Fan

机构 * Harbin Institute of Technology(哈尔滨工业大学) Chongqing Research Institute of HIT(重庆HIT研究所) Li Auto(利汽车) University of New South Wales(新南威尔士大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 EFDiT通过引入分层嵌入器和ProAttention机制,提升细粒度图像生成的语义信息融合和细节表现,优于现有微调方法。

Comments 6pages, 5figures, published to 2025 IEEE International Conference on Multimedia and Expo (ICME), Nantes, France, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13059 2025-12-02 eess.IV cs.CV 88%

3D MedDiffusion: A 3D Medical Latent Diffusion Model for Controllable and High-quality Medical Image Generation

3D MedDiffusion:一种用于可控和高质量医学图像生成的3D医学潜在扩散模型

Haoshen Wang, Zhentao Liu, Kaicong Sun, Xiaodong Wang, Dinggang Shen, Zhiming Cui

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 3D MedDiffusion通过高效补丁-体积自编码器和新型噪声估计器,实现可控且高质量的3D医学图像生成,适用于多种医学下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00557 2025-12-02 cs.CV cs.AI cs.LG 88%

Blind Inverse Problem Solving Made Easy by Text-to-Image Latent Diffusion

通过文本到图像潜在扩散模型简化盲逆问题求解

Michail Dontas, Yutong He, Naoki Murata, Yuki Mitsufuji, J. Zico Kolter, Ruslan Salakhutdinov

机构 * Carnegie Mellon University(卡内基梅隆大学) Sony AI(索尼人工智能) Sony Group Corporation(索尼集团) Bosch Center for AI(博世人工智能中心)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 LADiBI通过文本到图像潜在扩散模型无需训练解决多种盲逆问题,利用贝叶斯框架和新型后验采样算法实现灵活且高效的图像恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21215 2025-11-27 cs.CV cs.LG 88%

From Diffusion to One-Step Generation: A Comparative Study of Flow-Based Models with Application to Image Inpainting

从扩散到一步生成:基于流模型的比较研究及其在图像修复中的应用

Umang Agarwal, Rudraksh Sangore, Sumit Laddha

机构 * Department of Electrical Engineering IIT Bombay(电子工程系 印度理工学院 巴米扬)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文比较了三种生成模型在图像修复中的应用,展示了CFM和MeanFlow在生成质量和效率上的优势,特别是在单步生成和修复任务中的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10382 2025-11-27 cs.CV 88%

Towards Spatially Consistent Image Generation: On Incorporating Intrinsic Scene Properties into Diffusion Models

迈向空间一致的图像生成:将内在场景属性纳入扩散模型

Hyundo Lee, Suhyung Choi, Inwoo Hwang, Byoung-Tak Zhang

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种基于内在场景属性的图像生成方法,通过同时生成图像和其内在属性,提升生成图像的空间一致性和真实感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15092 2025-11-20 cs.CV 88%

Jointly Conditioned Diffusion Model for Multi-View Pose-Guided Person Image Synthesis

Chengyu Xie, Zhi Gong, Junchi Ren, Linkun Yu, Si Shen, Fei Shen, Xiaoyu Du

机构 * Nanjing University of Science and Technology, China(南京理工大学,中国) NExT++ Research Centre, National University of Singapore, Singapore(NExT++研究中心,新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08273 2025-10-28 cs.CV 88%

One Stone with Two Birds: A Null-Text-Null Frequency-Aware Diffusion Models for Text-Guided Image Inpainting

Haipeng Liu, Yang Wang, Meng Wang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 27 pages, 11 figures, to appear at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08625 2025-10-13 cs.CV 88%

Adjusting Initial Noise to Mitigate Memorization in Text-to-Image Diffusion Models

Hyeonggeun Han, Sehwan Kim, Hyungjun Joo, Sangwoo Hong, Jungwoo Lee

机构 * Seoul National University(首尔国立大学) CSE, Konkuk University(计算机科学与工程系,konkuk大学) Hodoo AI Labs(Hodoo AI实验室)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06995 2025-10-01 cs.CV 88%

KDC-Diff: A Latent-Aware Diffusion Model with Knowledge Retention for Memory-Efficient Image Generation

Md. Naimur Asif Borno, Md Sakib Hossain Shovon, Asmaa Soliman Al-Moisheer, Mohammad Ali Moni

机构 * The University of Queensland(昆士兰大学) Rajshahi University of Engineering & Technology(拉贾沙希工程与技术大学) Imam Mohammad Ibn Saud Islamic University (IMSIU)(伊玛姆穆罕默德·本·沙特伊斯兰大学) Charles Sturt University(查尔斯·斯特劳特大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(title);text-to-image(abstract);分类 cs.CV

Comments Currently Under Review at IEEE open journal for Computer Society

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24875 2025-09-30 cs.CV cs.LG 88%

Environment-Aware Satellite Image Generation with Diffusion Models

Nikos Kostagiolas, Pantelis Georgiades, Yannis Panagakis, Mihalis A. Nicolaou

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08567 2025-09-22 cs.CV 88%

Diffusion-Based Depth Inpainting for Transparent and Reflective Objects

Tianyu Sun, Dingchang Hu, Yixiang Dai, Guijin Wang

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11638 2025-09-16 cs.CV 88%

IS-Diff: Improving Diffusion-Based Inpainting with Better Initial Seed

Yongzhe Lyu, Yu Wu, Yutian Lin, Bo Du

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17784 2025-09-08 cs.CV 88%

HypDAE: Hyperbolic Diffusion Autoencoders for Hierarchical Few-shot Image Generation

Lingxiao Li, Kaixuan Fan, Boqing Gong, Xiangyu Yue

机构 * MMLab, The Chinese University of Hong Kong(香港中文大学) Boston University(波士顿大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025, Code is available at: https://github.com/lingxiao-li/HypDAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06119 2025-09-05 cs.CV cs.LG 88%

Hardware-Friendly Diffusion Models with Fixed-Size Reusable Structures for On-Device Image Generation

Sanchar Palit, Sathya Veera Reddy Dendi, Mallikarjuna Talluri, Raj Narayana Gadde

机构 * IIT Bombay(博伊斯姆理工大学) Samsung(三星)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments presented at IJCNN 2025 poster track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16217 2025-08-25 cs.CV 88%

PromptFlare: Prompt-Generalized Defense via Cross-Attention Decoy in Diffusion-Based Inpainting

Hohyun Na, Seunghoo Hong, Simon S. Woo

机构 * Sungkyunkwan University(成均馆大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15020 2025-08-22 cs.CV cs.AI 88%

TAIGen: Training-Free Adversarial Image Generation via Diffusion Models

Susim Roy, Anubhooti Jain, Mayank Vatsa, Richa Singh

机构 * University at Buffalo(布法罗大学) IIT Jodhpur(印度理工学院乔浦尔)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted at ICCVW-CV4BIOM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14802 2025-08-22 eess.IV cs.CV 88%

Fast-DDPM: Fast Denoising Diffusion Probabilistic Models for Medical Image-to-Image Generation

Hongxu Jiang, Muhammad Imran, Teng Zhang, Yuyin Zhou, Muxuan Liang, Kuang Gong, Wei Shao

机构 * University of Florida College of Medicine(佛罗里达大学医学院) University of Florida(佛罗里达大学) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02601 2025-08-20 cs.CV eess.IV 88%

Hyperspectral Image Generation with Unmixing Guided Diffusion Model

Shiyu Shen, Bin Pan, Ziye Zhang, Zhenwei Shi

机构 * School of Statistics and Data Science, KLMDASR, LEBPS, and LPMC, Nankai University(统计与数据科学学院,KLMDASR,LEBPS和LPMC,南开大学) Image Processing Center, School of Astronautics, Beihang University(图像处理中心,航天学院,北航大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12853 2025-08-19 cs.CV 88%

EraserDiT: Fast Video Inpainting with Diffusion Transformer Model

Jie Liu, Zheng Hui

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments technical report project page:https://jieliu95.github.io/EraserDiT_demo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07519 2025-08-12 cs.CV 88%

Exploring Multimodal Diffusion Transformers for Enhanced Prompt-based Image Editing

Joonghyuk Shin, Alchan Hwang, Yujin Kim, Daneul Kim, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments ICCV 2025. Project webpage: https://joonghyuk.com/exploring-mmdit-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03859 2025-08-07 cs.CV 88%

CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation

Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI(可信具身人工智能研究院) Fudan University(复旦大学) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心) Bytedance Intelligent Creation(字节跳动智能创作)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23058 2025-08-01 cs.CV cs.AI 88%

Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation

Alexandru Buburuzan

机构 * Department of Computer Science(计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments A dissertation submitted to The University of Manchester for the degree of Bachelor of Science in Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21690 2025-07-30 cs.CV cs.AI 88%

APT: Improving Diffusion Models for High Resolution Image Generation with Adaptive Path Tracing

Sangmin Han, Jinho Jeong, Jinwoo Kim, Seon Joo Kim

机构 * Yonsei University(延世大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21627 2025-07-30 cs.CV 88%

GuidPaint: Class-Guided Image Inpainting with Diffusion Models

Qimin Wang, Xinda Liu, Guohua Geng

机构 * Northwest University(西北大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01189 2025-07-29 eess.IV cs.AI cs.CV cs.IT eess.SP math.IT 88%

Compressed Image Generation with Denoising Diffusion Codebook Models

Guy Ohayon, Hila Manor, Tomer Michaeli, Michael Elad

机构 * Faculty of Computer Science, Technion -- Israel Institute of Technology, Haifa, Israel(计算机科学系,技术离子理工学院——以色列理工学院,海法,以色列) Faculty of Electrical and Computer Engineering, Technion -- Israel Institute of Technology, Haifa, Israel(电气与计算机工程系,技术离子理工学院——以色列理工学院,海法,以色列)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Published in the International Conference on Machine Learning (ICML) 2025. Code and demo are available at https://ddcm-2025.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18830 2025-07-28 eess.IV cs.CV cs.LG 88%

RealDeal: Enhancing Realism and Details in Brain Image Generation via Image-to-Image Diffusion Models

Shen Zhu, Yinzhu Jin, Tyler Spears, Ifrah Zawar, P. Thomas Fletcher

机构 * University of Virginia(弗吉尼亚大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17911 2025-07-25 eess.IV cs.CV 88%

Hierarchical Diffusion Framework for Pseudo-Healthy Brain MRI Inpainting with Enhanced 3D Consistency

Dou Hoon Kwark, Shirui Luo, Xiyue Zhu, Yudu Li, Zhi-Pei Liang, Volodymyr Kindratenko

机构 * The Grainger College of Engineering(格拉inger工程学院) National Center for Supercomputing Applications(国家超级计算应用中心) University of Illinois Urbana‑Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏