arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69868 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69868 篇

2312.03584 2025-07-24 cs.CV 88%

Context Diffusion: In-Context Aware Image Generation

Ivona Najdenkoska, Animesh Sinha, Abhimanyu Dubey, Dhruv Mahajan, Vignesh Ramanathan, Filip Radenovic

机构 * Meta GenAI(Meta 生成式人工智能) University of Amsterdam(阿姆斯特丹大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Journal ref European Conference on Computer Vision (ECCV) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16732 2025-07-23 cs.CV 88%

HarmonPaint: Harmonized Training-Free Diffusion Inpainting

Ying Li, Xinzhe Li, Yong Du, Yangyang Xu, Junyu Dong, Shengfeng He

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00377 2025-07-02 cs.CV 88%

MedDiff-FT: Data-Efficient Diffusion Model Fine-tuning with Structural Guidance for Controllable Medical Image Synthesis

Jianhao Xie, Ziang Zhang, Zhenyu Weng, Yuesheng Zhu, Guibo Luo

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Peking University Shenzhen Graduate School South China University of Technology, China

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

Comments 11 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23641 2025-07-01 cs.CV cs.AI 88%

VAP-Diffusion: Enriching Descriptions with MLLMs for Enhanced Medical Image Generation

Peng Huang, Junhu Fu, Bowen Guo, Zeju Li, Yuanyuan Wang, Yi Guo

机构 * College of Biomedical Engineering, Fudan University, Shanghai 200433, China(复旦大学生物医学工程学院) Key Laboratory of Medical Imaging Computing and Computer Assisted Intervention of Shanghai, Shanghai 200032, China(上海医学影像计算与计算机辅助干预重点实验室)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23482 2025-07-01 cs.CV 88%

MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting

Jun Huang, Ting Liu, Yihang Wu, Xiaochao Qu, Luoqi Liu, Xiaolin Hu

机构 * MT Lab, Meitu Inc(美图实验室,美图公司) National University of Singapore(新加坡国立大学) Department of Computer Science and Technology, BNRist, IDG/McGovern Institute for Brain Research, Tsinghua University(计算机科学与技术系,BNRist,IDG/McGovern脑科学研究院,清华大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23038 2025-07-01 cs.CV 88%

Inpainting is All You Need: A Diffusion-based Augmentation Method for Semi-supervised Medical Image Segmentation

Xinrong Hu, Yiyu Shi

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20452 2025-06-26 cs.CV cs.LG 88%

HiWave: Training-Free High-Resolution Image Generation via Wavelet-Based Diffusion Sampling

Tobias Vontobel, Seyedmorteza Sadat, Farnood Salehi, Romann M. Weber

机构 * ETH Zurich(苏黎世联邦理工学院) Disney Research|Studios(迪士尼研究与工作室)

专题命中 扩散模型 :diffusion(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09306 2025-06-25 cs.CV 88%

TD-Paint: Faster Diffusion Inpainting Through Time Aware Pixel Conditioning

Tsiry Mayet, Pourya Shamsolmoali, Simon Bernard, Eric Granger, Romain Hérault, Clement Chatelain

机构 * INSA Rouen Normandie, LITIS UR 4108(法国 Rouen 规划大学) University of York(约克大学) East China Normal University(华东师范大学) Université Rouen Normandie, LITIS UR 4108(法国 Rouen 规划大学) LIVIA, Dept. of Systems Engineering, ETS Montreal(蒙特利尔工程学院) Université Caen Normandie, CNRS, GREYC UMR6072(法国 Caen 规划大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13754 2025-06-18 cs.LG cs.AI cs.CV 88%

VideoPDE: Unified Generative PDE Solving via Video Inpainting Diffusion Models

Edward Li, Zichen Wang, Jiahe Huang, Jeong Joon Park

机构 * University of Michigan(密歇根大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments Project page: https://videopde.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07999 2025-06-10 cs.CV cs.LG 88%

MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation

Junhao Chen, Yulia Tsvetkov, Xiaochuang Han

机构 * Tsinghua University(清华大学) University of Washington(华盛顿大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02560 2025-06-04 cs.CV 88%

DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing

Zixiang Li, Haoyu Wang, Wei Wang, Chuangchuang Tan, Yunchao Wei, Yao Zhao

机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) Visual Intelligence +X International Cooperation Joint Laboratory of MOE(视觉智能+X国际合作联合实验室)

专题命中 扩散模型 :diffusion(title,abstract);image editing(title);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19365 2025-06-03 cs.CV cs.AI 88%

Conditional Image Synthesis with Diffusion Models: A Survey

Zheyuan Zhan, Defang Chen, Jian-Ping Mei, Zhenghe Zhao, Jiawei Chen, Chun Chen, Siwei Lyu, Can Wang

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University College of Computer Science, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学计算机科学学院,浙江大学) University at Buffalo, State University of New York(纽约州立大学布法罗分校) College of Computer Science, Zhejiang University of Technology(浙江工业大学计算机科学学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(区块链与数据安全国家重点实验室,浙江大学杭州高科技区(滨江)区块链与数据安全研究院) College of Computer Science, Zhejiang University(浙江大学计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24222 2025-06-02 cs.CV cs.LG 88%

Unleashing High-Quality Image Generation in Diffusion Sampling Using Second-Order Levenberg-Marquardt-Langevin

Fangyikang Wang, Hubery Yin, Lei Qian, Yinan Li, Shaobin Zhuang, Huminhao Zhu, Yilin Zhang, Yanlong Tang, Chao Zhang, Hanbin Zhao, Hui Qian, Chen Li

机构 * Zhejiang University(浙江大学) WeChat Vision, Tencent Inc(腾讯公司) Shanghai Jiao Tong University(上海交通大学) Tencent Lightspeed Studio(腾讯光年工作室)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08528 2025-05-28 astro-ph.GA cs.CV 88%

BCDDM: Branch-Corrected Denoising Diffusion Model for Black Hole Image Generation

Ao liu, Zelin Zhang, Songbai Chen, Cuihong Wen, Jieci Wang

机构 * College of information science and engineering, Hunan Normal University(信息科学与工程学院,湖南师范大学) Department of Physics, Institute of Interdisciplinary Studies, Key Laboratory of Low Dimensional Quantum Structures and Quantum Control of Ministry of Education, Synergetic Innovation Center for Quantum Effects and Applications, Hunan Normal University(物理系,跨学科研究所,教育部低维量子结构与量子控制重点实验室,量子效应与应用协同创新中心,湖南师范大学) Center for Gravitation and Cosmology, College of Physical Science and Technology, Yangzhou University(引力与宇宙学中心,物理科学与技术学院,扬州大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 20 pages, 10figures

Journal ref Astrophysical Journal Supplement Series, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20297 2025-05-27 cs.CV cs.CL 88%

DiSA: Diffusion Step Annealing in Autoregressive Image Generation

Qinyu Zhao, Jaskirat Singh, Ming Xu, Akshay Asthana, Stephen Gould, Liang Zheng

机构 * Australian National University(澳大利亚国立大学) Seeing Machines Ltd(Seeing Machines有限公司)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Our code is available at https://github.com/Qinyu-Allen-Zhao/DiSA

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19425 2025-05-27 cs.CV cs.CR cs.LG 88%

Structure Disruption: Subverting Malicious Diffusion-Based Inpainting via Self-Attention Query Perturbation

Yuhao He, Jinyu Tian, Haiwei Wu, Jianqing Li

机构 * Faculty of Innovation Engineering(创新工程学院) Macau University of Science and Technology(澳门科学技术大学) School of Computer Science and Engineering(计算机科学与工程学院) University of Electronic Science and Technology of China(电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14933 2025-05-23 cs.CV 88%

TWIG: Two-Step Image Generation using Segmentation Masks in Diffusion Models

Mazharul Islam Rakib, Showrin Rahman, Joyanta Jyoti Mondal, Xi Xiao, David Lewis, Alessandra Mileo, Meem Arafat Manab

机构 * BRAC University(布拉克大学) University of Delaware(德雷塞尔大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) ADAPT SFI Research Center(ADAPT SFI研究中心) Insight SFI Research Center for Data Analytics(Insight SFI数据分析研究中心) Dublin City University(都柏林城市大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 9 figures, published to IFIP International Summer School on Privacy and Identity Management

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12427 2025-05-21 cs.CV 88%

DragLoRA: Online Optimization of LoRA Adapters for Drag-based Image Editing in Diffusion Model

Siwei Xia, Li Sun, Tiantian Sun, Qingli Li

机构 * Siwei Xia Li Sun Tiantian Sun Qingli Li

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments Accepted by ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15661 2025-05-20 cs.CV 88%

DiTPainter: Efficient Video Inpainting with Diffusion Transformers

Xian Wu, Chang Liu

机构 * ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03471 2025-05-06 cs.CV 88%

Dynamic Importance in Diffusion U-Net for Enhanced Image Synthesis

Xi Wang, Ziqi He, Yang Zhou

机构 * CSSE, Shenzhen University(深圳大学计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

Comments Accepted to ICME 2025. Appendix & Code: https://github.com/Hytidel/UNetReweighting

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13509 2025-04-30 cs.CV 88%

Dual-Interrelated Diffusion Model for Few-Shot Anomaly Image Generation

Ying Jin, Jinlong Peng, Qingdong He, Teng Hu, Jiafu Wu, Hao Chen, Haoxuan Wang, Wenbing Zhu, Mingmin Chi, Jun Liu, Yabiao Wang

机构 * Fudan University(复旦大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01348 2025-04-29 cs.CV cs.CE cs.LG 88%

PatternPaint: Practical Layout Pattern Generation Using Diffusion-Based Inpainting

Guanglei Zhou, Bhargav Korrapati, Gaurav Rajavendra Reddy, Chen-Chia Chang, Jingyu Pan, Jiang Hu, Yiran Chen, Dipto G. Thakurta

机构 * Dept. of Electrical & Computer Engineering, Duke University(杜克大学电气与计算机工程系) Intel Corporation(英特尔公司) Dept. of Electrical & Computer Engineering, TAMU, College Station(塔拉斯大学电气与计算机工程系)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments DAC 2025 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01090 2025-04-29 cs.CV 88%

Infusion: internal diffusion for inpainting of dynamic textures and complex motion

Nicolas Cherel, Andrés Almansa, Yann Gousseau, Alasdair Newson

机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris, France(法国巴黎高等理工学院LTCI研究中心,Telecom Paris,巴黎理工学院) MAP5, CNRS & Université Paris Cité, France(法国国家科学研究中心MAP5研究所,巴黎城市大学) ISIR, Sorbonne Université, France(法国索邦大学ISIR研究所)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 14 pages, 11 figures. Published in Eurographics 2025

Journal ref Computer Graphics Forum e70070 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17524 2025-04-25 cs.CV 88%

ESDiff: Encoding Strategy-inspired Diffusion Model with Few-shot Learning for Color Image Inpainting

Junyan Zhang, Yan Li, Mengxiao Geng, Liu Shi, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 11 pages,10 figures,Submit to tcsvt

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03173 2025-04-23 cs.CV 88%

MObI: Multimodal Object Inpainting Using Diffusion Models

Alexandru Buburuzan, Anuj Sharma, John Redford, Puneet K. Dokania, Romain Mueller

机构 * FiveAI The University of Manchester(曼彻斯特大学) University of Oxford(牛津大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 8 pages; Project page at https://alexbubu.com/mobi

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09454 2025-04-15 cs.CV 88%

D$^2$iT: Dynamic Diffusion Transformer for Accurate Image Generation

Weinan Jia, Mengqi Huang, Nan Chen, Lei Zhang, Zhendong Mao

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13685 2025-04-15 cs.CV 88%

Financial Models in Generative Art: Black-Scholes-Inspired Concept Blending in Text-to-Image Diffusion

Divya Kothandaraman, Ming Lin, Dinesh Manocha

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20651 2025-04-14 cs.CV cs.AI 88%

Latent Drifting in Diffusion Models for Counterfactual Medical Image Synthesis

Yousef Yeganeh, Azade Farshad, Ioannis Charisiadis, Marta Hasny, Martin Hartenberger, Björn Ommer, Nassir Navab, Ehsan Adeli

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2025 (highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04168 2025-04-14 cs.CV cs.AI 88%

DiMSUM: Diffusion Mamba -- A Scalable and Unified Spatial-Frequency Method for Image Generation

Hao Phung, Quan Dao, Trung Dao, Hoang Phan, Dimitris Metaxas, Anh Tran

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024. Project page: https://vinairesearch.github.io/DiMSUM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19050 2025-04-11 cs.CV 88%

I Dream My Painting: Connecting MLLMs and Diffusion Models via Prompt Generation for Text-Guided Multi-Mask Inpainting

Nicola Fanelli, Gennaro Vessio, Giovanna Castellano

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments Accepted at WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏