arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69868 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69868 篇

2507.13401 2025-07-21 cs.CV cs.LG 85%

MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing

Shreya Kadambi, Risheek Garrepalli, Shubhankar Borse, Munawar Hyatt, Fatih Porikli

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09626 2025-07-14 cs.CV 85%

FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion

Haonan Qiu, Shiwei Zhang, Yujie Wei, Ruihang Chu, Hangjie Yuan, Xiang Wang, Yingya Zhang, Ziwei Liu

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2025, Project Page: http://haonanqiu.com/projects/FreeScale.html, Code Repo: https://github.com/ali-vilab/FreeScale

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06033 2025-07-09 cs.CV cs.AI cs.LG 85%

TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision

Syeda Anshrah Gillani, Mirza Samad Ahmed Baig, Osama Ahmed Khan, Shahid Munir Shah, Umema Mujeeb, Maheen Ali

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03846 2025-07-08 cs.CV cs.LG 85%

Interpretable Diffusion Models with B-cos Networks

Nicola Bernold, Moritz Vandenhirtz, Alice Bizeul, Julia E. Vogt

机构 * Department of Computer Science, ETH Zürich, Switzerland(苏黎世联邦理工学院计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00992 2025-07-03 cs.CV 85%

UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis

Yuanrui Wang, Cong Han, Yafei Li, Zhipeng Jin, Xiawei Li, SiNan Du, Wen Tao, Yi Yang, Shuanglong Li, Chun Yuan, Liu Lin

机构 * Tsinghua University(清华大学) Baidu Inc.(百度公司)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10105 2025-07-01 cs.CV 85%

High-Precision Dichotomous Image Segmentation via Probing Diffusion Capacity

Qian Yu, Peng-Tao Jiang, Hao Zhang, Jinwei Chen, Bo Li, Lihe Zhang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Published as a conference paper at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10633 2025-06-13 cs.CV 85%

Anatomy-Grounded Weakly Supervised Prompt Tuning for Chest X-ray Latent Diffusion Models

Konstantinos Vilouras, Ilias Stogiannidis, Junyu Yan, Alison Q. O'Neil, Sotirios A. Tsaftaris

机构 * University of Edinburgh(爱丁堡大学) Canon Medical Research Europe Ltd.(佳能医疗欧洲有限公司)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17493 2025-06-10 cs.CV cs.AI 85%

Model Collapse in the Self-Consuming Chain of Diffusion Finetuning: A Novel Perspective from Quantitative Trait Modeling

Youngseok Yoon, Dainong Hu, Iain Weissburg, Yao Qin, Haewon Jeong

机构 * UCSB California, USA(加州大学圣芭芭拉分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments version 3, additional 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23283 2025-05-30 cs.CV 85%

RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries

Zhihong Tan, Jiayi Wang, Huiying Shi, Binyuan Huang, Hongchen Wei, Zhenzhong Chen

机构 * Zhihong Tan(谭志宏) Jiayi Wang(王佳毅) Huiying Shi(Shi 希慧) Binyuan Huang(黄彬远) Hongchen Wei(韦宏晨) Zhenzhong Chen(陈振中)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13740 2025-05-27 cs.LG cs.AI cs.CV 85%

Improving Compositional Generation with Diffusion Models Using Lift Scores

Chenning Yu, Sicun Gao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Journal ref ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18865 2025-05-26 cs.CV cs.AI cs.LG 85%

REG: Rectified Gradient Guidance for Conditional Diffusion Models

Zhengqi Gao, Kaiwen Zha, Tianyuan Zhang, Zihui Xue, Duane S. Boning

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 20 pages, 10 figures; accepted by ICML'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12486 2025-05-20 cs.CV 85%

Guiding Diffusion with Deep Geometric Moments: Balancing Fidelity and Variation

Sangmin Jung, Utkarsh Nath, Yezhou Yang, Giulia Pedrielli, Joydeep Biswas, Amy Zhang, Hassan Ghasemzadeh, Pavan Turaga

机构 * Arizona State University(亚利桑那州立大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted in CVPR Workshop GMCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01917 2025-05-20 cs.GR cond-mat.mtrl-sci cs.LG eess.IV 85%

Discrete Spatial Diffusion: Intensity-Preserving Diffusion Modeling

Javier E. Santos, Agnese Marcato, Roman Colman, Nicholas Lubbers, Yen Ting Lin

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08817 2025-05-15 cs.CV cs.LG 85%

Towards SFW sampling for diffusion models via external conditioning

Camilo Carvajal Reyes, Joaquín Fontbona, Felipe Tobar

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepcted at IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13637 2025-05-12 cs.CV cs.AI cs.LG 85%

Curriculum Direct Preference Optimization for Diffusion and Consistency Models

Florinel-Alin Croitoru, Vlad Hondru, Radu Tudor Ionescu, Nicu Sebe, Mubarak Shah

机构 * University of Bucharest(布加勒斯特大学) University of Trento(特伦托大学) University of Central Florida(中央佛罗里达大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10232 2025-05-01 cs.CV cs.AI 85%

ColorEdit: Training-free Image-Guided Color editing with diffusion model

Xingxi Yin, Zhi Li, Jingfeng Zhang, Chenglin Li, Yin Zhang

机构 * Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15397 2025-04-23 cs.CV 85%

MirrorVerse: Pushing Diffusion Models to Realistically Reflect the World

Ankit Dhiman, Manan Shah, R Venkatesh Babu

机构 * Vision and AI Lab, IISc Bangalore(视觉与人工智能实验室,班加罗尔IISc) Samsung R & D Institute India - Bangalore(三星研发研究所-印度班加罗尔)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to CVPR 2025. Project Page: https://mirror-verse.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06186 2025-04-21 cs.CV 85%

PTDiffusion: Free Lunch for Generating Optical Illusion Hidden Pictures with Phase-Transferred Diffusion Model

Xiang Gao, Shuai Yang, Jiaying Liu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11850 2025-04-17 cs.CV 85%

ACE: Attentional Concept Erasure in Diffusion Models

Finn Carter

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10883 2025-04-16 cs.CV cs.AI 85%

Bringing together invertible UNets with invertible attention modules for memory-efficient diffusion models

Karan Jain, Mohammad Nayeem Teli

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08451 2025-04-14 cs.CV 85%

Muon-Accelerated Attention Distillation for Real-Time Edge Synthesis via Optimized Latent Diffusion

Weiye Chen, Qingen Zhu, Qian Long

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14854 2025-04-08 cs.CV cs.LG 85%

TerDiT: Ternary Diffusion Models with Transformers

Xudong Lu, Aojun Zhou, Ziyi Lin, Qi Liu, Yuhui Xu, Renrui Zhang, Xue Yang, Junchi Yan, Peng Gao, Hongsheng Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14524 2025-04-07 cs.CV 85%

Training-Free Style and Content Transfer by Leveraging U-Net Skip Connections in Stable Diffusion

Ludovica Schaerf, Andrea Alfarano, Fabrizio Silvestri, Leonardo Impett

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments Accepted to CVPR Workshop on AI for Creative Visual Content Generation Editing and Understanding 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01934 2025-04-04 cs.CV 85%

ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement

Runhui Huang, Chunwei Wang, Junwei Yang, Guansong Lu, Yunlong Yuan, Jianhua Han, Lu Hou, Wei Zhang, Lanqing Hong, Hengshuang Zhao, Hang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07764 2025-04-02 cs.CV 85%

Stable-Makeup: When Real-World Makeup Transfer Meets Diffusion Model

Yuxuan Zhang, Yirui Yuan, Yiren Song, Jiaming Liu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22796 2025-04-01 cs.CV cs.AI 85%

DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers

Hanling Zhang, Rundong Su, Zhihang Yuan, Pengtao Chen, Mingzhu Shen Yibo Fan, Shengen Yan, Guohao Dai, Yu Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13107 2025-03-31 cs.CV 85%

Accelerate High-Quality Diffusion Models with Inner Loop Feedback

Matthew Gwilliam, Han Cai, Di Wu, Abhinav Shrivastava, Zhiyu Cheng

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments submission currently under review; 20 pages, 17 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21774 2025-03-28 cs.CV 85%

Optimal Stepsize for Diffusion Sampling

Jianning Pei, Han Hu, Shuyang Gu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20853 2025-03-28 cs.CV cs.AI cs.LG cs.RO 85%

Unified Multimodal Discrete Diffusion

Alexander Swerdlow, Mihir Prabhudesai, Siddharth Gandhi, Deepak Pathak, Katerina Fragkiadaki

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments Project Website: https://unidisc.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11240 2025-03-28 cs.CV cs.LG 85%

Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards

Zijing Hu, Fengda Zhang, Long Chen, Kun Kuang, Jiahui Li, Kaifeng Gao, Jun Xiao, Xin Wang, Wenwu Zhu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2025, add references

详情

展开后加载摘要…

URL PDF HTML 收藏