arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69868 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69868 篇

2406.08070 2024-09-13 cs.CV cs.AI cs.LG 88%

CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models

Hyungjin Chung, Jeongsol Kim, Geon Yeong Park, Hyelin Nam, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);image editing(abstract)

Comments 25 pages, 21 figures. Project Page: https://cfgpp-diffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00816 2024-06-04 cs.LG cs.CR cs.CV 88%

Invisible Backdoor Attacks on Diffusion Models

Sen Li, Junchi Ma, Minhao Cheng

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);inpainting(abstract)

Comments Code: https://github.com/invisibleTriggerDiffusion/invisible_triggers_for_diffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08510 2023-04-05 cs.CV 88%

Text-driven Visual Synthesis with Latent Diffusion Prior

Ting-Hsuan Liao, Songwei Ge, Yiran Xu, Yao-Chih Lee, Badour AlBahar, Jia-Bin Huang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);image synthesis(abstract)

Comments Project website: https://latent-diffusion-prior.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11732 2026-08-13 cs.CR cs.AI 新提交 88%

Fingerprinting Text-to-Image Diffusion Models via Collapsed Generation

基于塌陷生成的文本到图像扩散模型指纹识别

Yuanmin Huang, Chen Chen, Geng Hong, Xiaoyu You, Hui Xue, Zhenxing Qian, Mi Zhang, Min Yang

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 本研究提出基于塌陷生成的非侵入式指纹框架,可在白盒和黑盒设置下验证文本到图像扩散模型的所有权,且对微调衍生模型及混淆具有鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06424 2026-08-10 cs.SD cs.CL cs.LG 新提交 88%

Multi Codec Discrete Diffusion Model for Text Guided Speech Inpainting and Editing

用于文本引导语音修复与编辑的多编解码器离散扩散模型

Iftach Shoham, Tali Dror, Oren Gal, Haim Permuter, Gilad Katz, Eliya Nachmani

机构 * Ben-Gurion University of the Negev(内盖夫本-古里安大学) University of Haifa(海法大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

AI总结 该研究提出基于分层编解码器令牌的离散扩散框架SIEDD,其核心架构HiCoDD结合音素级约束等技术,在RealEdit基准中实现最优语音编辑性能,且优于自回归基线,显著提升上下文保留的语音重建与编辑效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03990 2026-08-05 cs.LG 新提交 88%

Assessment of Conditional Diffusion Model for Synthetic Histopathology Image Generation

用于合成组织病理学图像生成的条件扩散模型评估

Seyed Kahaki, Shijie Li, Weijie Chen, Nicholas Petrick

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract)

AI总结 本研究针对合成组织病理学图像生成的评估问题,提出基于数字病理学预训练基础模型改进的FID、IS及精确率-召回率指标,实验发现改进后的IS与下游细胞核分割性能相关性更高,且生成数据多样性对分割性能的提升作用强于单张图像视觉保真度。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07072 2026-07-09 cs.LG 新提交 88%

An Hybrid Quantum-Classical Diffusion Model for Image Generation

一种用于图像生成的混合量子-经典扩散模型

Qipeng Qian, Keli Deng, Yuntao Qian

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract)

AI总结 研究针对量子扩散模型应用于经典高维数据的限制,提出结合经典自动编码器与混合态量子去噪扩散概率模型的混合生成管道,用于图像生成,通过简化反向动力学算法展示该方法在MNIST图像生成上的效果及意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01959 2026-06-17 cond-mat.mtrl-sci 版本更新 88%

Score-based diffusion models for accurate crystal-structure inpainting and reconstruction of hydrogen positions

基于分数的扩散模型用于精确的晶体结构修补和氢原子位置重建

Timo Reents, Arianna Cantarella, Marnik Bercx, Pietro Bonfà, Giovanni Pizzi

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

AI总结 提出将计算机视觉中的图像修补扩散模型应用于材料科学,实现从部分信息重建晶体结构,特别是氢原子位置,成功率超97%。

Journal ref npj Comput Mater 12, 203 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04898 2026-05-28 cs.CR cs.AI 88%

Semantic-level Backdoor Attack against Text-to-Image Diffusion Models

针对文本到图像扩散模型的语义级后门攻击

Tianxin Chen, Wenbo Jiang, Hongqiao Chen, Zhirun Zheng, Cheng Huang

机构 * College of Computer Science and Artificial Intelligence, Fudan University, Shanghai, China(复旦大学计算机科学与人工智能学院,上海,中国) State Key Laboratory of Integrated Services Networks, Xidian University, Xian, China(集成服务网络国家重点实验室,西安电子科技大学,西安,中国) University of Electronic Science and Technology of China, Sichuan, China(电子科技大学,四川,中国) Ajou University, Gyeonggi-do, South Korea(庆尚道,韩国,全州大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 提出语义级后门攻击(SemBD),通过基于连续语义区域的表示级触发器替代离散文本模式,利用蒸馏编辑交叉注意力层的键和值投影矩阵植入后门,并引入语义正则化和多实体后门目标增强隐蔽性,实现100%攻击成功率并抵御输入级防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19698 2026-05-20 cs.CR cs.LG 88%

Awakening the Hydra: Stabilizing Multi-Concept Backdoor Injection in Text-to-Image Diffusion Models

唤醒 Hydra:在文本到图像扩散模型中稳定多概念后门注入

Kai Wang, Jiale Zhang, Chengcheng Zhu, Chuang Ma, Songze Li

机构 * Yangzhou University(扬州大学) Nanjing University(南京大学) Chongqing University(重庆大学) Southeast University(东南大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 本文研究了在易受干扰的环境下多概念后门攻击的稳定性问题,提出 Hydra 框架,通过约束触发语义和协调跨任务交互,实现稳健且可控的多概念后门注入,实验表明 Hydra 在保持清洁生成质量的同时,有效激活后门。

Comments Preprint. 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10315 2026-05-12 cs.LG cs.AI 88%

Active Tabular Augmentation via Policy-Guided Diffusion Inpainting

通过策略引导的扩散修复进行主动表格增强

Zheyu Zhang, Shuo Yang, Bardh Prenkaj, Gjergji Kasneci

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

AI总结 本文提出TAP方法,结合扩散修复与轻量策略,提升表格增强的实用性和安全性,在数据稀缺情况下提升分类准确率和回归性能。

Comments Accepted for publication at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09039 2026-04-13 eess.SP 88%

Diffusion Inpainting MIMO-OFDM Channels with Limited Noisy Observations

利用有限噪声观测进行MIMO-OFDM信道扩散修复

Weijie Zhou, Zhaoyang Zhang, Yuzhi Yang, Sen Yan, Zhixian Kong, Merouane Debbah

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

AI总结 本文提出基于扩散模型的MIMO-OFDM信道估计方法,通过条件生成任务修复有限噪声观测,实现高精度信道恢复,实验表明在不同噪声条件下性能提升5dB以上,且在稀疏试点密度下保持高效准确。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20680 2026-02-25 cs.CR 88%

Vanishing Watermarks: Diffusion-Based Image Editing Undermines Robust Invisible Watermarking

消失的水印:基于扩散的图像编辑削弱了鲁棒的隐形水印

Fan Guo, Jiyu Kang, Qi Ming, Emily Davis, Finn Carter

专题命中 扩散模型 :diffusion(title,abstract);image editing(title);image generation(abstract)

AI总结 本文揭示基于扩散模型的图像编辑可有效消除鲁棒隐形水印,挑战现有水印技术的鲁棒性,需发展新策略应对生成模型带来的威胁。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03213 2026-02-17 cs.LG 88%

Critic-Guided Reinforcement Unlearning in Text-to-Image Diffusion

基于批评者的文本到图像扩散强化学习

Mykola Vysotskyi, Zahar Kohut, Mariia Shpir, Taras Rumezhak, Volodymyr Karpiv

机构 * SoftServe, Sadova St, 2D, Lviv, Lviv Oblast Ukraine(SoftServe) Ukrainian Catholic University(乌克兰天主教大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 本文提出了一种基于批评者的强化学习框架,用于文本到图像扩散模型的无学习,通过时间步感知的批评者和噪声时间步奖励提升稳定性和效果。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26097 2025-10-31 eess.SP cs.LG 88%

Robust Super-Capacity SRS Channel Inpainting via Diffusion Models

Usman Akram, Fan Zhang, Yang Li, Haris Vikalo

机构 * Department of Electrical and Computer Engineering, The University of Texas at Austin(电子与计算机工程系,德克萨斯大学奥斯汀分校) Standards and Mobility Innovation Lab, Samsung Research America(标准与移动创新实验室,三星美国研究院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25818 2025-10-31 cs.LG cs.AI 88%

ScaleDiff: Higher-Resolution Image Synthesis via Efficient and Model-Agnostic Diffusion

Sungho Koh, SeungJu Cha, Hyunwoo Oh, Kwanyoung Lee, Dong-Jin Kim

机构 * Hanyang University(翰阳大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);text-to-image(abstract)

Comments NeurIPS 2025. Code: https://github.com/KSH00906/ScaleDiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26538 2025-10-01 cs.AI 88%

HilbertA: Hilbert Attention for Image Generation with Diffusion Models

Shaoyi Zheng, Wenbo Lu, Yuxuan Xia, Haomin Liu, Shengjie Wang

机构 * Department of Computer Science, New York University(纽约大学计算机科学系)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16342 2025-09-23 eess.AS cs.LG cs.SD 88%

Similarity-Guided Diffusion for Long-Gap Music Inpainting

Sean Turland, Eloi Moliner, Vesa Välimäki

机构 * Acoustics Lab, Dept. Information(信息学院声学实验室) Communications Engineering, Aalto University, Espoo, Finland(通讯工程,阿alto大学,埃斯波,芬兰)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Comments 5 pages, 2 figures. Submitted to IEEE ICASSP 2026. Audio examples and supplementary material are available at: https://s-turland.github.io/SimDPS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10396 2025-09-15 cs.LG 88%

Inpainting-Guided Policy Optimization for Diffusion Large Language Models

Siyan Zhao, Mengchen Liu, Jing Huang, Miao Liu, Chenyu Wang, Bo Liu, Yuandong Tian, Guan Pang, Sean Bell, Aditya Grover, Feiyu Chen

机构 * Meta Superintelligence Labs(Meta超智能实验室) Tsinghua University, College of AI(清华大学人工智能学院) MIT(麻省理工学院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Comments preprint; 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09767 2025-08-20 cs.RO 88%

DISCO: Language-Guided Manipulation with Diffusion Policies and Constrained Inpainting

Ce Hao, Kelvin Lin, Zhiwei Xue, Siyuan Luo, Harold Soh

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) Smart Systems Institute, NUS(NUS智能系统研究所)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Journal ref IEEE Robotics and Automation Letters ( Volume: 10, Issue: 10, October 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16634 2025-08-18 cs.CY cs.AI cs.CR 88%

RLCP: A Reinforcement Learning-based Copyright Protection Method for Text-to-Image Diffusion Model

Zhuan Shi, Jing Yan, Xiaoli Tang, Lingjuan Lyu, Boi Faltings

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract)

Journal ref The 2025 IEEE International Conference on Multimedia and Expo (ICME'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09903 2025-08-14 quant-ph 88%

Hybrid Quantum-Classical Latent Diffusion Models for Medical Image Generation

Kübra Yeter-Aydeniz, Nora M. Bauer, Pranay Jain, Max Masnick

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20478 2025-07-29 cs.LG 88%

Conditional Diffusion Models for Global Precipitation Map Inpainting

Daiko Kishikawa, Yuka Muto, Shunji Kotsuki

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13486 2025-05-30 eess.IV 88%

Connecting Image Inpainting with Denoising in the Homogeneous Diffusion Setting

Daniel Gaa, Vassillen Chizhov, Pascal Peter, Joachim Weickert, Robin Dirk Adam

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Journal ref In Advances in Continuous and Discrete Models, Vol. 2025, Article No. 74, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10853 2025-04-21 cs.CR 88%

PT-Mark: Invisible Watermarking for Text-to-image Diffusion Models via Semantic-aware Pivotal Tuning

Yaopeng Wang, Huiyu Xu, Zhibo Wang, Jiacheng Du, Zhichao Li, Yiming Li, Qiu Wang, Kui Ren

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03785 2025-03-07 eess.IV cs.LG 88%

Tackling Few-Shot Segmentation in Remote Sensing via Inpainting Diffusion Model

Steve Andreas Immanuel, Woojin Cho, Junhyuk Heo, Darongsae Kwon

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Comments Accepted to ICLRW 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15266 2025-01-13 eess.AS cs.SD 88%

Diffusion-Based Audio Inpainting

Eloi Moliner, Vesa Välimäki

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Comments Submitted for publication to the Journal of Audio Engineering Society on January 30th, 2023

Journal ref Journal of the Audio Engineering Society 72, no. 3 (2024): 100-113

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00712 2024-10-04 q-bio.NC cs.LG 88%

NECOMIMI: Neural-Cognitive Multimodal EEG-informed Image Generation with Diffusion Models

Chi-Sheng Chen

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03509 2024-09-04 cs.CL cs.AI cs.HC cs.LG 88%

Diffusion Explainer: Visual Explanation for Text-to-image Stable Diffusion

Seongmin Lee, Benjamin Hoover, Hendrik Strobelt, Zijie J. Wang, ShengYun Peng, Austin Wright, Kevin Li, Haekyu Park, Haoyang Yang, Duen Horng Chau

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(title);image generation(abstract)

Comments 5 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06747 2024-08-13 eess.IV cs.NA math.NA 88%

Efficient Parallel Data Optimization for Homogeneous Diffusion Inpainting of 4K Images

Niklas Kämper, Vassillen Chizhov, Joachim Weickert

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏