arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-02 至 2026-04-02 共收录 78 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 78 篇

2508.12094 2026-04-02 cs.CV 83%

Error Propagation Mechanisms and Compensation Strategies for Quantized Diffusion

量化扩散模型中的误差传播机制与补偿策略

Songwei Liu, Chao Zeng, Chenqian Yan, Xurui Peng, Xing Wang, Fangmin Chen, Xing Mei

机构 * ByteDance Inc.(字节跳动公司)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出了一种基于理论框架的误差传播建模与补偿策略,通过数学推导得到每一步量化误差传播方程,并在多个图像数据集上验证了该策略对误差传播的抑制效果,显著提升了PTQ方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22729 2026-04-02 stat.ML cs.LG math.ST stat.TH 82%

Identifying Drift, Diffusion, and Causal Structure from Temporal Snapshots

从时间快照中识别漂移、扩散和因果结构

Vincent Guan, Joseph Janssen, Hossein Rahmani, Andrew Warren, Stephen Zhang, Elina Robeva, Geoffrey Schiebinger

机构 * University of British Columbia(不列颠哥伦比亚大学) University of Melbourne(墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

AI总结 本文提出了一种从时间边际联合识别SDE漂移和扩散的方法,证明了非识别性仅在初始分布具有广义旋转对称性时发生,并展示了因果图可从SDE参数中恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00007 2026-04-02 cs.CL cs.AI 82%

Dynin-Omni: Omnimodal Unified Large Diffusion Language Model

Dynin-Omni: 多模态统一的大扩散语言模型

Jaeik Kim, Woojin Kim, Jihwan Hong, Yejoon Lee, Sieun Hyeon, Mintaek Lim, Yunseok Han, Dogeun Kim, Hoeun Lee, Hyunggeun Kim, Jaeyoung Do

机构 * AIDAS Lab Seoul National University [1.5ex] Project Page Code Model Demo -2em

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

AI总结 Dynin-Omni首次提出基于掩码扩散的多模态基础模型,统一文本、图像、语音的理解与生成,以及视频理解,通过共享离散令牌空间实现双向上下文迭代优化。

Comments Project Page: https://dynin.ai/omni/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01053 2026-04-02 cs.CV 79%

PHASOR: Anatomy- and Phase-Consistent Volumetric Diffusion for CT Virtual Contrast Enhancement

PHASOR:基于解剖和相位一致的体积扩散用于CT虚拟对比增强

Zilong Li, Dongyang Li, Chenglong Ma, Zhan Feng, Dakai Jin, Junping Zhang, Hao Luo, Fan Wang, Hongming Shan

机构 * Shanghai Key Lab of Intelligent Information Processing, School of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院上海市智能信息处理重点实验室) Institute of Science and Technology for Brain-inspired Intelligence and MOE Frontiers Center for Brain Science, Fudan University(复旦大学类脑智能科学与技术研究院及教育部脑科学前沿中心) Shanghai Center for Brain Science and Brain-inspired Technology(上海脑科学与类脑研究中心) Department of Radiology, First Affiliated Hospital of College of Medical Science, Zhejiang University(浙江大学医学院附属第一医院放射科) Alibaba DAMO Academy(阿里巴巴达摩院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出PHASOR框架,通过体积扩散模型提升CT虚拟对比增强质量,引入解剖路由混合专家和强度-相位意识表示对齐模块,解决解剖异质性和空间偏移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00985 2026-04-02 cs.CV 79%

Maximizing T2-Only Prostate Cancer Localization from Expected Diffusion Weighted Imaging

从预期扩散加权成像最大化T2-only前列腺癌定位

Weixi Yi, Yipei Wang, Wen Yan, Hanyuan Zhang, Natasha Thorley, Alexander Ng, Shonit Punwani, Fernando Bianco, Mark Emberton, Veeru Kasivisvanathan, Dean C. Barratt, Shaheer U. Saeed, Yipeng Hu

机构 * UCL Hawkes Institute and the Department of Medical Physics and Biomedical Engineering, University College London(伦敦大学学院霍克斯研究所与医学物理与生物医学工程系) Centre for Bioengineering, School of Engineering and Materials Science and Digital Environment Research Institute, Queen Mary University of London(伦敦玛丽女王大学工程与材料科学学院生物工程中心与数字环境研究所) Centre for Medical Imaging, University College London(伦敦大学学院医学影像中心) Division of Surgery & Interventional Science, University College London(伦敦大学学院外科与介入科学部) Urological Research Network(泌尿研究网络)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出利用T2加权图像和生成模型进行前列腺癌定位,通过期望最大化算法提升定位性能,相比传统方法在患者和区域层面表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00853 2026-04-02 cs.CV 79%

MotionGrounder: Grounded Multi-Object Motion Transfer via Diffusion Transformer

MotionGrounder: 通过扩散变换器实现多物体运动迁移

Samuel Teodoro, Yun Chen, Agus Gunawan, Soo Ye Kim, Jihyong Oh, Munchurl Kim

机构 * School of Electrical Engineering, Korea Advanced Institute of Science and Technology(韩国科学技术院电气工程学院) Adobe Research(Adobe研究院) CMLab, Chung-Ang University(中央大学CMLab)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MotionGrounder,一种基于扩散变换器的多物体运动迁移框架,通过流式运动信号和对象-描述对齐损失实现稳定运动先验和空间对齐,实验显示其在定量、定性和人类评估中均优于现有方法。

Comments Please visit our project page at https://kaist-viclab.github.io/motiongrounder-site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00519 2026-04-02 cs.CV 79%

Learnability-Guided Diffusion for Dataset Distillation

基于可学习性的扩散模型用于数据集蒸馏

Jeffrey A. Chan-Santiago, Mubarak Shah

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于可学习性的数据集蒸馏方法,通过逐步构建合成数据集,减少冗余信号,提升模型性能,在ImageNet-1K等数据集上取得最佳结果。

Comments This paper has been accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29742 2026-04-02 cs.CV cs.CR 79%

SHIFT: Stochastic Hidden-Trajectory Deflection for Removing Diffusion-based Watermark

SHIFT: 随机隐藏轨迹偏移用于移除基于扩散的水印

Rui Bao, Zheng Gao, Xiaoyu Li, Xiaoyan Feng, Yang Song, Jiaojiao Jiang

机构 * University of New South Wales(新南威尔士大学) Griffith University(格里菲斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SHIFT通过随机隐藏轨迹偏移攻击利用扩散水印的轨迹恢复漏洞,实现高成功率的水印移除,不依赖模型训练,保持视觉和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14464 2026-04-02 cs.CV cs.AI 79%

CoCoDiff: Correspondence-Consistent Diffusion Model for Fine-grained Style Transfer

CoCoDiff:基于语义对应关系的扩散模型用于细粒度风格迁移

Wenbo Nie, Zixiang Li, Renshuai Tao, Bin Wu, Yunchao Wei, Yao Zhao

机构 * Institute of Information Science, Beijing Jiaotong University(北京交通大学信息科学研究所) Visual Intelligence + X International Joint Laboratory of the Ministry of Education(视觉智能+X教育部国际联合实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CoCoDiff提出一种无需训练的低成本风格迁移框架,利用预训练的潜在扩散模型实现细粒度语义一致的风格化,通过像素级语义对应模块和循环一致性模块实现对象和区域级别的风格迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16148 2026-04-02 cs.CV 79%

ActionMesh: Animated 3D Mesh Generation with Temporal 3D Diffusion

ActionMesh: 带有时间轴的3D扩散模型用于动画3D网格生成

Remy Sabathier, David Novotny, Niloy J. Mitra, Tom Monnier

机构 * Meta Reality Labs(Meta现实实验室) SpAItial University College London(伦敦大学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ActionMesh通过引入时间轴的3D扩散模型,实现了从多种输入生成动画3D网格,具备快速生成、无骨骼和拓扑一致性的优势,提升了在纹理和重定向等应用中的效率。

Comments CVPR 2026. Project webpage with code and videos: https://remysabathier.github.io/actionmesh/ . V2 update includes more baseline models with a larger evaluation set on our new publicly released benchmark ActionBench, and {3D+video}-to-animated-mesh qualitative comparison in supplemental

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00250 2026-04-02 cs.CV 79%

PRISM: Differentiable Analysis-by-Synthesis for Fixel Recovery in Diffusion MRI

PRISM:基于微结构拟合的固定点恢复分析-合成可微方法

Mohamed Abouagour, Atharva Shah, Eleftherios Garyfallidis

机构 * Indiana University, Bloomington, IN, USA(印第安纳大学布卢明顿分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PRISM通过端到端的空间块拟合显式多室模型,结合CSF、灰质和白质纤维方向,利用排斥和稀疏先验实现纤维恢复,优于现有方法。

Comments 10 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00093 2026-04-02 cs.CV 79%

RawGen: Learning Camera Raw Image Generation

RawGen: 学习相机原始图像生成

Dongyoung Kim, Junyong Lee, Abhijith Punnappurath, Mahmoud Afifi, Sangmin Han, Alex Levinshtein, Michael S. Brown

机构 * Samsung Electronics(三星电子) Yonsei University(延世大学)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

AI总结 RawGen通过扩散模型生成任意目标相机的原始图像,解决大规模原始数据集收集困难的问题,并提升低级视觉任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01200 2026-04-02 math.NA cs.NA math.AP 78%

A Posteriori Error Analysis of Runge-Kutta Discontinuous Galerkin Schemes with SIAC Post-Processing for Nonlinear Convection-Diffusion Systems

Runge-Kutta不连续Galerkin方案在非线性对流-扩散系统中的后验误差分析及SIAC后处理

Jan Giesselmann, Kiwoong Kwon, Sebastian Krumscheid

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种可靠后验误差估计器,用于非线性对流-扩散系统在多维平紧致空间上的Runge-Kutta不连续Galerkin近似,重点在于对流占主导的 regime,通过SIAC滤波重构数值解并推导误差估计器。

Comments 21 pages, 1 figure, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01175 2026-04-02 cs.LG 78%

NeuroDDAF: Neural Dynamic Diffusion-Advection Fields with Evidential Fusion for Air Quality Forecasting

NeuroDDAF:基于证据融合的神经动态扩散-对流场用于空气质量预测

Prasanjit Dey, Soumyabrata Dev, Angela Meyer, Bianca Schoen-Phelan

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出NeuroDDAF模型,结合物理模型与神经网络,通过GRU-图注意力编码器、傅里叶域扩散-对流模块、风调制的潜在Neural ODE以及证据融合机制,提升空气质量预测的准确性和不确定性估计。

Comments This manuscript is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01122 2026-04-02 eess.IV 78%

Region-Adaptive Generative Compression with Spatially Varying Diffusion Models

区域自适应生成压缩与空间变化扩散模型

Lucas Relic, Roberto Azevedo, Yang Zhang, Stephan Mandt, Markus Gross, Christopher Schroers

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种区域自适应扩散图像编解码器,通过空间变化扩散模型实现非均匀比特分配,利用重要性图作为潜在表示的先验,提升率失真性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01120 2026-04-02 eess.AS 78%

Diff-VS: Efficient Audio-Aware Diffusion U-Net for Vocals Separation

Diff-VS:高效的音频感知扩散U-Net用于人声分离

Yun-Ning, Hung, Richard Vogl, Filip Korzeniowski, Igor Pereira

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于EDM框架的新型生成式人声分离模型,通过改进的U-Net架构处理短时傅里叶变换频谱图,在客观指标上匹配判别基线,主观感知质量接近最先进的系统。

Comments Accepted at ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01106 2026-04-02 physics.optics cs.LG 78%

Inverse Design of Optical Multilayer Thin Films using Robust Masked Diffusion Models

利用鲁棒掩码扩散模型逆向设计光学多层薄膜

Jonas Schaible, Asena Karolin Özdemir, Charlotte Debus, Sven Burger, Achim Streit, Christiane Becker, Klaus Jäger, Markus Götz

机构 * Zuse Institute Berlin(柏林祖泽研究所) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) JCMwave GmbH(JCMwave有限公司) Helmholtz AI(亥姆霍兹人工智能)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出OptoLlama模型,通过光学光谱数据逆向设计多层薄膜结构,显著降低光谱误差,恢复物理有意义的堆叠特征。

Comments 24 pages, 14 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00984 2026-04-02 nucl-th hep-th math-ph math.MP 78%

Exact interpolation between Fick and Cattaneo diffusion in relativistic kinetic theory

在相对论动力学理论中实现菲克与卡塔内奥扩散的精确插值

Lorenzo Gavassino

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文构建了一种在1+1维中可精确求解的相对论动力学理论家族,其流体动力学部分连续插值于菲克和卡塔内奥扩散定律之间,通过参数a控制微观散射动态,实现从无限软但无限频繁的散射到最大硬但有限率的散射的转变。

Comments 10 pages, 4 figures, comments welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00896 2026-04-02 physics.med-ph 78%

Design of a double breast gradient coil with controlled anterior posterior gradient variation for diffusion weighted imaging

设计一种具有受控前后梯度变化的双乳腺梯度线圈用于扩散加权成像

Feng Jia, Gerrit Cornelis Arends, Philipp Amrein, Edwin Versteeg, Dennis W. J. Klomp, Maxim Zaitsev, Chantal M. W. Tax, Sebastian Littin

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种优化框架,通过约束控制前后梯度变化,提高乳腺扩散加权成像的线圈效率和均匀性,实验结果表明新设计在后乳腺区域性能提升显著。

Comments 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00692 2026-04-02 math.PR math.AP 78%

Uniform-in-time diffusion approximations for multiscale stochastic systems

多尺度随机系统的时间均匀扩散近似

Longjie Xie, Xicheng Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文建立了一种针对广泛类别的全耦合多尺度随机系统的统一时间扩散近似,通过精确刻画极限联合分布,提供了时间均匀的正则化消除原理的严格公式,并证明了极限的可交换性。

Comments 51pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00666 2026-04-02 cs.CL 78%

TRIMS: Trajectory-Ranked Instruction Masked Supervision for Diffusion Language Models

TRIMS: 用于扩散语言模型的轨迹排序指令掩码监督

Lingjie Chen, Ruizhong Qiu, Yuyu Fan, Yanjun Zhao, Hanghang Tong

机构 * UIUC(伊利诺伊大学厄巴纳-香槟分校) Independent Researcher(独立研究员)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 TRIMS通过轨迹指导的监督微调框架提升扩散语言模型的生成效率与准确性,实验表明其在数学和编程基准上优于传统方法,且训练成本更低。

Comments 10 pages, 7 figures, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00645 2026-04-02 math.AP math.PR 78%

Li-Yau and Harnack estimates for nonlocal diffusion problems

李-尤和哈纳克估计非局部扩散问题

Rico Zacher

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文介绍微分哈纳克不等式,总结了关于非局部扩散问题的李-尤和哈纳克估计的课程主要结果。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00497 2026-04-02 math.AP 78%

Fundamental solution and diffusion limits for the heat equation in a half-space with a diffusive dynamical boundary condition

半空间热方程中具有扩散动力边界条件的基本解及扩散极限

Kazuhiro Ishige, Sho Katayama, Tatsuki Kawakami

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究半空间热方程在扩散动力边界条件下的基本解,推导出显式表示并建立精确衰减估计,分析解的定性性质及扩散极限行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00481 2026-04-02 stat.ME stat.ML 78%

Tucker Diffusion Model for High-dimensional Tensor Generation

Tucker扩散模型用于高维张量生成

Jianhua Guo, Xinbing Kong, Zeyu Li, Junfan Mao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出Tucker扩散模型,通过低秩Tucker假设实现张量分布的学习,利用Tucker-Unet架构在高维张量生成中取得理论和实践优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00391 2026-04-02 cs.RO cs.SY eess.SY 78%

Behavioral Score Diffusion: Model-Free Trajectory Planning via Kernel-Based Score Estimation from Data

行为得分扩散:通过核基得分估计实现无模型轨迹规划

Shihao Li, Jiachen Li, Jiamin Xu, Dongmei Chen

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出行为得分扩散(BSD),通过核加权估计直接从轨迹数据中计算扩散得分函数,无需学习模型或动力学模型,在停车场景中实现高效轨迹规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00375 2026-04-02 cs.CL 78%

Locally Confident, Globally Stuck: The Quality-Exploration Dilemma in Diffusion Language Models

局部自信,全局停滞:扩散语言模型中的质量探索困境

Liancheng Fang, Aiwei Liu, Henry Peng Zou, Yankai Chen, Enze Ma, Leyi Pan, Chunyu Miao, Wei-Chieh Huang, Xue Liu, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Tsinghua University(清华大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) McGill University(麦吉尔大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文探讨了扩散语言模型中质量与探索的矛盾,提出了一种平衡两者的方法,通过优化分布和采样策略提升生成质量与探索能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10441 2026-04-02 cs.RO 78%

KnowDiffuser: A Knowledge-Guided Diffusion Planner with LLM Reasoning

KnowDiffuser: 一种基于知识的扩散规划器与大语言模型推理

Fan Ding, Xuewen Luo, Fengze Yang, Bo Yu, HwaHui Tew, Ganesh Krishnasamy, Junn Yong Loo

机构 * Monash University Malaysia(莫纳什大学马来西亚校区) University of Utah(犹他大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出KnowDiffuser,结合大语言模型的语义理解和扩散模型的生成能力,有效解决自动驾驶中语义到物理的鸿沟问题,实验表明其在开放环和闭环评估中表现优异。

Comments 10pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00226 2026-04-02 eess.IV physics.med-ph 78%

Let Distortion Guide Restoration (DGR): A physics-informed learning framework for Prostate Diffusion MRI

让失真引导恢复(DGR):一种用于前列腺扩散MRI的物理引导学习框架

Ziyang Long, Binesh Nader, Lixia Wang, Archana Vadiraj Malaji, Chia-Chi Yang, Haoran Sun, Rola Saouaf, Timothy Daskivich, Hyung Kim, Yibin Xie, Debiao Li, Hsin-Jung Yang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DGR框架,通过物理引导学习方法在无采集情况下纠正前列腺单次采集EPI扩散加权成像中的严重磁 susceptibility 引起的失真,提升了图像质量和诊断信心。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00580 2026-04-02 cs.LG stat.ML 78%

Non-Asymptotic Convergence of Discrete Diffusion Models: Masked and Random Walk dynamics

离散扩散模型的非渐近收敛性:掩码与随机游动动力学

Giovanni Conforti, Alain Durmus, Le-Tuyet-Nhi Pham, Gael Raoul

机构 * University of Padova(帕多瓦大学) CMAP, IP Paris(巴黎综合理工学院应用数学中心)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了三种离散扩散模型的非渐近收敛性,通过建立基于随机游动和掩码过程的收敛保证,解决了离散状态空间下扩散模型的挑战,且在无需限制估计得分的情况下提供了最优的收敛界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13568 2026-04-02 math.OC q-fin.MF 78%

Infinite-Horizon Optimal Control of Jump-Diffusion Models for Pollution-Dependent Disasters

无限时间 horizon 跳扩散模型中污染依赖型灾害的最优控制

Daria Sakhanda, Joshué Helí Ricalde-Guerrero

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一个统一框架,研究具有环境风险的随机增长模型,探讨罕见但灾难性冲击与资本积累和污染的相互作用,通过泊松点过程推导非局部HJB方程,提供闭式解并构建复合状态变量。

详情

展开后加载摘要…

URL PDF HTML 收藏