arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-06-30 至 2026-06-30 共收录 125 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 125 篇

2603.12575 2026-06-30 cs.CV 89%

AccelAes: Accelerating Diffusion Transformers for Training-Free Aesthetic-Enhanced Image Generation

AccelAes: 通过美学感知的时空缩减加速无训练扩散变换器

Xuanhua Yin, Chuanzhi Xu, Haoxian Zhou, Boyu Wei, Weidong Cai

机构 * School of Computer Science, The University of Sydney(悉尼大学计算机科学学院)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出AccelAes框架,通过空间-时间缩减提升扩散变换器的生成效率与美学质量,在Lumina-Next上实现2.11倍加速并提升ImageReward 11.9%。

Comments Accepted by ECCV2026; 34 pages, 19 tables, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05693 2026-06-30 eess.IV cs.AI cs.CV 88%

Longitudinal Lesion Inpainting in Brain MRI via 3D Region Aware Diffusion

通过3D区域感知扩散进行脑部MRI的纵向病变修复

Zahra Karimaghaloo, Dumitru Fetco, Haz-Edine Assemlal, Hassan Rivaz, Douglas L. Arnold

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文提出基于DDPM的新型伪3D纵向修复框架,利用多通道条件结合不同时间点的纵向信息,提高病变修复的感知保真度和纵向稳定性,同时提升处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02172 2026-06-30 cs.CV 88%

TerraDiT: Point-Conditioned Diffusion Transformer for Satellite Image Synthesis

TerraDiT:基于点的扩散变换器用于卫星图像合成

Srikumar Sastry, Dan Cher, Brian Wei, Aayush Dhakal, Subash Khanal, Dev Gupta, Nathan Jacobs

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

AI总结 TerraDiT通过点条件控制实现文本到卫星图像生成,提供语义丰富的控制信号,具有灵活、标注友好和计算简单的推理特性。

Comments 26 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30332 2026-06-30 cs.CV 83%

UniGP: Taming Diffusion Transformer for Prior-Preserved Unified Generation and Perception

UniGP:驯服扩散Transformer以实现先验保留的统一生成与感知

Qin Guo, Hao Luo, Dongxu Yue, Weixuan Jin, Xiao Fu, Fan Wang, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) DAMO Academy, Alibaba Group(阿里云达摩院) Hupan Lab(虎扑实验室) Zhejiang University(浙江大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Zeekr Automobile R&D Co., Ltd.(小鹏汽车研发有限公司)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 提出UniGP框架,基于MMDiT通过简单联合训练统一可控生成与密集预测,无需复杂任务设计,保留骨干先验,在多个任务上超越先前统一方法并与专用方法持平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29801 2026-06-30 cs.CV 83%

Concept Removal Guidance: Evidence-Calibrated Negative Guidance for Safe Diffusion Sampling

概念移除引导:用于安全扩散采样的证据校准负引导

Yoonseok Choi, Chaeyoung Oh, Hyunjun Choi, Seokin Seo, Kee-Eung Kim

机构 * KAIST(韩国科学技术院) KIST(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 提出概念移除引导(CRG),一种无需训练的方法,通过从模型噪声预测中估计不良概念存在并自适应校准负引导权重,在保持良性保真度的同时降低攻击成功率。

Comments Published at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28628 2026-06-30 eess.IV cs.CV cs.LG 83%

Envisage: Diffusion-Based Rhinoplasty Goal Visualization with Mask-Decomposed Evaluation

Envisage:基于扩散的鼻整形目标可视化与掩码分解评估

Mudit Agarwal, Amit D. Bhrany

机构 * University of Washington(华盛顿大学) University of Washington School of Medicine(华盛顿大学医学院) Department of Otolaryngology–Head and Neck Surgery(耳鼻喉科–头颈外科部门)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 提出Envisage扩散修复管线,从单张正面照片可视化鼻整形目标,并引入SurgicalScore掩码分解协议评估局部编辑质量,克服全脸身份指标在硬合成编辑下的混淆。

Comments 29 pages, 4 figures, 22 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00654 2026-06-30 cs.CV 83%

Seed-to-Seed: Unpaired Image Translation in Diffusion Seed Space

种子到种子:扩散种子空间中的无配对图像翻译

Or Greenberg, Eran Kishon, Dani Lischinski

机构 * General Motors R&D(通用汽车研发中心) The Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出一种结合GAN和扩散模型的无配对图像翻译方法,通过利用预训练扩散模型的种子空间语义信息,实现复杂汽车场景的结构保持翻译,优于现有方法。

Comments British Machine Vision Conference (BMVC) 2025. Official proceedings: https://bmvc2025.bmva.org/proceedings/154/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05934 2026-06-30 cs.CV 83%

AD-DAE: Alzheimer's Disease Progression Modeling with Unpaired Longitudinal MRI using Diffusion Auto-Encoders

AD-DAE:利用未配对纵向MRI进行阿尔茨海默病进展建模的扩散自编码器

Ayantika Das, Arunima Sarkar, Keerthi Ram, Mohanasankar Sivaprakasam

机构 * Indian Institute of Technology Madras (IITM)(印度理工学院马德拉斯分校) Sudha Gopalakrishnan Brain Centre (SGBC), IITM(苏达·戈帕拉克里希南脑中心(SGBC),印度理工学院马德拉斯分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 本文提出AD-DAE框架,通过扩散自编码器在无配对纵向MRI数据中建模阿尔茨海默病进展,利用紧凑的潜在空间生成后续影像。

Comments Accepted in IEEE Journal of Biomedical and Health Informatics ( https://ieeexplore.ieee.org/document/11579738 )

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07711 2026-06-30 cs.CV cs.AI 83%

SSM Meets Video Diffusion Models: Efficient Long-Term Video Generation with Structured State Spaces

结构状态空间模型与视频扩散模型的结合:利用结构状态空间实现高效长时视频生成

Yuta Oshima, Shohei Taniguchi, Masahiro Suzuki, Yutaka Matsuo

机构 * The University of Tokyo(东京大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 本文提出利用结构状态空间模型作为视频扩散模型的时序特征提取器,以解决传统注意力层在生成长视频序列时的计算成本问题,实验表明结构状态空间模型在内存使用和性能上更具优势。

Comments Accepted as a workshop paper at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28922 2026-06-30 eess.IV 82%

Cross-Sensor SAR Data Generation Using Diffusion Models and Feature Migration

基于扩散模型和特征迁移的跨传感器SAR数据生成

Xuanting Wu, Fan Zhang, Fei Ma, Qiang Yin, Yongsheng Zhou

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

AI总结 提出融合稳定扩散模型与注意力蒸馏的框架,利用历史SAR数据生成适配新传感器特性的训练数据,缓解数据稀缺问题。

Journal ref Transactions of Nanjing University of Aeronautics and Astronautics, 2025, 42(4): 509-524

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25044 2026-06-30 cs.RO 82%

X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models

X-DiffVLA:面向视觉-语言-动作模型的跨具身扩散动作头

Boyu Li, Chaoyi Xu, Haoqi Yuan, Xinrun Xu, Börje F. Karlsson, Haoran Li, Zongqing Lu, Dongbin Zhao

机构 * SKL-MAIS, Institute of Automation, Chinese Academy of Sciences(SKL-MAIS,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) BeingBeyond School of Computer Science, Peking University(北京大学计算机学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对跨具身数据学习通用策略的挑战,提出X-DiffVLA模型,通过扩散模型和具身强制技术实现异构末端执行器间的知识迁移,在RoboCasa和Isaac Gym上分别提升15.3%和12.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29095 2026-06-30 cs.CV cs.GR cs.LG 81%

HorizonRelight: Relighting Long-horizon Videos Consistently via Diffusion Transformers

HorizonRelight: 通过扩散变换器一致地重照明长时域视频

Jing Yang, Mayoore Jaiswal, Zian Wang, Steven Zeng, Rochelle Pereira, Yajie Zhao, Jianyuan Min

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 针对长视频重照明中的时间不连续问题,提出基于扩散变换器的框架,通过掩码目标域自条件化和热启动提示实现跨块一致重照明,显著提升时间一致性。

Comments https://research.nvidia.com/labs/sil/projects/horizonrelight/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30642 2026-06-30 cs.SD cs.AI 80%

LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training

LeVo 2:通过层次表示建模和渐进式后训练实现稳定悦耳的歌曲生成

Shun Lei, Huaicheng Zhang, Dapeng Wu, Yaoxun Xu, Lishi Zuo, Wei Tan, Hangting Chen, Guangzheng Li, Jianwei Yu, Zhiyong Wu, Dong Yu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Tencent(腾讯) Wuhan University(武汉大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 扩散模型 :diffusion(summary_cn,abstract)

AI总结 提出LeVo 2混合LLM-Diffusion框架,通过层次化建模(先预测混合令牌进行语义规划,再并行预测人声和伴奏令牌)解决全曲生成中协调性与细节保真度的权衡,并引入美学引导训练策略,在主观和客观指标上超越开源基线,接近商业系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30417 2026-06-30 cs.CV cs.AI 79%

Beyond Point Estimates for Glaucoma Visual Field Forecasting with Diffusion Models

超越点估计:基于扩散模型的青光眼视野预测

Marta Colmenar Herrera, Pablo Márquez Neila, Şerife Seda Kucur Ergünay, Martin S. Zinkernagel, Raphael Sznitman

机构 * ARTORG Center for Biomedical Engineering Research, UniBe, Switzerland(瑞士UniBe生物医学工程研究中心ARTORG) PeriVision SA, Epalinges, Switzerland(瑞士Epalinges市PeriVision公司) Department of Ophthalmology, Inselspital, Bern, Switzerland(瑞士伯恩Inselspital眼科部门)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出使用条件去噪扩散模型进行概率性视野预测,生成未来视野的分布,实现校准良好的预测,并在点估计上达到最先进精度,支持从点估计向不确定性感知的临床风险评估转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30012 2026-06-30 cs.CV 79%

SkelEM: Training-Signal Decoupling of Skeleton and Diffusion for Self-supervised Axial Super-Resolution in Volume Microscopy

SkelEM:用于体积显微镜中自监督轴向超分辨率的骨架与扩散训练信号解耦

Bohao Chen, Yanchao Zhang, Yanan Lv, Chenxun Deng, Hua Han, Xi Chen

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences, China(中国科学院大学先进交叉学科学院) State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Institute of Automation, Chinese Academy of Sciences, China(中国科学院脑认知与脑启发智能技术国家重点实验室) School of Future Technology, University of Chinese Academy of Sciences, China(中国科学院大学未来技术学院) School of Artificial Intelligence, University of Chinese Academy of Sciences, China(中国科学院大学人工智能学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出SkelEM框架,通过解耦低频拓扑与高频细节的训练信号,结合确定性骨架与扩散精炼器,实现体积显微镜自监督轴向超分辨率,仅需≤5步即可恢复高保真细节,并在新基准BRAVE-ASR上取得最优平衡。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29387 2026-06-30 cs.GR cs.NA math.NA 79%

Dipole Diffusion Error in Thin Geometry: Optical Thickness Laws for Grid-Free Subsurface Scattering

薄几何中的偶极子扩散误差:无网格次表面散射的光学厚度定律

Faruk Alpay, Baris Basaran

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

AI总结 针对偶极子模型在薄和弯曲物体上的几何误差,通过有限板多极子对比发现漫反射率误差具有材料无关的主导率$C e^{-2τ}$,透射率主导衰减为$e^{-τ}$,并利用Walk on Spheres方法直接求解扩散方程,无需网格或半空间近似。

Comments 22 pages, 13 figures, 1 table. Ancillary files include the full reproduction code (Python/NumPy CPU reference and Apple Metal GPU kernels) and all result data

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29360 2026-06-30 cs.CV 79%

SAFE-DiT: Semantics-Aware Fast-path Execution for High-Resolution Diffusion Transformers

SAFE-DiT:面向高分辨率扩散Transformer的语义感知快速路径执行

Xuanhua Yin, Yuxuan Jia, Chuanzhi Xu, Weidong Cai

机构 * School of Computer Science, The University of Sydney(悉尼大学计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对高分辨率扩散Transformer推理中的空间冗余导致注意力掩码引发性能瓶颈(MIDT),提出无训练框架SAFE-DiT,通过分离精确掩码消除与近似空间调度,实现2.69-5.09倍加速并降低内存占用,同时保持视觉质量。

Comments 20 pages, 12 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29319 2026-06-30 cs.CV 79%

FDM-MFVT: Few-step Sampling Diffusion Model for Mask-Free Virtual Try-On

FDM-MFVT: 用于无掩模虚拟试穿的少步采样扩散模型

Jiaxin Liu, Xiaoye Liang, Lai Jiang, Mai Xu, Jun Liu

机构 * School of Electronic Information Engineering, Beihang University, Beijing, China(北京航空航天大学电子信息工程学院) Zhongguancun Academy, Beijing, China(中关村学院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出FDM-MFVT,一种少步扩散模型,通过噪声优化模块和指令驱动模块实现高效无掩模虚拟试穿,并构建了3万对的无掩模数据集MFVT。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28785 2026-06-30 cs.CV 79%

Stochastic Optimal Control Sampling for Diffusion Inverse Problems

扩散逆问题的随机最优控制采样

Jie Zhang, Youmei Qiu, Hanling Tian, Jingyuan Zhang, Xiang Yin, Xiaolin Huang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, China(上海交通大学自动化与智能感知学院,上海,中国) Shanghai Key Laboratory of Flexible Medical Robotics, Tongren Hospital, Institute of Medical Robotics, Shanghai Jiao Tong University, Shanghai, China(上海柔性医疗机器人重点实验室,同仁医院,医学机器人研究所,上海交通大学,上海,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出随机最优控制采样(SOCS),通过闭式控制更新在每一步将测量一致的干净预测拉回去噪流,以高效解决扩散逆问题,提升视觉保真度和定量性能。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28677 2026-06-30 cs.CV 79%

SATB-VR: Training Few-Step Video Restoration Diffusion Model using SNR-Aware Trajectory Blending

SATB-VR:使用信噪比感知轨迹混合训练少步视频恢复扩散模型

Haoran Bai, Xiaoxu Chen, Xiaoyu Liu, Zongsheng Yue, Sibin Deng, Wangmeng Zuo, Ying Chen

机构 * Alibaba Group(阿里巴巴集团) Harbin Institute of Technology(哈尔滨工业大学) Xi’an Jiaotong University(西安交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出SATB-VR少步视频恢复框架,通过辅助预测器跳过低信噪比步骤,并利用SNR感知轨迹混合策略解决训练-推理不一致,实现高效高质量恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17980 2026-06-30 cs.CV 79%

Learning to Balance: Decoupled Siamese Diffusion Transformer for Reference-Based Remote Sensing Image Super-Resolution

学习平衡:用于基于参考的遥感图像超分辨率的解耦孪生扩散变换器

Bin Luo, Runmin Dong, Zhaoyang Luo, Jinxiao Zhang, Jiyao Zhao, Fan Wei, Haohuan Fu

机构 * Tsinghua Shenzhen International Graduate School, Shenzhen, China(清华大学深圳国际研究生院) Sun Yat-sen University, Zhuhai, China(中山大学) National Supercomputing Center in Shenzhen, Shenzhen, China(深圳国家超算中心) Tsinghua University, Beijing, China(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DS-DiT解耦孪生扩散变换器,通过在注意力层面解耦低分辨率和参考信息交互,解决参考基于超分辨率中参考信息依赖过重和利用不足的问题,提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10629 2026-06-30 cs.CV 79%

Product-of-Gaussian-Mixture Diffusion Models for Joint Nonlinear MRI Reconstruction

基于高斯混合积的扩散模型用于联合非线性MRI重建

Laurenz Nagler, Martin Zach, Thomas Pock

机构 * Graz University of Technology(格拉茨技术大学) École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院) Biomedical Imaging Group and Center for Biomedical Imaging(生物医学成像组和生物医学成像中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出结合参数高效高斯混合积扩散模型与经典平滑先验的联合重建方法,提升MRI重建的效率和鲁棒性,同时改善去噪和图像重建效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17975 2026-06-30 cs.CV 79%

AHOY! Animatable Humans under Occlusion from YouTube Videos with Gaussian Splatting and Video Diffusion Priors

AHOY! 从YouTube视频中通过高斯点云和视频扩散先验构建可动画的遮挡人类

Aymen Mir, Riza Alp Guler, Xiangjun Tang, Peter Wonka, Gerard Pons-Moll

机构 * University of Tübingen(图宾根大学) Imperial College London(帝国理工学院) KAUST(阿卜杜拉国王科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出AHOY方法,通过高斯点云和视频扩散先验从真实视频中重建完整可动画3D人体,解决遮挡挑战,提出四点贡献:生成监督、两阶段架构、解耦策略、头身监督。

Comments ECCV 2026. Project page is available at https://miraymen.github.io/ahoy/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14526 2026-06-30 cs.CV 79%

LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion

LatSearch:基于潜在奖励的搜索以加速推理时间扩展在视频扩散中

Zengqun Zhao, Ziquan Liu, Yu Cao, Shaogang Gong, Zhensong Zhang, Jifei Song, Jiankang Deng, Ioannis Patras

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出LatSearch,通过潜在奖励引导的重采样和剪枝机制,提升视频扩散的推理效率和生成质量,验证其在VBench-2.0基准上的优越性。

Comments Accepted at ECCV 2026. Project page: see https://zengqunzhao.github.io/LatSearch

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20606 2026-06-30 cs.CV 79%

Probing and Leveraging Video Diffusion Transformer Features for Robust Point Tracking

探查并利用视频扩散变换器特征以实现稳健的点跟踪

Soowon Son, Honggyu An, Jisu Nam, Hyunah Ko, Chaehyun Kim, Dahyun Chung, Siyoon Jin, Jung Yi, Junhwa Hur, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能) Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文探讨了视频扩散变换器在点跟踪中的优势,提出DiTracker框架,通过整合视频DiT特征提升跟踪鲁棒性,实验证明其在挑战性场景下表现优异。

Comments Project Page: https://cvlab-kaist.github.io/DiTracker/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08505 2026-06-30 cs.CV 79%

Early Estimation of Language to Latent Alignment in Diffusion Models

扩散模型中语言到潜在对齐的早期估计

Vasco Ramos, Regev Cohen, Idan Szpektor, Joao Magalhaes

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出NoisyCLIP模型,通过噪声感知双塔结构实现扩散模型中语言与潜在对齐的早期评估,降低计算成本并提升语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30467 2026-06-30 stat.ML cs.LG 78%

Non-parametric recovery of causal diffusion mechanisms from steady-state observations

从稳态观测中非参数恢复因果扩散机制

Richard Schwank, Mathias Drton

机构 * School of Computation, Information and Technology, Technical University of Munich(计算、信息与技术学院,慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对连续时间因果扩散系统,提出从横截面数据非参数识别完整因果机制(漂移函数)的方法,证明在弱非爆炸条件下可识别,并给出核估计量及其一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30414 2026-06-30 cs.LG 78%

Diffusion Fine-tuning with Rewarded Moment Matching Distillation

基于奖励矩匹配蒸馏的扩散模型微调

Alexis Jacq, Guillaume Couairon, Valentin De Bortoli, Quentin Berthet, Arnaud Doucet, Romuald Elie

机构 * Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出奖励矩匹配蒸馏(RMMD)框架,同时蒸馏扩散模型并最大化奖励函数,通过在线策略训练和KL正则化实现高质量生成,在ImageNet上取得更优的FID-奖励权衡,并在气象预报模型GenCast上实现7.5倍加速且性能超越教师模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30103 2026-06-30 math.AP 78%

A lattice Boltzmann scheme with equilateral triangles for diffusion and acoustics

用于扩散和声学的等边三角形格子玻尔兹曼方案

Francois Dubois, Pierre Lallemand

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出基于等边三角形网格的D2T4格子玻尔兹曼方案,采用多松弛时间方法,通过考虑双点进行一致性分析,导出扩散和声学的等效偏微分方程,并在周期边界条件下验证收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30080 2026-06-30 math.PR 78%

Ergodicity of reflected stochastic reaction-diffusion equations driven by space-time white noise

时空白噪声驱动的反射随机反应扩散方程的遍历性

Shijie Shang, Jianliang Zhai, Tusheng Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究反射随机反应扩散方程在耗散条件下的不变测度存在唯一性和指数混合性,通过比较原理克服无Itô公式的困难。

详情

展开后加载摘要…

URL PDF HTML 收藏