arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-24 至 2026-04-24 共收录 47 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2604.21036 2026-04-24 cs.AI 75%

Who Defines Fairness? Target-Based Prompting for Demographic Representation in Generative Models

谁定义了公平性?面向生成模型的基于目标的提示方法用于人口特征表示

Marzia Binta Nizam, James Davis

机构 * University of California, Santa Cruz(加州大学圣克ruz分校)

专题命中 文生图 :diffusion(abstract,abstract_cn);text-to-image(abstract)

AI总结 本文提出一种轻量级框架,在推理阶段通过提示级干预减轻生成模型中的代表性偏见,允许用户选择多种公平性定义,通过审计目标符合度和肤色分布来评估公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21523 2026-04-24 cs.CV cs.CL 57%

Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models

看到并不等于相信:揭示评估者视觉-语言模型的盲区

Mohammed Safi Ur Rahman Khan, Sanjay Suryanarayanan, Tushar Anand, Mitesh M. Khapra

机构 * Nilekani Centre at AI4Bharat(AI4Bharat的Nilekani中心) Indian Institute of Technology Madras(印度理工学院马德拉斯分校) BITS Pilani, Hyderabad(海得拉巴 BITS学院)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 本文系统评估了评估者视觉-语言模型在I2T和T2I任务中的可靠性,通过引入针对性扰动测试其在对象幻觉、空间推理等关键错误维度上的检测能力,发现当前模型存在显著盲区。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 1 篇

2601.05127 2026-04-24 cs.GR 70%

LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization

LooseRoPE:基于内容的注意力操控用于语义和谐化

Etai Sella, Yoav Baron, Hadar Averbuch-Elor, Daniel Cohen-Or, Or Patashnik

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.GR

AI总结 本文提出LooseRoPE,通过松驰旋转位置编码实现无提示图像编辑,平衡对象身份保留与上下文融合,实现无缝合成。

Comments Accepted to SIGGRAPH 2026. Project Page: https://snap-research.github.io/LooseRoPE/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 41 篇

2604.21041 2026-04-24 cs.CV 88%

Projected Gradient Unlearning for Text-to-Image Diffusion Models: Defending Against Concept Revival Attacks

投影梯度遗忘用于文本到图像扩散模型:防御概念复活攻击

Aljalila Aladawi, Mohammed Talha Alam, Fakhri Karray

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫德尔·本·扎耶德人工智能大学) University of Waterloo(滑铁卢大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出投影梯度遗忘方法,用于消除扩散模型中 undesirable 的概念,通过构建核心梯度空间并投影梯度更新,有效防止后续微调恢复已删除的概念。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21289 2026-04-24 cs.CV 85%

AttDiff-GAN: A Hybrid Diffusion-GAN Framework for Facial Attribute Editing

AttDiff-GAN:一种用于面部属性编辑的混合扩散-生成对抗网络框架

Wenmin Huang, Weiqi Luo, Xiaochun Cao, Jiwu Huang

机构 * GuangDong Province Key Lab of Information Security Technology and School of Computer Science and Engineering(广东信息安全技术重点实验室和计算机科学与工程学院) School of Cyber Science and Technology, Shenzhen Campus(深圳校区网络科学与技术学院) Guangdong Laboratory of Machine Perception and Intelligent Computing, Faculty of Engineering(广东机器感知与智能计算实验室,工程学院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出AttDiff-GAN框架,结合GAN属性操控与扩散图像生成,通过特征级对抗学习和PriorMapper、RefineExtractor提升风格-属性对齐,实现更精确的面部属性编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21008 2026-04-24 cs.CV 85%

Linear Image Generation by Synthesizing Exposure Brackets

通过合成曝光快门生成线性图像

Yuekun Dai, Zhoutong Zhang, Shangchen Zhou, Nanxuan Zhao

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) Adobe NextCam Adobe Research(Adobe研究院)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出基于文本的线性图像生成方法,通过合成曝光快门序列生成高质量场景参考线性图像,保留完整动态范围,用于专业后期处理。

Comments accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20936 2026-04-24 cs.MM cs.CV cs.HC 81%

AttentionBender: Manipulating Cross-Attention in Video Diffusion Transformers as a Creative Probe

AttentionBender: 在视频扩散变换器中操纵交叉注意力作为创造性探测工具

Adam Cole, Mick Grierson

机构 * University of the Arts London(伦敦艺术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

AI总结 AttentionBender通过操纵视频扩散变换器中的交叉注意力,帮助艺术家探索黑箱视频生成的内部机制,揭示交叉注意力的高度交织特性,并产生新的美学效果。

Comments To appear in the Proceedings of the 2026 ACM Creativity and Cognition (C&C '26). 15 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04395 2026-04-24 cs.CV cs.MM 81%

BiTDiff: Fine-Grained 3D Conducting Motion Generation via BiMamba-Transformer Diffusion

BiTDiff:通过BiMamba-Transformer扩散实现细粒度3D导体运动生成

Tianzhi Jia, Kaixing Yang, Xiaole Yang, Xulong Tang, Ke Qiu, Shikui Wei, Yao Zhao

机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) Renmin University of China(中国人民大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

AI总结 本文提出BiTDiff框架,结合BiMamba-Transformer模型和扩散策略,解决3D导体运动生成中的数据和方法限制,构建了首个大规模CM-Data数据集,并实现高质量运动合成与训练自由的联合级运动编辑。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21592 2026-04-24 cs.CV 79%

Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers

Sculpt4D:通过稀疏注意力扩散变换器生成4D形状

Minghao Yin, Wenbo Hu, Jiale Xu, Ying Shan, Kai Han

机构 * The University of Hong Kong(香港大学) ARC Lab, Tencent PCG(腾讯PCG实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Sculpt4D通过在预训练的3D扩散变换器中集成高效时间建模,解决4D生成中的时间伪影和计算需求问题,实现高保真4D合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21518 2026-04-24 eess.IV cs.CV 79%

DiffNR: Diffusion-Enhanced Neural Representation Optimization for Sparse-View 3D Tomographic Reconstruction

DiffNR: 用于稀疏视图3D断层成像重建的扩散增强神经表示优化

Shiyan Su, Ruyi Zha, Danli Shi, Hongdong Li, Xuelian Cheng

机构 * Monash University(莫纳什大学) The Australian National University(澳大利亚国立大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffNR通过引入扩散先验改进神经表示优化,解决稀疏视图下CT成像的严重伪影问题,提升PSNR并保持高效优化。

Comments Accepted to AAAI 2026. Project page: https://ooonesevennn.github.io/DiffNR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21422 2026-04-24 cs.CV 79%

Pre-process for segmentation task with nonlinear diffusion filters

分割任务前的非线性扩散滤波预处理

Javier Sanguino, Carlos Platero, Olga Velasco

机构 * Health Science Technology Group, Technical University of Madrid(健康科学技术组,马德里技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出非线性扩散滤波用于分割前的预处理,设计新型扩散函数以实现清晰轮廓和无模糊边缘,证明滤波器满足尺度空间要求,通过半隐式方案高效生成分段常数图像。

Comments Manuscript from 2017, previously unpublished, 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21279 2026-04-24 cs.CV 79%

LatRef-Diff: Latent and Reference-Guided Diffusion for Facial Attribute Editing and Style Manipulation

LatRef-Diff: 基于潜在和参考引导的扩散模型用于面部属性编辑和风格操控

Wenmin Huang, Weiqi Luo, Xiaochun Cao, Jiwu Huang

机构 * GuangDong Province Key Lab of Information Security Technology and School of Computer Science and Engineering(广东信息安全技术重点实验室和计算机科学与工程学院) School of Cyber Science and Technology, Shenzhen Campus(深圳校区网络科学与技术学院) Guangdong Laboratory of Machine Perception and Intelligent Computing, Faculty of Engineering(广东机器感知与智能计算实验室,工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出LatRef-Diff,通过潜在和参考引导方法改进面部属性编辑和风格操控,解决传统扩散模型在属性控制和风格操控中的不足,采用风格代码和模块化设计提升精度和图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21221 2026-04-24 cs.CV cs.LG 79%

Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation

稀疏强制:用于实时自回归扩散视频生成的原生可训练稀疏注意力

Boxun Xu, Yuming Du, Zichang Liu, Siyu Yang, Ziyang Jiang, Siqi Yan, Rajasi Saha, Albert Pumarola, Wenchen Wang, Peng Li

机构 * Meta Superintelligence Labs(Meta超智能实验室) University of California, Santa Barbara(加州大学圣芭芭拉分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出稀疏强制方法,通过在训练和推理中提升长时程生成质量并降低解码延迟,采用可训练的原生稀疏机制和高效的GPU内核PBSA来加速稀疏注意力和内存更新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17656 2026-04-24 cs.SD cs.AI cs.CL cs.CV cs.LG 79%

Video-Robin: Autoregressive Diffusion Planning for Intent-Grounded Video-to-Music Generation

Video-Robin:基于意图的视频到音乐生成的自回归扩散规划

Vaibhavi Lokegaonkar, Aryan Vijay Bhosale, Vishnu Raj, Gouthaman KV, Ramani Duraiswami, Lie Lu, Sreyan Ghosh, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学College Park分校) Dolby Laboratories(杜比实验室) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Video-Robin通过结合自回归规划与扩散合成,实现高质量的语义对齐音乐生成,相比传统方法在速度和质量上均有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18457 2026-04-24 cs.CV cs.LG 79%

VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models

VFM-VAE:视觉基础模型可以作为潜在扩散模型的良好分词器

Tianci Bi, Xiaoyi Zhang, Yan Lu, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出VFM-VAE,利用冻结的视觉基础模型作为潜在扩散模型的分词器,通过设计新解码器提升图像重建能力,实现分词器与扩散模型的协同优化,提升训练效率与性能。

Comments Accepted at CVPR 2026. Code and models available at: https://github.com/tianciB/VFM-VAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13576 2026-04-24 eess.IV cs.CV 79%

Cross-Distribution Diffusion Priors-Driven Iterative Reconstruction for Sparse-View CT

跨分布扩散先验驱动的稀疏视图CT迭代重建

Haodong Li, Shuo Han, Haiyang Mao, Yu Shi, Changsheng Fang, Jianjia Zhang, Weiwen Wu, Hengyong Yu

机构 * Department of Electrical and Computer Engineering, University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校电子与计算机工程系) School of Biomedical Engineering, Sun Yat-Sen University(中山大学生物医学工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CDPIR框架,通过整合跨分布扩散先验与模型驱动迭代重建方法,解决稀疏视图CT在分布外场景下的重建问题,提升图像质量与泛化能力。

Comments 17 pages, 15 figures, accepted by IEEE Transactions on Medical Imaging

Journal ref IEEE Transactions on Medical Imaging, 2026 (early access)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21267 2026-04-24 math-ph math.MP 78%

On invariant solutions of linear time-fractional diffusion-wave equations with variable coefficients

关于具有变量系数的时间分数扩散-波方程的不变解

Sodbaatar Adiya, Khongorzul Dorjgotov, Bayarmagnai Gombodorj, Hiroyuki Ochiai, Uuganbayar Zunderiya

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过李对称分析研究了具有变量系数的时间分数扩散-波方程的不变解,利用Mittag-Leffler函数、广义Wright函数和Fox H函数求得精确解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21210 2026-04-24 quant-ph cs.LG 78%

The Feedback Hamiltonian is the Score Function: A Diffusion-Model Framework for Quantum Trajectory Reversal

反馈哈密顿量是得分函数:一种用于量子轨迹反向的扩散模型框架

Sagar Dubey, Alan John

机构 * Stony Brook University(石溪大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过量子轨迹分布的路径概率函数导数证明反馈哈密顿量等于得分函数,揭示其与机器学习中基于得分的扩散模型的联系,并提出在多量子比特系统中应用机器学习方法估计得分。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21180 2026-04-24 physics.flu-dyn physics.ao-ph physics.comp-ph 78%

Uncertainty-Aware Spatiotemporal Super-Resolution Data Assimilation with Diffusion Models

具有扩散模型的不确定性感知时空超分辨率数据同化

Aditya Sai Pranith Ayapilla, Kazuya Miyashita, Yuki Yasuda, Ryo Onishi

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于扩散模型的DiffSRDA框架,通过低分辨率预报和稀疏观测生成高分辨率分析,实现高效且具有不确定性的时空超分辨率数据同化,优于传统方法。

Comments 35 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20984 2026-04-24 math.DS math.PR 78%

Graphon Limits of Graph Reaction--Diffusion Equations

图反应-扩散方程的图面容极限

Edith J. Zhang, James Scott, Qiang Du

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究图反应-扩散方程序列在图面容极限下的收敛性,揭示其非局部极限方程的解的收敛性质,并分析随机粒子过程的大数定律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20886 2026-04-24 physics.chem-ph cs.LG 78%

KinetiDiff: Docking-Guided Diffusion for De Novo ACVR1 Inhibitor Design in Fibrodysplasia Ossificans Progressiva

KinetiDiff:基于 docking 的扩散模型用于 Fibrodysplasia Ossificans Progressiva 中 ACVR1 抑制剂的 de novo 设计

Aaryan Patel

机构 * Saugus High School, Santa Clarita, CA(圣克拉拉, 加州, 桑吉斯高中)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 KinetiDiff 结合几何完整扩散模型与实时 AutoDock Vina 梯度指导,生成高亲和力 ACVR1 抑制剂,其最佳候选物 pKd 为 8.10,比晶体参考高 19.2%。

Comments 21 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20852 2026-04-24 cs.IR cs.AI 78%

DenoiseRank: Learning to Rank by Diffusion Models

DenoiseRank: 通过扩散模型学习排序

Ying Wang, Preslav Nakov, Shangsong Liang

机构 * Sun Yat-sen University(中山大学) MBZUAI(马克斯·普朗克研究所) Guangzhou, China(中国广州) Abu Dhabi, UAE(阿布扎赫德, UAE)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DenoiseRank,从生成视角解决学习排序问题,通过扩散过程噪声标签并反向去噪以预测分布,实验证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03700 2026-04-24 stat.ML cs.AI cs.LG math.ST stat.TH 78%

Generalization Properties of Score-matching Diffusion Models for Intrinsically Low-dimensional Data

分数匹配扩散模型在本质上低维数据中的泛化性质

Saptarshi Chakraborty, Quentin Berthet, Peter L. Bartlett

机构 * Department of Statistics, University of Michigan(密歇根大学统计学系) Google DeepMind(谷歌DeepMind) Department of Statistics, University of California, Berkeley(加州大学伯克利分校统计学系) Department of Electrical Engineering and Computer Sciences, UC Berkeley(加州大学伯克利分校电气工程与计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了分数匹配扩散模型在学习未知分布时的统计收敛性,得出了基于Wasserstein-p距离的有限样本误差界,并引入了(p,q)-Wasserstein维度概念,展示了扩散模型对数据内在几何的适应性及缓解维度灾难的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06428 2026-04-24 cs.LG 78%

BackPlay: Head-Only Look-Back Self-Correction for Diffusion Language Models

BackPlay:用于扩散语言模型的头部-only回溯自校正

Liming Liu, Binxuan Huang, Zixuan Zhang, Xin Liu, Bing Yin, Tuo Zhao

机构 * Amazon(亚马逊)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 BackPlay通过在冻结的生成器上训练轻量级校正头,改进多token解码下的生成质量,利用回溯校正机制减少错误积累。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04573 2026-04-24 cs.LG cs.AI cs.CL 78%

LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning

LaDiR:潜在扩散增强大语言模型进行文本推理

Haoqiang Kang, Yizhe Zhang, Nikki Lijing Kuang, Nicklas Majamaki, Navdeep Jaitly, Yi-An Ma, Lianhui Qin

机构 * University of California, San Diego(加州大学圣迭戈分校) Apple(苹果公司)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 LaDiR通过结合连续潜在表示的表达力与潜在扩散模型的迭代精炼能力,提升大语言模型在文本推理中的准确性、多样性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10842 2026-04-24 physics.space-ph astro-ph.EP physics.plasm-ph 78%

Observation of a Knotted Electron Diffusion Region in Earth's Magnetotail Reconnection

地球磁尾重联中一个结状电子扩散区的观测

Xinmin Li, Chuanfei Dong, Hantao Ji, Chi Zhang, Liang Wang, Barbara Giles, Hongyang Zhou, Rui Chen, Yi Qi

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究发现地球磁尾电流片中存在非共面的结状电子扩散区,揭示了三维效应及电子与离子扩散区在重联过程中的多尺度耦合复杂性。

Comments 27 pages and 4 figures

Journal ref Geophysical Research Letters,2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19336 2026-04-24 math.PR math.AP math.DG math.SP 78%

Functional Inequalities for doubly weighted Brownian Motion with Sticky-Reflecting Boundary Diffusion

双重加权布朗运动的函数不等式:具有粘性反射边界的扩散

Marie Bormann

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了具有粘性反射边界的流形上双重加权布朗运动的Poincaré和Logarithmic Sobolev常数上界,采用能量交互和加权Reilly公式进行插值分析,同时得到Steklov特征值和边界迹算子的上界。

Journal ref Potential Analysis, Vol. 64, Paper No. 47, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04823 2026-04-24 cs.CV 74%

Flow Matching for Conditional MRI-CT and CBCT-CT Image Synthesis

基于流匹配的条件MRI-CT和CBCT-CT图像合成

Arnela Hadzic, Simon Johannes Joham, Martin Urschler

机构 * Institute for Medical Informatics, Statistics and Documentation(医学信息学、统计学与文档研究所)

专题命中 扩散模型 :image synthesis(title);分类 cs.CV

AI总结 本文提出一种全3D流匹配框架,用于生成MRI或CBCT到CT的合成图像,通过轻量3D编码器提取输入特征,并在有限训练分辨率下实现全局结构重建,但细节能效有限。

Comments Published in the Proceedings of the Third Austrian Symposium on AI, Robotics, and Vision (AIRoV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21453 2026-04-24 cs.CV 57%

Instance-level Visual Active Tracking with Occlusion-Aware Planning

实例级视觉主动跟踪与遮挡感知规划

Haowei Sun, Kai Zhou, Hao Gao, Shiteng Zhang, Jinwu Hu, Xutao Wen, Qixiang Ye, Mingkui Tan

机构 * South China University of Technology(南方科技大学) Pazhou Laboratory(Pazhou实验室) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出OA-VAT方法,通过实例感知原型初始化、在线原型增强跟踪和遮挡感知轨迹规划模块,解决遮挡和相似干扰问题,实现高精度实时跟踪。

Comments CVPR 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21146 2026-04-24 cs.CV 57%

WFM: 3D Wavelet Flow Matching for Ultrafast Multi-Modal MRI Synthesis

WFM:用于超快速多模态MRI合成的3D小波流匹配

Yalcin Tur, Mihajlo Stojkovic, Ulas Bagci

机构 * Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Machine and Hybrid Intelligence Lab, Feinberg School of Medicine, Northwestern University(北western大学费因伯格医学院机器与混合智能实验室)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出WFM方法,通过学习基于小波空间条件均值的直接流,实现高效多模态MRI合成,单模型在BraTS 2024上达到26.8 dB PSNR和0.94 SSIM,速度比扩散模型快250-1000倍。

Comments 17 pages, 4 figures, 3 tables. Accepted at MIDL 2026 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏