VolDiT: Controllable Volumetric Medical Image Synthesis with Diffusion Transformers
VolDiT:基于扩散变换器的可控体积医学图像合成
机构 * Institute for Artificial Intelligence in Cardiovascular Medicine, Medical Faculty of Heidelberg University, Heidelberg University(海德堡大学医学院心血管医学人工智能研究所) ; Department of Cardiology, Angiology, Pneumology, Heidelberg University Hospital(海德堡大学医院心脏病学、血管学、肺病学系) ; DZHK (German Centre for Cardiovascular Research), Partner Site Heidelberg/Mannheim(德国心血管研究中心(DZHK)海德堡/曼海姆合作站点) ; University Medical Center of the Johannes Gutenberg-University Mainz(美因茨约翰内斯·古腾堡大学医学中心)
专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV
AI总结 本文提出VolDiT,首个纯变压器架构的3D扩散模型,通过体积块嵌入和全局自注意力实现3D数据处理,引入时间步门控控制适配器提升生成可控性,实验证明其在医学图像合成中具有更高的全局一致性与生成保真度。