Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation
迈向医学数据的视觉-语言基础模型:越南语PET/CT报告生成的多模态数据集和基准
机构 * AI4LIFE, Hanoi University of Science and Technology, Vietnam(AI4LIFE,河内科学技术大学,越南) ; Nagoya University, Japan(名古屋大学,日本) ; AIST, Japan(日本国家先进工业技术研究院) ; VinUniversity, Vietnam(文园大学,越南) ; NVIDIA, USA(NVIDIA,美国) ; Griffith University, Australia(格里菲斯大学,澳大利亚) ; Hanoi Medical University, Vietnam(河内医学院,越南) ; Military Central Hospital, Vietnam(越南108中央军医院)
专题命中 医学影像 :CT(title,title_cn);medical AI(abstract);分类 cs.CV
AI总结 本文提出了一种面向越南语医学数据的多模态数据集和基准,旨在解决医学影像领域中PET/CT数据不足和低资源语言代表性不足的问题。
Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Track on Datasets and Benchmarks