Vision-Language Model Based Multi-Expert Fusion for CT Image Classification
基于视觉-语言模型的多专家融合用于CT图像分类
机构 * College of Computer Science and Artificial Intelligence, Shanghai Key Laboratory of Intelligent Information Processing, Fudan University(复旦大学计算机科学与人工智能学院,上海智能信息处理重点实验室) ; University of Oxford(牛津大学) ; The Hong Kong University of Science and Technology(香港科技大学)
AI总结 本文提出一种三阶段源感知多专家框架,通过构建肺部感知3D专家、开发MedSigLIP基专家和训练源分类器,提升多源CT图像中新冠检测的鲁棒性,实验结果显示在不同阶段模型在宏F1、ACC和AUC指标上均取得优异成绩。