Visual Instruction-Finetuned Language Model for Versatile Brain MR Image Tasks
面向多样化脑部MRI任务的视觉指令微调语言模型
机构 * Sungkyunkwan University(成均馆大学) ; Department of Electrical and Computer Engineering(电气与计算机工程系) ; Department of Artificial Intelligence(人工智能系)
专题命中 医疗多模态 :MRI(abstract);分类 cs.CV
AI总结 本文提出LLaBIT模型,通过视觉指令微调提升语言模型在脑部MRI任务中的表现,通过特征图重用和文本数据生成提升性能,验证了其在报告生成、视觉问答、图像分割和图像翻译中的有效性。
Comments ICPR 2026 accepted