Towards Responsible Multimodal Medical Reasoning via Context-Aligned Vision-Language Models
通过上下文对齐的视觉-语言模型实现负责任的多模态医疗推理
机构 * Salim Habib University(萨利姆·哈比卜大学) ; Institute of Business Administration Sukkur(苏库尔工商管理学院) ; University of Central Florida(中佛罗里达大学) ; The University of Texas MD Anderson Cancer Center(德克萨斯大学MD安德森癌症中心) ; Toronto Metropolitan University(多伦多都会大学) ; Vector Institute(向量研究所)
专题命中 幻觉与事实性 :alignment(abstract);safety(abstract)
AI总结 本文提出一种上下文对齐的框架,通过整合多种临床证据提升医疗多模态推理的可靠性与可信度,实验显示其在胸部X光数据集上提升了判别性能并减少幻觉关键词。