Calibrated Triage, Not Autonomy: Confidence Estimation for Medical Vision-Language Models
校准的分诊,而非自主:医学视觉-语言模型的置信度估计
机构 * Michigan State University(密歇根州立大学)
专题命中 医疗多模态 :pathology(abstract);radiology(abstract)
AI总结 针对医学视觉-语言模型在回答时可能忽略图像而依赖语言先验的问题,提出使用置信度估计进行校准分诊,通过评估七种置信度估计器,发现高置信度区域是区分可用估计器的关键,最佳探针可将错误率从41-45%降至1-4%,但无估计器在所有领域和模型中一致最优。