TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
TemMed-Bench:评估视觉语言模型的时序医学图像推理能力
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 视觉问答 :vision-language model(title,abstract);分类 cs.CV
AI总结 本文提出TemMed-Bench时序医学图像推理基准,评估12个视觉语言模型,发现多数模型缺乏分析患者状况时序变化的能力,多模态检索扩充可显著提升其性能。