SurgXBench: Explainable Vision-Language Model Benchmark for Surgery
SurgXBench: 可解释的视觉-语言模型手术基准
机构 * Arizona State University(亚利桑那州立大学) ; Intel Labs(英特尔实验室) ; Duke University(杜克大学) ; University of Miami(迈阿密大学) ; University of California, Merced(加州大学默塞德分校)
专题命中 视觉推理 :VLM(summary_cn,abstract);vision-language model(title,abstract);分类 cs.CV
AI总结 针对手术视觉-语言模型(VLM)泛化能力不足的问题,提出SurgXBench基准,在零样本设置下评估多个先进VLM在器械与动作分类任务上的表现,并集成可解释AI分析模型注意力与因果解释,揭示模型依赖弱上下文线索而非临床相关证据的局限性。