2505.17779
2026-02-24
cs.CV
cs.LG
62%
U2-BENCH: Benchmarking Large Vision-Language Models on Ultrasound Understanding
U2-BENCH:在超声理解上评估大视觉-语言模型的基准测试
Anjie Le, Henan Liu, Yue Wang, Zhenyu Liu, Rongkun Zhu, Taohan Weng, Jinze Yu, Boyang Wang, Yalun Wu, Kaiwen Yan, Quanlin Sun, Meirui Jiang, Jialun Pei, Siya Liu, Haoyun Zheng, Zhoujun Li, Alison Noble, Jacques Souquet, Xiaoqing Guo, Manxi Lin, Hongcheng Guo
专题命中
医疗多模态
:diagnosis(abstract);分类 cs.CV、cs.LG
AI总结
U2-BENCH首次提出评估大视觉-语言模型在超声理解上的基准测试,涵盖分类、检测、回归和文本生成任务,评估23种最新模型,揭示其在图像分类上的优势及在空间推理和临床语言生成上的挑战。