NeuroVLM-Bench: Evaluation of Vision-Enabled Large Language Models for Clinical Reasoning in Neurological Disorders
NeuroVLM-Bench:评估用于神经系统疾病临床推理的视觉增强大语言模型
专题命中 医学数据与评测 :MRI(abstract);CT(abstract);diagnosis(abstract);分类 cs.CV、cs.LG
AI总结 本文评估了视觉增强大语言模型在神经疾病临床推理中的性能,通过多模态模型在MRI和CT数据集上进行基准测试,发现影像属性基本解决,但诊断推理仍具挑战性。
Comments 53 pages, 12 figures. Manuscript submitted to the BMC Medical Informatics and Decision Making journal