Benchmarking Multimodal Large Language Models for Scientific Visualization Literacy
用于科学可视化素养的多模态大语言模型基准测试
机构 * University of Notre Dame(圣母大学)
专题命中 文档图表理解 :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.AI
AI总结 研究对六个多模态大语言模型进行科学可视化素养基准测试,涵盖多种技术和任务类型。通过封闭世界协议评估闭源和开源模型,与人类参与者数据对比。发现模型表现不均,Gemini最强,开源模型低于人类基线,明确SciVis素养对评估多模态AI系统的必要性。