LVOmniBench: Pioneering Long Audio-Video Understanding Evaluation for Omnimodal LLMs
LVOmniBench:开创性长音频视频理解评估用于多模态大语言模型
机构 * Zhejiang University(浙江大学) ; Westlake University(西湖大学) ; Ant Group(蚂蚁集团) ; Shanghai Innovation Institute(上海创新研究院) ; Shanghai Jiao Tong University(上海交通大学) ; University of California Merced(加州大学默塞德分校)
专题命中 视频数据与评测 :video understanding(title);分类 cs.CV
AI总结 LVOmniBench旨在评估多模态大语言模型在长音频视频中的跨模态理解能力,通过275个10至90分钟的高质量视频和1014个问题-答案对,揭示当前模型在处理长形式输入时的挑战。
Comments Project page: https://kd-tao.github.io/LVOmniBench/