WildTableBench: Benchmarking Multimodal Foundation Models on Table Understanding In the Wild
WildTableBench:在真实场景中评估多模态基础模型的表格理解能力
机构 * The University of Queensland(昆士兰大学) ; Stanford University(斯坦福大学) ; The Australian National University(澳大利亚国立大学) ; Zhejiang University(浙江大学) ; Murdoch University(莫纳什大学) ; The University of Adelaide(阿德莱德大学)
专题命中 多模态评测 :multimodal(title,abstract);multimodal foundation model(title,abstract);分类 cs.CV
AI总结 提出WildTableBench基准,包含402张真实场景表格图像和928个问答对,评估21个前沿多模态模型,仅一个模型准确率超50%,揭示模型在结构感知和推理方面的持续弱点。