VULCA-Bench: A Multicultural Vision-Language Benchmark for Evaluating Cultural Understanding
VULCA-Bench:一个多文化视觉-语言基准,用于评估文化理解
机构 * DJCAD, University of Dundee, United Kingdom(邓迪大学DJCAD部门) ; University of California, Santa Cruz, USA(加州大学圣克ruz分校) ; Analogy AI ; East China Normal University, China(华东师范大学) ; Nanjing University, China(南京大学) ; Department of Mechanical Engineering, School of Engineering, University of Birmingham(伯明翰大学工程学院机械工程系)
专题命中 视觉问答 :vision-language model(abstract);VLM(abstract);分类 cs.CV
AI总结 VULCA-Bench通过多文化艺术批评基准评估视觉-语言模型在文化理解上的能力,包含7,410对图像-批评对,涵盖八个文化传统,通过五层框架评估文化理解,揭示更高阶推理更具挑战性。
Comments 8 pages, 4 figures, submitted to ACL 2026 Dataset Track