FRIEDA: Benchmarking Multi-Step Cartographic Reasoning in Vision-Language Models
FRIEDA:评估视觉语言模型中多步骤制图推理的基准
机构 * University of Minnesota-Twin Cities(明尼苏达大学双城分校) ; University of California, Davis(加州大学戴维斯分校) ; University of Southern California(南加州大学)
AI总结 FRIEDA 是一个评估视觉语言模型多步骤制图推理能力的基准,通过多步骤推理和跨地图定位测试,揭示了当前模型在空间智能方面的不足。
Comments Accepted to ICLR 2026