SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
SpatiaLQA: 一个评估视觉-语言模型空间逻辑推理能力的基准
Yuechen Xie, Xiaoyan Zhang, Yicheng Shan, Hao Zhu, Rui Tang, Rong Wei, Mingli Song, Yuanyu Wan, Jie Song
机构
*
Zhejiang University(浙江大学)
;
The University of Sydney(悉尼大学)
;
ManyCore
;
State Key Laboratory of Blockchain and Security, Zhejiang University(浙江大学区块链与安全国家重点实验室)
;
Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)
De-rendering, Reasoning, and Repairing Charts with Vision-Language Models
图表去渲染、推理与修复:基于视觉-语言模型
Valentin Bonas, Martin Sinnona, Viviana Siless, Emmanuel Iarussi
机构
*
Universidad Torcuato Di Tella(托克托迪特拉大学)
;
Consejo Nacional de Investigaciones Científicas y Técnicas(国家科学与技术研究理事会)
;
Facultad de Ciencias Exactas y Naturales Universidad de Buenos Aires(布宜诺斯艾利斯大学科学与自然学院)