LRR-Bench: Left, Right or Rotate? Vision-Language models Still Struggle With Spatial Understanding Tasks
LRR-Bench:左、右还是旋转?视觉-语言模型在空间理解任务上仍面临挑战
机构 * University of Electronic Science and Technology of China(电子科技大学) ; Drexel University(德雷塞尔大学) ; Tianyijiaotong Technology Ltd.(天奕交通技术有限公司)
专题命中 空间理解 :spatial understanding(title,abstract);分类 cs.CV
AI总结 LRR-Bench通过合成数据评估视觉-语言模型在空间理解任务上的性能,发现其在复杂任务上的表现远低于人类水平。