Robusto-2: Benchmarking Humans & VLMs for Autonomous Driving in Lima & New York City
Robusto-2: 在利马与纽约市对自动驾驶中人类与VLM的基准测试
机构 * Artificio Lima, Peru
专题命中 其他自动驾驶 :autonomous driving(title);self-driving(abstract);分类 cs.RO、cs.CV、cs.AI
AI总结 本研究通过视觉问答范式,比较人类驾驶员(来自利马和纽约)与视觉语言模型在利马和纽约的驾驶场景中的表现,发现人类与模型在回答事实、评级、反事实和推理四类问题时存在差异,但地理因素影响不显著。
Comments 11 pages main body. 42 pages total. Data publicly available online