arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-06-01 至 2026-06-01 共收录 2 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 数据集与评测 2 篇

2605.31572 2026-06-01 cs.CV 81%

nuReasoning: A Reasoning-Centric Dataset and Benchmark for Long-Tail Autonomous Driving

nuReasoning:面向长尾自动驾驶的推理中心数据集与基准

Zhiyu Huang, Johnson Liu, Rui Song, Zewei Zhou, Ruining Yang, Yun Zhang, Tianhui Cai, Hanyin Zhang, Mingxuan Gao, Valeria Xu, Jiali Chen, Yishan Shen, Yiluan Guo, Tony, Qi, Jiaqi Ma

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Motional

专题命中 数据集与评测 :VLA(summary_cn,abstract);分类 cs.CV

AI总结 提出nuReasoning数据集,包含2万段20秒长尾驾驶场景的推理标注,支持空间、决策和反事实推理评估,并证明推理监督可提升VLM和VLA的驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15614 2026-06-01 cs.CL 50%

HypoSpace: A Diagnostic Benchmark for Set-Valued Hypothesis Generation under Underdetermination and Sublinear Coverage Bounds

HypoSpace: 欠定性与次线性覆盖边界下集合值假设生成的诊断基准

Tingting Chen, Beibei Lin, Zifeng Yuan, Qiran Zou, Hongyu He, Anirudh Goyal, Yew-Soon Ong, Dianbo Liu

机构 * National University of Singapore(国立新加坡大学) College of Computing(计算学院) Data Science(数据科学) Nanyang Technological University(南洋理工大学) Centre for Frontier AI Research (CFAR)(前沿人工智能研究中心 (CFAR)) Agency for Science, Technology and Research(科技研究局) Meta Superintelligence Labs(Meta超智能实验室)

专题命中 数据集与评测 :action model(abstract)

AI总结 提出HypoSpace基准,通过三个结构化领域评估大语言模型在欠定假设空间中的采样能力,发现模型在高有效性下存在覆盖失败,并展示分层解码可部分缓解该问题。

详情

展开后加载摘要…

URL PDF HTML 收藏