arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-05-04 至 2026-05-04 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 数据集与评测 1 篇

2605.00397 2026-05-04 cs.RO 74%

MiniVLA-Nav v1: A Multi-Scene Simulation Dataset for Language-Conditioned Robot Navigation

MiniVLA-Nav v1:一种多场景模拟数据集用于语言条件的机器人导航

Ali Al-Bustami, Jaerock Kwon

机构 * Department of Electrical and Computer Engineering, University of Michigan-Dearborn(密歇根大学迪尔伯恩分校电气与计算机工程系)

专题命中 数据集与评测 :language-conditioned robot(title);分类 cs.RO

AI总结 本文提出MiniVLA-Nav v1数据集,用于语言引导的物体接近导航任务,包含四个逼真环境,提供同步图像、深度图和分割掩码,支持多种评估分割。

Comments 9 pages, 12 figures, 7 tables. Dataset paper

详情

展开后加载摘要…

URL PDF HTML 收藏