arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-07-03 至 2026-07-03 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 语言条件控制 1 篇

2607.02222 2026-07-03 cs.RO cs.AI 新提交 62%

CoFL-S: Spatially Queryable Sector Flow Fields for Local Language-Conditioned Navigation

CoFL-S: 用于局部语言条件导航的空间可查询扇区流场

Haokun Liu, Zhaoqi Ma, Yicheng Chen, Wentao Zhang, Masaki Kitagawa, Zicen Xiong, Jinjie Li, Moju Zhao

机构 * Dragon Lab, Department of Mechanical Engineering, The University of Tokyo(龙实验室,机械工程系,东京大学)

专题命中 语言条件控制 :vision-language-action(abstract);分类 cs.RO、cs.AI

AI总结 提出CoFL-S,一种低层级视觉-语言-动作框架,通过预测机器人局部可见扇区上的语言条件流场并滚动生成连续轨迹,在连续时间Habitat基准测试中优于动作令牌和动作块基线,并实现零样本真实世界部署。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏