arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-04-24 至 2026-04-24 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 部署与泛化 1 篇

2604.21192 2026-04-24 cs.RO cs.AI 73%

How VLAs (Really) Work In Open-World Environments

视觉-语言-动作模型(VLAs)在开放世界环境中的实际运作方式

Amir Rasouli, Yangzheng Wu, Zhiyuan Li, Rui Heng Yang, Xuan Zhao, Charles Eret, Sajjad Pakdamansavoji

机构 * Noah’s Ark Laboratory, Huawei Technologies Canada(华为加拿大技术有限公司诺亚实验室)

专题命中 部署与泛化 :vision-language-action(abstract);action model(abstract);分类 cs.RO、cs.AI

AI总结 本文探讨了VLAs在开放世界环境中的实际运作,指出现有评估方法可能忽视安全性问题,并提出改进的评估协议以更准确衡量复杂交互场景中的性能。

Comments 8 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏