Vision-Language-Action Models for Autonomous Driving: Past, Present, and Future
面向自动驾驶的视觉-语言-动作模型:过去、现在与未来
机构 * HKUST(香港科技大学) ; Zhejiang University(浙江大学) ; National University of Singapore(新加坡国立大学) ; HKUST(GZ)(香港科技大学(广州)) ; DAMO Academy, Alibaba(阿里巴巴达摩院) ; University of California, Los Angeles(加州大学洛杉矶分校) ; Xiaomi EV(小米电动车) ; Xi'an Jiaotong University(西安交通大学) ; Nanyang Technological University, Singapore(新加坡南洋理工大学)
专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO
AI总结 本文探讨了自动驾驶中视觉-语言-动作模型的发展历程,提出两种主要范式并分析其挑战与未来方向。
Comments Survey; 47 pages, 7 figures, 9 tables; GitHub Repo at https://github.com/worldbench/awesome-vla-for-ad