Less is More: Lean yet Powerful Vision-Language Model for Autonomous Driving
少即是多:一种高效而强大的视觉-语言模型用于自动驾驶
机构 * School of Data Science, Fudan University Shanghai, China(复旦大学数据科学学院) ; Institute of Automation, Chinese Academy of Sciences Beijing, China(中国科学院自动化研究所)
AI总结 本研究提出Max-V1模型,通过端到端视觉-语言方法实现高效自动驾驶,取得nuScenes数据集上的显著性能提升。