Spatial-aware Vision Language Model for Autonomous Driving
面向自动驾驶的空间感知视觉语言模型
机构 * Motional ; University of Amsterdam(阿姆斯特丹大学)
专题命中 感知 :LiDAR(summary_cn,abstract);autonomous driving(title,abstract);分类 cs.CV
AI总结 提出LVLDrive框架,通过融合LiDAR点云与视觉语言模型,利用渐进融合Q-Former和空间感知问答数据集,解决3D度量空间推理瓶颈,提升自动驾驶场景理解与决策可靠性。
Comments Accepted to CVPR AutoPilot Workshop 2026