DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale
DVGT-2:面向大规模自动驾驶的视觉-几何-动作模型
机构 * Tsinghua University(清华大学) ; Xiaomi EV(小米电动车) ; University of Macau(澳门大学) ; Peking University(北京大学)
专题命中 仿真评测 :autonomous driving(title,abstract);trajectory planning(abstract);分类 cs.RO、cs.CV、cs.AI
AI总结 本文提出VGA范式,通过密集3D几何信息提升自动驾驶决策,引入DVGT-2实现在线处理,结合时间因果注意力和滑动窗口策略,提升效率与重建性能。
Comments Code is available at https://github.com/wzzheng/DVGT