AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving
AutoDrive-R$^2$: 促进自动驾驶VLA模型的推理与自反思能力
机构 * AMAP, Alibaba Group(阿里集团AMAP) ; Sun Yat-sen University(中山大学) ; University of Queensland(昆士兰大学) ; Lanzhou University(兰州大学) ; Case Western Reserve University(凯斯西储大学)
专题命中 仿真评测 :autonomous driving(title,abstract);trajectory planning(abstract);分类 cs.RO、cs.CV
AI总结 本文提出AutoDrive-R$^2$框架,通过链式推理和强化学习提升自动驾驶VLA系统的推理与自反思能力,使用nuScenesR$^2$-6K数据集和GRPO算法实现高鲁棒性轨迹规划。