Multimodal Action Diffusion for Robust End-to-End Autonomous Driving
多模态动作扩散用于鲁棒的端到端自动驾驶
机构 * Computer Vision Center (CVC)(计算机视觉中心) ; Universitat Autònoma de Barcelona (UAB)(巴塞罗那自治大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);end-to-end driving(abstract);分类 cs.CV
AI总结 提出动作扩散变换器(ADT),通过多模态动作建模和最近邻匹配,在闭环Bench2Drive基准上超越先前最优方法,同时延迟降低十倍。
Comments Preprint. June 1st, 2026. Corresponding author: Jorge Daniel Rodríguez-Vidal