What Matters to Enhance Traffic Rule Compliance of Imitation Learning for End-to-End Autonomous Driving
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments 14 pages, 3 figures
视觉与机器人
自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments 14 pages, 3 figures
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments ICLR 2024
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
专题命中 端到端驾驶 :end-to-end driving(title);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI
Comments project page: https://hao-shao.com/projects/lmdrive.html
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments Technical Report
专题命中 端到端驾驶 :end-to-end driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments Accepted at ICCV 2023. Camera ready version
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments This work has been accepted for publication in IEEE Transactions on Intelligent Vehicles. The published version can be accessed at https://ieeexplore.ieee.org/document/9802907 or https://doi.org/10.1109/TIV.2022.3185303
专题命中 端到端驾驶 :end-to-end driving(title,abstract);分类 cs.RO、cs.CV、cs.AI
Comments Conference submission 6 pages, 8 figures
CogAD: 认知层次引导的端到端自动驾驶
机构 * HAOMO.AI Technology Co., Ltd(HAOMO.AI技术有限公司)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 提出CogAD模型,通过全局到局部的层次感知和意图条件多模态轨迹生成,模拟人类驾驶员的认知层次机制,在nuScenes和Bench2Drive上实现端到端规划的最优性能,尤其在长尾场景和复杂真实驾驶条件下表现优异。
Comments CVPR2026 Workshop on Autonomous Driving
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
Comments The 3rd WACV Workshop on Large Language and Vision Models for Autonomous Driving (LLVM-AD) 2025
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.CV、cs.AI
Comments 9 pages, 3 figures, Accepted at CVPR 2024 Vision and Language for Autonomous Driving and Robotics Workshop
通过神经符号安全护卫实现端到端自动驾驶的引导
专题命中 端到端驾驶 :autonomous driving(title);end-to-end driving(abstract);分类 cs.RO、cs.AI
AI总结 该研究针对端到端驾驶智能体违反交通规则的问题,提出无需重训的神经符号安全护卫,在Fail2Drive和Bench2Drive基准上使成功率提15%、安全碰撞降53%且保留原驾驶分数。
多智能体具身自动驾驶:从V2X信息交换到共享世界模型
机构 * Lingnan University, Hong Kong(岭南大学(香港))
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 本文综述了从单车智能向多智能体具身系统转变的自动驾驶技术,通过共享世界模型实现感知共享、意图推断和协同规划,并指出了在仿真评估、实时安全保证等方面的研究空白。
HyWorldVLA:一种用于自动驾驶的具有混合世界建模的视觉-语言-动作模型
机构 * Automotive New Technology Research Institute, BYD Company Limited(比亚迪汽车新技术研究院)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.CV、cs.AI
AI总结 研究针对自动驾驶中视觉-语言-动作模型的不足,提出HyWorldVLA框架,统一像素级监督与潜在表征学习。预训练阶段预测视频潜在并重建帧,微调阶段预测潜在特征生成轨迹,实验表明其性能优于基线,还建立了世界模型噪声鲁棒性评估新基准。
Comments 20 pages with 13 figures
端到端自动驾驶中的训练后处理
机构 * Northeastern University(东北大学) ; Purdue University(普渡大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 探讨端到端自动驾驶中训练后处理技术,针对传统方法不足,将现有文献按监督形式分四类,阐述各分类的能力、局限与挑战,助力系统理解该领域并推动相关研究。
WCog-VLA:用于端到端自动驾驶的双级世界认知视觉-语言-行动模型
机构 * Tongji University(同济大学) ; Nanyang Technological University(南洋理工大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.CV、cs.AI
AI总结 针对现有视觉-语言-行动模型在自动驾驶中存在的局限,提出双级世界认知的WCog-VLA框架,语义层统一认知推理,生成层引入新模型加速推理,构建数据集,实验证明该模型在NAVSIM基准测试中达到最优分数。
Comments 20 pages, 7 figures
基于轨迹评分器的零人类示范端到端自动驾驶
机构 * Institute of Trustworthy Embodied AI(可信具身人工智能研究所) ; Fudan University(复旦大学) ; Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室) ; NVIDIA ; University of Michigan(密歇根大学) ; East China Normal University(华东师范大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 研究提出ZTRS,一种基于强化学习的端到端自动驾驶规划范式,仅依靠真实世界图像和规则奖励训练,无需人类示范。通过详尽策略优化,能更好推广到长尾驾驶场景,在相关数据集上展现出优于模仿学习方法的性能。
CritiqueDriveVLM:从验证器引导的强化学习到自动驾驶的潜在思想蒸馏
机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) ; School of Digital Media & Design Arts(数字媒体与设计艺术学院) ; Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.CV、cs.AI
AI总结 提出CritiqueDriveVLM框架解决自动驾驶中推理幻觉等问题,先通过验证器引导的强化学习培养强大教师模型,再用潜在思想蒸馏压缩能力到学生模型,提升性能并大幅降低推理延迟。
Comments Accepted by ECCV 2026
CLEAR:用于端到端自动驾驶的大规模闭环强化学习
机构 * Qualcomm AI Research(高通人工智能研究中心)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 研究端到端自动驾驶,针对现有基于视觉语言动作模型的策略多采用模仿学习致闭环规划性能欠佳的问题,提出CLEAR系统,用强化学习进行闭环训练,设计异构管道增加并行模拟环境数量,性能优于先前方法。
PriorEye: 用于端到端自动驾驶的地理空间视觉先验
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 提出地理空间视觉先验和双记忆架构,增强端到端自动驾驶的预见性和鲁棒性,在NAVSIM-v2上持续提升性能。
Comments Accepted to ECCV 2026
端到端的激光雷达深度强化学习用于作物行导航
机构 * University of São Paulo (USP)(圣保罗大学)
专题命中 端到端驾驶 :LiDAR(title,abstract);分类 cs.RO、cs.AI
AI总结 本文提出基于激光雷达的端到端导航系统,通过深度强化学习直接将3D激光雷达数据映射到控制指令,解决农业环境中GNSS不可靠、行内杂乱和光照变化的问题。
Comments Accepted to the 22nd International Conference on Advanced Robotics (ICAR 2025). 7 pages
Journal ref 22nd International Conference on Advanced Robotics (ICAR), 2025
SSIL: 用于端到端驾驶的自监督模仿学习
机构 * R & D Center, SL Corporation(SL公司研发中心) ; Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电子与计算机工程系) ; Department of Information and Communication Engineering, Handong Global University(翰林全球大学信息与通信工程系) ; College of Engineering, Texas A & M University-Corpus Christi(德克萨斯A&M大学科珀斯克里斯蒂分校工程学院) ; School of Computer Science and Electrical Engineering, Handong Global University(翰林全球大学计算机科学与电子工程学院)
专题命中 端到端驾驶 :end-to-end driving(title);autonomous driving(abstract);分类 cs.RO、cs.AI
AI总结 提出自监督模仿学习框架SSIL,利用车辆位姿生成伪转向角数据,无需驾驶命令或预训练模型,结合交叉注意力条件方法CACA,在三个基准数据集上达到与监督学习相当的驾驶精度。
Comments 8 pages, 4 figures
可解释深度学习提升人类对自动驾驶汽车的心理模型
机构 * Computer Science & Artificial Intelligence Laboratory (CSAIL), Massachusetts Institute of Technology(计算机科学与人工智能实验室(CSAIL),麻省理工学院) ; Motional AD Inc.(Motional AD公司) ; Department of Psychology and Center for Brain Science, Harvard University(心理学系和大脑科学中心,哈佛大学) ; Department of Aeronautics and Astronautics, Massachusetts Institute of Technology(航空与宇航系,麻省理工学院)
专题命中 端到端驾驶 :self-driving(title,abstract);分类 cs.RO、cs.AI
AI总结 提出概念包装网络(CW-Net),在真实自动驾驶车上实现可解释规划,通过因果性概念解释提升驾驶员对车辆行为的预测能力,尤其在意外场景中。
Comments MST & JAS contributed equally to this work
CoIRL-AD:面向自动驾驶的潜在世界模型中的协作-竞争模仿-强化学习
机构 * University of Science and Technology of China(中国科学技术大学) ; Tsinghua University(清华大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 提出CoIRL-AD框架,通过解耦模仿学习与强化学习、利用潜在世界模型进行长时程奖励估计以及引入竞争机制,在离线训练中提升自动驾驶的鲁棒性,尤其在跨城市泛化和长尾场景中表现优异。
Comments 19 pages, 22 figures, ICML 2026
CLEAR:端到端自动驾驶中的认知与潜在评估自适应路由
机构 * Qwen 3.5 0.8B
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.AI
AI总结 提出CLEAR框架,通过单步条件漂移替代扩散模型的多步去噪,结合视觉编码器Drive-JEPA和微调Qwen 3.5 0.8B进行语义推理,实现高效多模态规划,在NAVSIM v1上达到93.7 PDMS。
Safe2Drive: 评估端到端自动驾驶模型的安全驾驶行为
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Birla Institute of Technology and Science Pilani(比拉理工学院和科学帕利尼)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 针对端到端自动驾驶模型在常见安全关键场景中表现脆弱的问题,提出Safe2Drive测试集和安全驾驶评分(SDS),评估发现领先模型在安全场景中驾驶得分大幅下降且SDS较低。
Journal ref CVPR Workshops 2026
NTR:端到端驾驶中场景令牌瓶颈的神经令牌重建
机构 * National University of Singapore(新加坡国立大学) ; Black Sesame Technologies(黑 sesame 技术公司)
专题命中 端到端驾驶 :end-to-end driving(title);autonomous driving(abstract);分类 cs.RO、cs.CV
AI总结 针对端到端驾驶中场景令牌瓶颈缺乏视觉监督的问题,提出神经令牌重建(NTR)框架,通过自蒸馏掩码潜在重建约束场景令牌保留更丰富的视觉表示,实现最先进的驾驶性能。
用于优化自动驾驶延迟-准确性权衡的多分辨率端到端深度神经网络
机构 * University of Kansas Lawrence(堪萨斯大学劳伦斯分校)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.AI
AI总结 提出一种多分辨率端到端CNN,通过运行时选择输入分辨率和分辨率重定向,在延迟预算下优化自动驾驶的延迟-安全性权衡。
Comments ICCPS 2026
LVDrive: 基于潜在视觉表征的视觉-语言-动作自动驾驶模型
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Xiaomi EV(小米电动车)
专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.CV、cs.AI
AI总结 本文提出LVDrive,一种增强视觉-语言-动作能力的自动驾驶模型,通过引入未来场景预测任务,在高维潜在空间中学习语义丰富的场景表示,从而提升闭环驾驶性能。