arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-04-10 至 2026-04-10 共收录 4 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 端到端驾驶 4 篇

2604.08366 2026-04-10 cs.LG cs.AI cs.CV 81%

Scaling-Aware Data Selection for End-to-End Autonomous Driving Systems

面向端到端自动驾驶系统的缩放感知数据选择

Tolga Dimlioglu, Nadine Chang, Maying Shen, Rafid Mahmood, Jose M. Alvarez

机构 * New York University(纽约大学) NVIDIA(英伟达) University of Ottawa(渥太华大学)

专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出MOSAIC框架,通过分域、拟合神经缩放规律和迭代优化数据混合,提升自动驾驶模型在EPDMS指标上的性能,比基线模型减少80%的数据使用。

Comments Accepted to CVPR 2026, 8 pages of main body and 10 pages of appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18662 2026-04-10 cs.RO cs.CV 81%

Pseudo-Expert Regularized Offline RL for End-to-End Autonomous Driving in Photorealistic Closed-Loop Environments

伪专家正则化离线强化学习用于逼真闭环环境中的端到端自动驾驶

Chihiro Noguchi, Takaki Yamamoto

机构 * InfoTech, Toyota Motor Corporation(丰田汽车公司 InfoTech)

专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种基于摄像头的端到端离线强化学习框架,通过伪地面真实轨迹正则化提升自动驾驶安全性与效率,实验表明在nuScenes数据集上显著降低碰撞率并提高路线完成度。

Comments Accepted to CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08266 2026-04-10 cs.CV 57%

Orion-Lite: Distilling LLM Reasoning into Efficient Vision-Only Driving Models

Orion-Lite:将LLM推理能力蒸馏到高效视觉-only驾驶模型

Jing Gu, Niccolò Cavagnero, Gijs Dubbelman

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 端到端驾驶 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出Orion-Lite,通过潜特征蒸馏和真实轨迹监督,在闭环评估中实现高效视觉-only驾驶模型,超越大规模VLA模型ORION,达到Bench2Drive基准的80.6 Driving Score。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07991 2026-04-10 cs.CV cs.MM 57%

MotionScape: A Large-Scale Real-World Highly Dynamic UAV Video Dataset for World Models

MotionScape: 一个大规模真实世界高动态无人机视频数据集用于世界模型

Zile Guo, Zhan Chen, Enze Zhu, Kan Wei, Yongkang Zou, Xiaoxuan Liu, Lei Wang

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院) Jilin University(吉林大学)

专题命中 端到端驾驶 :autonomous driving(abstract);分类 cs.CV

AI总结 MotionScape提供高动态无人机视频数据,用于提升世界模型对复杂3D动态的模拟能力,通过语义和几何对齐的标注提升无人机自主导航与决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏