arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-06-15 至 2026-06-15 共收录 2 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 端到端驾驶 2 篇

2606.14010 2026-06-15 cs.CV cs.LG cs.RO 新提交 62%

RT-VLA: Real-Time Vision-Language-Action Models via Knowledge Distillation

RT-VLA:通过知识蒸馏实现实时视觉-语言-动作模型

Xiangyu Huang, Zhenlin Hua, Han Zhou, Shounak Sural, Ragunathan Rajkumar

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 端到端驾驶 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 提出RT-VLA,通过多级监督蒸馏将SimLingo模型的能力压缩至轻量学生模型,在保持竞争性能的同时将推理时间降低44.8倍(纯视觉模式)和7.9倍(视觉+语言模式),实现实时可解释的VLA自动驾驶。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03686 2026-06-15 cs.NI cs.AI cs.LG 版本更新 57%

Revisiting Outage for Edge Inference Systems

重新审视边缘推理系统的中断问题

Zhanwei Wang, Qunsong Zeng, Haotian Zheng, Kaibin Huang

机构 * Department of Electrical and Computer Engineering, The University of Hong Kong(香港大学电子与计算机工程系)

专题命中 端到端驾驶 :autonomous driving(abstract);分类 cs.AI

AI总结 针对边缘推理系统的端到端可靠性,提出推理中断概率框架,量化推理精度低于阈值的概率,并优化通信开销与推理可靠性的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏