arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-07-20 至 2026-07-20 共收录 12 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 2 篇

2607.15620 2026-07-20 cs.RO cs.AI 新提交 62%

AEGIS: Assay-Aware Protocol Validation and Runtime Monitoring for Open-Source Liquid Handling Robots

AEGIS:用于开源液体处理机器人的检测感知协议验证和运行时监测

Priyanka V. Setty, Arvind Ramanathan, Ian Foster, Rick Stevens

机构 * Data Science and Learning Division, Argonne National Laboratory(阿贡国家实验室数据科学与学习部) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 感知 :self-driving(abstract);分类 cs.RO、cs.AI

AI总结 研究开源液体处理机器人运行问题,提出AEGIS两层防护系统。一层结合检测规则库与大语言模型验证协议,二层用主成分分析模型监测运行轨迹,经实验验证有效,统一了检测感知验证与视觉监测,且开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16181 2026-07-20 cs.CV 新提交 57%

Vision-Language Assistant for Emotional Reactions to Risky Driving

用于对危险驾驶产生情感反应的视觉语言助手

Harine Choi, Eun Hak Lee, Zhengzhong Tu

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 研究针对现有自动驾驶视觉语言模型忽视情感维度与用户体验的问题,提出KYA系统。它由视觉模块(用YOLOv8变体检测危险行为并提取指标生成日志)和语言模块(依情感基调设置生成回应)组成,经实验评估表现良好,为车载人工智能带来新范式。

Comments Transportation Research Record. Advance online publication (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 3 篇

2607.15969 2026-07-20 eess.SY cs.RO cs.SY 新提交 57%

Vessel Trajectory Prediction using COLREGs-aware Optimal Planning

使用COLREGs感知最优规划的船舶轨迹预测

David Kaikkonen, Fredrik Ljungberg, Erik Frisk

机构 * ABB Corporate Research(ABB企业研究部) Department of Electrical Engineering, Linköping University(Linköping大学电气工程系)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 研究船舶轨迹预测问题,核心方法是先利用A*搜索生成初始轨迹,再用数值优化器确保符合COLREG,以船舶当前位置、速度和目的地为输入,基于AIS数据验证,比基于学习的方法预测更快。

Comments 6 pages, 11 figures. This work has been accepted to IFAC2026 for publication under a Creative Commons Licence CC-BY-NC-ND

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15697 2026-07-20 cs.SD cs.CR cs.LG 新提交 50%

SpeechGuard: Online Defense against Backdoor Attacks on Speech Recognition Models

SpeechGuard:针对语音识别模型后门攻击的在线防御

Jinwen Xin, Xixiang Lv

专题命中 规划控制 :autonomous driving(abstract)

AI总结 研究针对语音识别模型运行时的后门攻击,提出SpeechGuard在线防御管道,改进STRIP方法为S-STRIP检测过滤中毒样本,利用时频掩蔽等净化样本,经实验验证其能有效减轻后门威胁并维持预测准确率。

Comments 8 pages

Journal ref 2024 International Joint Conference on Neural Networks (IJCNN), pp. 1-8, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15862 2026-07-20 math.OC 新提交 50%

PriEco-DRL: Joint Optimization of Electric-Bus Eco-Driving and Transit-Priority Adaptive Signals via Deep Reinforcement Learning

PriEco-DRL:基于深度强化学习的电动公交生态驾驶与公交优先自适应信号联合优化

Dingshan Sun, Ang Li, Chaopeng Tan, Zicheng Su, Wanjing Ma, Marco Rinaldi

专题命中 规划控制 :occupancy(abstract)

AI总结 本文提出PriEco-DRL框架,运用深度强化学习将电动公交生态驾驶与公交优先自适应信号控制相结合,采用优先级加权最大压力控制器及结构化奖励,经集中训练和分散执行,实验表明其能降低电动公交能耗,实现能量-时间权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2607.15820 2026-07-20 cs.SE 新提交 78%

In the Driver's Seat: A Multi-Company Study on the Reality of Autonomous Driving System Testing

掌控全局:关于自动驾驶系统测试现状的多公司研究

Qunying Song, Yuan Gao, Johannes Betz, Dietmar Pfahl, Mohammad Reza Mousavi, Federica Sarro

专题命中 端到端驾驶 :autonomous driving(title,abstract)

AI总结 针对自动驾驶系统测试复杂且缺乏标准的问题,通过对九家公司专家访谈,经主题分析总结行业测试情况、挑战与趋势,提出以证据为中心的闭环测试框架,为ADS测试提供指导并指明未来方向。

Comments 34 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 1 篇

2607.15713 2026-07-20 eess.SP cs.AI cs.LG 新提交 57%

Map as a Prompt: Learning Multi-Modal Spatial-Signal Foundation Models for Cross-scenario Wireless Localization

地图作为提示:学习用于跨场景无线定位的多模态空间信号基础模型

Yong Chu, Xun Zhou, Zenglin Xu, Hui Wang, Yue Yu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Shanghai Academy of AI for Science(上海人工智能科学研究院) Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.AI

AI总结 针对无线定位在不同环境中面临的挑战及现有方法的局限,提出多模态基础模型SigMap,通过循环自适应掩码策略和“地图即提示”框架学习无线表示并实现跨场景适应,实验证明其性能领先且零样本泛化能力强。

Comments 17pages, 9 figures, poster in International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 2 篇

2607.15889 2026-07-20 cs.CV 新提交 80%

Hardware-triggered Time Synchronization of Roadside Multi-lidar, Multi-camera Measurement System for Accurate Data Alignment

用于精确数据对齐的路边多激光雷达、多摄像头测量系统的硬件触发时间同步

Shiva Agrawal, Savankumar Bhanderi, Zhiran Yan, Gordon Elger

机构 * Technische Hochschule Ingolstadt(英戈尔施塔特技术大学)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 研究路边多激光雷达与多摄像头系统数据对齐问题,提出开源、简单、模块化的硬件触发时间同步电路,通过实验评估其对时空对齐的影响,实现跨传感器一致性最大化,为多传感器同步提供低成本可扩展方案。

Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC 2026). Code and hardware design: https://github.com/shiva-THI/hardware-trigger-time-sync-lidar-cameras

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16156 2026-07-20 cs.LG cs.SY eess.SY 新提交 78%

PRISA: Proactive Infrastructure LiDAR Framework for Intersection Safety Assessment

PRISA:用于交叉路口安全评估的主动式基础设施激光雷达框架

Tam Bang, Hussam Abubakr, Emiliano de la Garza Villarreal, Truc Phuong Nguyen, Austin Harris, Toru Hirano, Mina Sartipi, Yunfei Xu, Hoang H. Nguyen

机构 * University of Tennessee at Chattanooga(田纳西大学查塔努加分校)

专题命中 激光雷达 :LiDAR(title,abstract)

AI总结 研究针对城市交叉路口危险问题,提出PRISA框架,利用隐私保护、低光鲁棒的路边传感器,通过自动整理训练数据训练轨迹预测模型,进行连续运动预测和双重替代安全评估,经实验验证其在交叉路口安全监测方面具有实际可行性。

Comments Accepted for publication at the 2026 IEEE 29th International Conference on Intelligent Transportation Systems (ITSC 2026). 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 多传感器融合 1 篇

2607.16154 2026-07-20 cs.CV cs.SY eess.SY 新提交 79%

CLIFE: Camera-LiDAR Fusion Framework for Edge-Deployable Roadside VRU Perception

CLIFE:用于边缘可部署路边VRU感知的相机-激光雷达融合框架

Tam Bang, Hoang H. Nguyen, Lei Cheng, Lihao Guo, Siyang Cao, Hussam Abubakr, Tianya Zhang, Austin Harris, Mina Sartipi

专题命中 多传感器融合 :LiDAR(title,abstract);分类 cs.CV

AI总结 针对路边VRU感知难题,提出CLIFE框架,集成无目标在线校准与轻量级后期融合跟踪于单嵌入式设备,无需云卸载。经实验验证,该框架提升了传感器感知能力与鲁棒性,核心运行高效,为下游安全应用提供基础并减少相关开销。

Comments Accepted for publication at the 2026 IEEE 29th International Conference on Intelligent Transportation Systems (ITSC 2026). 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 仿真评测 1 篇

2607.15621 2026-07-20 cs.RO cs.AI 新提交 62%

Think at 5 Hz, Act at 20 Hz: Asynchronous Fast-Slow Vision-Language-Action Inference for Closed-Loop Driving

以5Hz思考,20Hz行动:用于闭环驾驶的异步快慢视觉-语言-动作推理

Yun Li, Jiachen Gong, Simon Thompson, Ehsan Javanmardi, Qunli Zhang, Zifan Zeng, Shiming Liu, Peng Wang, Zixuan Guo, Manabu Tsukada

机构 * The University of Tokyo(东京大学) TIER IV, Inc.(TIER IV公司) Huawei(华为)

专题命中 仿真评测 :end-to-end driving(abstract);分类 cs.RO、cs.AI

AI总结 研究针对大语言模型用于闭环驾驶时推理延迟与车辆控制速率冲突的问题,提出快慢架构,慢系统用冻结主干处理历史,快专家基于缓存和当前帧回归航路点,经训练在CARLA上提升路线完成率,降低误差且可零样本转移。

Comments 13 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 其他自动驾驶 1 篇

2607.15888 2026-07-20 cs.CY cs.HC 新提交 78%

Red Light, Grey Zone: A Multi-Perspective Interactive Narrative for Autonomous Driving Ethics

红灯,灰色地带:自动驾驶伦理的多视角交互式叙事

Mengyi Wei, Nianhua Liu, Chenyu Zuo, Liqiu Meng

专题命中 其他自动驾驶 :autonomous driving(title,abstract)

AI总结 研究自动驾驶伦理这一公共问题,提出多视角交互式叙事方法,通过“红灯,灰色地带”原型展开研究。经探索性用户研究发现,该方法能支持非专家对人工智能系统中的问责、证据和治理进行反思,尤其在责任判断等方面有积极效果。

详情

展开后加载摘要…

URL PDF HTML 收藏