arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-07-20 至 2026-07-20 共收录 20 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 3 篇

2607.15620 2026-07-20 cs.RO cs.AI 新提交 62%

AEGIS: Assay-Aware Protocol Validation and Runtime Monitoring for Open-Source Liquid Handling Robots

AEGIS:用于开源液体处理机器人的检测感知协议验证和运行时监测

Priyanka V. Setty, Arvind Ramanathan, Ian Foster, Rick Stevens

机构 * Data Science and Learning Division, Argonne National Laboratory(阿贡国家实验室数据科学与学习部) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 感知 :self-driving(abstract);分类 cs.RO、cs.AI

AI总结 研究开源液体处理机器人运行问题,提出AEGIS两层防护系统。一层结合检测规则库与大语言模型验证协议,二层用主成分分析模型监测运行轨迹,经实验验证有效,统一了检测感知验证与视觉监测,且开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16181 2026-07-20 cs.CV 新提交 57%

Vision-Language Assistant for Emotional Reactions to Risky Driving

用于对危险驾驶产生情感反应的视觉语言助手

Harine Choi, Eun Hak Lee, Zhengzhong Tu

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 研究针对现有自动驾驶视觉语言模型忽视情感维度与用户体验的问题,提出KYA系统。它由视觉模块(用YOLOv8变体检测危险行为并提取指标生成日志)和语言模块(依情感基调设置生成回应)组成,经实验评估表现良好,为车载人工智能带来新范式。

Comments Transportation Research Record. Advance online publication (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26477 2026-07-20 cs.LG 版本更新 50%

Variational Inference for Evidential Deep Learning

证据深度学习的变分推断

Jiawei Tang, Xinyan Du, Hui Liu, Junhui Hou, Yuheng Jia

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) School of Computing Information Sciences, Saint Francis University(圣弗朗西斯大学计算信息科学学院) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其交叉应用关键实验室(东南大学),中华人民共和国教育部,中国)

专题命中 感知 :autonomous driving(abstract)

AI总结 针对传统证据深度学习(EDL)中KL惩罚项导致证据过高和参数设置缺乏理论保证的问题,提出基于变分推断的VI-EDL框架,通过推导证据下界(ELBO)抑制证据过度增长,并建立泛化界理论,在视觉和医学数据集上实现最先进的分布外检测、噪声检测和自动驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 5 篇

2512.13636 2026-07-20 cs.CV cs.RO 版本更新 81%

MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning

MindDrive: 一种通过在线强化学习实现自动驾驶的视觉-语言-动作模型

Haoyu Fu, Diankun Zhang, Zongchuang Zhao, Jianfeng Cui, Hongwei Xie, Bing Wang, Guang Chen, Hangjun Ye, Dingkang Liang, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 MindDrive通过在线强化学习实现自动驾驶中的视觉-语言-动作模型,结合决策专家和动作专家,提升复杂场景下的驾驶决策与探索效率。

Comments Accepted by ECCV 2026; Project Page: https://xiaomi-mlab.github.io/MindDrive/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15969 2026-07-20 eess.SY cs.RO cs.SY 新提交 57%

Vessel Trajectory Prediction using COLREGs-aware Optimal Planning

使用COLREGs感知最优规划的船舶轨迹预测

David Kaikkonen, Fredrik Ljungberg, Erik Frisk

机构 * ABB Corporate Research(ABB企业研究部) Department of Electrical Engineering, Linköping University(Linköping大学电气工程系)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 研究船舶轨迹预测问题,核心方法是先利用A*搜索生成初始轨迹,再用数值优化器确保符合COLREG,以船舶当前位置、速度和目的地为输入,基于AIS数据验证,比基于学习的方法预测更快。

Comments 6 pages, 11 figures. This work has been accepted to IFAC2026 for publication under a Creative Commons Licence CC-BY-NC-ND

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00898 2026-07-20 cs.LG cs.RO 版本更新 57%

Dichotomous Diffusion Policy Optimization

二元扩散策略优化

Ruiming Liang, Yinan Zheng, Kexin Zheng, Tianyi Tan, Jianxiong Li, Liyuan Mao, Zhihao Wang, Guang Chen, Hangjun Ye, Jingjing Liu, Jinqiao Wang, Xianyuan Zhan

机构 * Fundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(基础模型研究中心,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Xiaomi EV(小米电动车)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO

AI总结 DIPOLE是一种新的RL算法,通过二元策略分解实现稳定可控的扩散策略优化,适用于复杂现实应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15697 2026-07-20 cs.SD cs.CR cs.LG 新提交 50%

SpeechGuard: Online Defense against Backdoor Attacks on Speech Recognition Models

SpeechGuard:针对语音识别模型后门攻击的在线防御

Jinwen Xin, Xixiang Lv

专题命中 规划控制 :autonomous driving(abstract)

AI总结 研究针对语音识别模型运行时的后门攻击,提出SpeechGuard在线防御管道,改进STRIP方法为S-STRIP检测过滤中毒样本,利用时频掩蔽等净化样本,经实验验证其能有效减轻后门威胁并维持预测准确率。

Comments 8 pages

Journal ref 2024 International Joint Conference on Neural Networks (IJCNN), pp. 1-8, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15862 2026-07-20 math.OC 新提交 50%

PriEco-DRL: Joint Optimization of Electric-Bus Eco-Driving and Transit-Priority Adaptive Signals via Deep Reinforcement Learning

PriEco-DRL:基于深度强化学习的电动公交生态驾驶与公交优先自适应信号联合优化

Dingshan Sun, Ang Li, Chaopeng Tan, Zicheng Su, Wanjing Ma, Marco Rinaldi

专题命中 规划控制 :occupancy(abstract)

AI总结 本文提出PriEco-DRL框架,运用深度强化学习将电动公交生态驾驶与公交优先自适应信号控制相结合,采用优先级加权最大压力控制器及结构化奖励,经集中训练和分散执行,实验表明其能降低电动公交能耗,实现能量-时间权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 2 篇

2607.15820 2026-07-20 cs.SE 新提交 78%

In the Driver's Seat: A Multi-Company Study on the Reality of Autonomous Driving System Testing

掌控全局:关于自动驾驶系统测试现状的多公司研究

Qunying Song, Yuan Gao, Johannes Betz, Dietmar Pfahl, Mohammad Reza Mousavi, Federica Sarro

专题命中 端到端驾驶 :autonomous driving(title,abstract)

AI总结 针对自动驾驶系统测试复杂且缺乏标准的问题,通过对九家公司专家访谈,经主题分析总结行业测试情况、挑战与趋势,提出以证据为中心的闭环测试框架,为ADS测试提供指导并指明未来方向。

Comments 34 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02851 2026-07-20 cs.RO 版本更新 57%

EmbodiedDiffusion: End-to-End Traversability-Guided Visual Diffusion for Heterogeneous Robot Navigation

EmbodiedDiffusion:用于异构机器人导航的端到端可通行性引导视觉扩散

Iana Zhura, Sausar Karaf, Faryal Batool, Nipun Dhananjaya Weerakkodi Mudalige, Valerii Serpiva, Ali Alridha Abdulkarim, Aleksey Fedoseev, Didar Seyidov, Hajira Amjad, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(智能空间机器人实验室,数字工程中心,斯克尔科沃科学与技术研究所)

专题命中 端到端驾驶 :trajectory planning(abstract);分类 cs.RO

AI总结 针对自主导航中视觉可通行性估计问题,EmbodiedDiffusion框架利用无规划器合成监督等,同时预测可通行性地图与生成可行轨迹,经训练提炼语义到轻量级模型,能快速适应新平台,在多机器人室内环境中实现高效导航与轨迹生成。

Comments This work has been submitted for publication and is currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 4 篇

2510.08151 2026-07-20 stat.AP q-bio.PE q-bio.QM 版本更新 78%

Evaluating multi-season occupancy models with autocorrelation fitted to heterogeneous datasets

评估拟合异构数据集的具有自相关的多季节占用模型

André Luís Luza, Didier Alard, Frédéric Barraquand

专题命中 BEV与占用 :occupancy(title,abstract)

AI总结 研究受异构蝴蝶占用数据集启发,评估含时空随机效应的多季节占用模型,发现其对异构数据和协变量重叠有鲁棒性,但存在可识别性问题,受数据间隙挑战,即使数据丰富地区也受影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15713 2026-07-20 eess.SP cs.AI cs.LG 新提交 57%

Map as a Prompt: Learning Multi-Modal Spatial-Signal Foundation Models for Cross-scenario Wireless Localization

地图作为提示:学习用于跨场景无线定位的多模态空间信号基础模型

Yong Chu, Xun Zhou, Zenglin Xu, Hui Wang, Yue Yu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Shanghai Academy of AI for Science(上海人工智能科学研究院) Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.AI

AI总结 针对无线定位在不同环境中面临的挑战及现有方法的局限,提出多模态基础模型SigMap,通过循环自适应掩码策略和“地图即提示”框架学习无线表示并实现跨场景适应,实验证明其性能领先且零样本泛化能力强。

Comments 17pages, 9 figures, poster in International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15635 2026-07-20 cs.AI 57%

On inferring cumulative constraints

关于推断累积约束

Konstantin Sidorov

机构 * Faculty of Electrical Engineering, Mathematics & Computer Science(电气工程、数学与计算机科学系) Delft University of Technology(代尔夫特理工大学)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.AI

AI总结 该研究提出了一种预处理方法,通过推断额外的累积约束来捕捉多资源交互,从而提高调度问题的搜索性能和目标界限精度。

Comments 17 pages, 6 figures, 4 tables; submitted to the 32nd International Conference on Principles and Practice of Constraint Programming (CP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16592 2026-07-20 cs.RO 版本更新 57%

ContactFusion: Stochastic Poisson Surface Maps from Visual and Contact Sensing

ContactFusion:基于视觉和接触传感的随机泊松曲面地图

Aditya Kamireddypalli, Joao Moura, Russell Buchanan, Matias Mattamala, Sethu Vijayakumar, Subramanian Ramamoorthy

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学) Department of Mechanical and Mechatronics Engineering, University of Waterloo(机械与机电工程系,滑铁卢大学)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.RO

AI总结 研究针对机器人装配中场景理解噪声影响插入成功率的问题,提出ContactFusion方法,结合全局映射与局部接触信息,通过拒绝采样程序估计接触位置,将接触与视觉信息融合到SPSMap,验证了方法有效性并改善孔位估计。

Comments Version accepted to IROS2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 2 篇

2607.15889 2026-07-20 cs.CV 新提交 80%

Hardware-triggered Time Synchronization of Roadside Multi-lidar, Multi-camera Measurement System for Accurate Data Alignment

用于精确数据对齐的路边多激光雷达、多摄像头测量系统的硬件触发时间同步

Shiva Agrawal, Savankumar Bhanderi, Zhiran Yan, Gordon Elger

机构 * Technische Hochschule Ingolstadt(英戈尔施塔特技术大学)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 研究路边多激光雷达与多摄像头系统数据对齐问题,提出开源、简单、模块化的硬件触发时间同步电路,通过实验评估其对时空对齐的影响,实现跨传感器一致性最大化,为多传感器同步提供低成本可扩展方案。

Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC 2026). Code and hardware design: https://github.com/shiva-THI/hardware-trigger-time-sync-lidar-cameras

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16156 2026-07-20 cs.LG cs.SY eess.SY 新提交 78%

PRISA: Proactive Infrastructure LiDAR Framework for Intersection Safety Assessment

PRISA:用于交叉路口安全评估的主动式基础设施激光雷达框架

Tam Bang, Hussam Abubakr, Emiliano de la Garza Villarreal, Truc Phuong Nguyen, Austin Harris, Toru Hirano, Mina Sartipi, Yunfei Xu, Hoang H. Nguyen

机构 * University of Tennessee at Chattanooga(田纳西大学查塔努加分校)

专题命中 激光雷达 :LiDAR(title,abstract)

AI总结 研究针对城市交叉路口危险问题,提出PRISA框架,利用隐私保护、低光鲁棒的路边传感器,通过自动整理训练数据训练轨迹预测模型,进行连续运动预测和双重替代安全评估,经实验验证其在交叉路口安全监测方面具有实际可行性。

Comments Accepted for publication at the 2026 IEEE 29th International Conference on Intelligent Transportation Systems (ITSC 2026). 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 多传感器融合 1 篇

2607.16154 2026-07-20 cs.CV cs.SY eess.SY 新提交 79%

CLIFE: Camera-LiDAR Fusion Framework for Edge-Deployable Roadside VRU Perception

CLIFE:用于边缘可部署路边VRU感知的相机-激光雷达融合框架

Tam Bang, Hoang H. Nguyen, Lei Cheng, Lihao Guo, Siyang Cao, Hussam Abubakr, Tianya Zhang, Austin Harris, Mina Sartipi

专题命中 多传感器融合 :LiDAR(title,abstract);分类 cs.CV

AI总结 针对路边VRU感知难题,提出CLIFE框架,集成无目标在线校准与轻量级后期融合跟踪于单嵌入式设备,无需云卸载。经实验验证,该框架提升了传感器感知能力与鲁棒性,核心运行高效,为下游安全应用提供基础并减少相关开销。

Comments Accepted for publication at the 2026 IEEE 29th International Conference on Intelligent Transportation Systems (ITSC 2026). 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 仿真评测 1 篇

2607.15621 2026-07-20 cs.RO cs.AI 新提交 62%

Think at 5 Hz, Act at 20 Hz: Asynchronous Fast-Slow Vision-Language-Action Inference for Closed-Loop Driving

以5Hz思考,20Hz行动:用于闭环驾驶的异步快慢视觉-语言-动作推理

Yun Li, Jiachen Gong, Simon Thompson, Ehsan Javanmardi, Qunli Zhang, Zifan Zeng, Shiming Liu, Peng Wang, Zixuan Guo, Manabu Tsukada

机构 * The University of Tokyo(东京大学) TIER IV, Inc.(TIER IV公司) Huawei(华为)

专题命中 仿真评测 :end-to-end driving(abstract);分类 cs.RO、cs.AI

AI总结 研究针对大语言模型用于闭环驾驶时推理延迟与车辆控制速率冲突的问题,提出快慢架构,慢系统用冻结主干处理历史,快专家基于缓存和当前帧回归航路点,经训练在CARLA上提升路线完成率,降低误差且可零样本转移。

Comments 13 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 其他自动驾驶 2 篇

2607.15888 2026-07-20 cs.CY cs.HC 新提交 78%

Red Light, Grey Zone: A Multi-Perspective Interactive Narrative for Autonomous Driving Ethics

红灯,灰色地带:自动驾驶伦理的多视角交互式叙事

Mengyi Wei, Nianhua Liu, Chenyu Zuo, Liqiu Meng

专题命中 其他自动驾驶 :autonomous driving(title,abstract)

AI总结 研究自动驾驶伦理这一公共问题,提出多视角交互式叙事方法,通过“红灯,灰色地带”原型展开研究。经探索性用户研究发现,该方法能支持非专家对人工智能系统中的问责、证据和治理进行反思,尤其在责任判断等方面有积极效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03462 2026-07-20 cs.CR cs.NI 50%

Analyzing the Impact of Adversarial Attacks on C-V2X-Enabled Road Safety: An Age of Information Perspective

分析对抗攻击对C-V2X赋能道路安全的影响:信息年龄视角

Mahmudul Hassan Ashik, Moinul Hossain

专题命中 其他自动驾驶 :autonomous driving(abstract)

AI总结 本文提出了一种针对NR-V2X的资源饥饿攻击,通过降低SLRs导致自动驾驶安全风险,并利用信息年龄模型验证攻击影响。

Comments 6 pages, 5 figures, Accepted for publication at 2026 IEEE International Conference on Communications

Journal ref ICC 2026 - IEEE International Conference on Communications, Glasgow, United Kingdom, 2026, pp. 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏