arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-07-23 至 2026-07-23 共收录 23 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 9 篇

2603.28029 2026-07-23 cs.CV cs.RO 版本更新 76%

Effort-Based Criticality Metrics for Evaluating 3D Perception Errors in Autonomous Driving

基于努力的临界度量指标用于评估自动驾驶中的3D感知误差

Sharang Kaul, Simon Bultmann, Mario Berk, Abhinav Valada

机构 * CARIAD SE University of Freiburg(弗莱堡大学)

专题命中 感知 :autonomous driving(title);分类 cs.RO、cs.CV

AI总结 本文提出基于努力的临界度量指标,通过FSR、MDR和LEA量化自动驾驶中3D感知误差的严重性,揭示非关键性误差占比高,验证新指标能捕捉安全关键信息。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20175 2026-07-23 cs.CV 新提交 74%

PerceptDrive: Perception Prior World-Action Modeling with Adaptive Expert Routing for End-to-End Autonomous Driving

PerceptDrive:用于端到端自动驾驶的具有自适应专家路由的感知先验世界-动作建模

Yushan Liu, Tianxiong Lv, Bohua Wang, Hangqi Fan, Chenxu Zhao, He Zheng, Xuchang Zhong, Yifan Xie, Congyang Zhao, Zhihao Liao, Leigang Luo, Yang Cai, Xiao-Ping Zhang, Wenbo Ding

机构 * Tsinghua University(清华大学) AMap, Alibaba Group(高德软件有限公司,阿里巴巴集团)

专题命中 感知 :autonomous driving(title);分类 cs.CV

AI总结 研究针对自动驾驶中感知基础模型的问题,提出PerceptDrive框架,将教师提炼先验和观察潜变量输入可训练模型,经特定分支处理、先验保留及场景条件路由,实验表明其性能领先,证实相关方法的有效性及对先验的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18348 2026-07-23 cs.RO cs.AI cs.LG 版本更新 73%

PGTT: Phase-Guided Terrain Traversal for Perceptive Legged Locomotion

PGTT:用于感知式有腿运动的相位引导地形遍历

Alexandros Ntagkas, Chairi Kiourt, Konstantinos Chatzilygeroudis

机构 * Laboratory of Automation and Robotics (LAR) in the Department of Electrical & Computer Engineering, University of Patras(自动化与机器人实验室(LAR)(电气与计算机工程系,帕特拉斯大学)) Archimedes/Athena RC, Greece(阿基米德/雅典娜RC,希腊) Athena - Research and Innovation Center in Information, Communication and Knowledge Technologies, Xanthi, Greece(雅典娜信息、通信和知识技术研究中心(Xanthi,希腊)) Computational Intelligence Laboratory (CILab), Department of Mathematics, University of Patras(计算智能实验室(CILab)(数学系,帕特拉斯大学))

专题命中 感知 :LiDAR(abstract,abstract_cn);分类 cs.RO、cs.AI

AI总结 研究针对有腿机器人感知强化学习控制器的不足,提出相位引导地形遍历(PGTT)方法,通过奖励塑造强化步态结构,编码腿相位等,在特定训练下,该方法在多种场景成功率高且速度跟踪可比,还能跨平台转移。

Comments 8 pages, 9 figures, 3 tables, Accepted at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19781 2026-07-23 cs.CV 新提交 70%

WASABI: Whole-graph Assignment-based Stabilizer for lAne topology By Inter-frame tracking

WASABI:基于帧间跟踪的车道拓扑全图分配稳定器

Tetsuhiro Uchida, Myu Sasaki, Kensho Nakajima, Yasuhiro Shimada, Toru Saito

专题命中 感知 :autonomous driving(abstract);BEV(abstract);分类 cs.CV

AI总结 研究针对自动驾驶中车道拓扑感知模型输出不稳定问题,提出WASABI实时后处理管道,通过联合跟踪车道段及其连通性,集成多种技术,在内部验证数据上提升了检测F1等指标,实现帧内和帧间车道拓扑稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20061 2026-07-23 cs.RO 新提交 57%

ReferTrack: Referring Then Tracking for Embodied Visual Tracking

ReferTrack:用于具身视觉跟踪的先指认后跟踪

Hanjing Ye, Tianle Zeng, Jiazhao Zhang, Shaoan Wang, Zibo Zhang, Weisi Situ, Yuchen Zhou, Yonggen Ling, Hong Zhang

机构 * SUSTech(南方科技大学) Tencent Robotics X(腾讯机器人X实验室) Peking University(北京大学) Futian Laboratory(福田实验室)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 研究针对具身视觉跟踪问题,提出ReferTrack先指认后跟踪范式,用单个摄像头,先选目标再解码跟踪航点,通过滑动窗口队列保留运动线索,经数据集协同训练增强识别,在EVT - Bench上达先进单视图性能并验证了迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19935 2026-07-23 cs.AI 新提交 57%

MOF-Sleuth: Tool-Grounded Reward Alignment for Explainable Fine-Grained MOF CIF Auditing

MOF-Sleuth:用于可解释细粒度MOF CIF审核的工具基础奖励对齐

Yu Liu, Zhiwei Yang, Diandian Guo, Kun Peng, Fangfang Yuan, Cong Cao, Chaozhuo Li, Zhiyuan Ma, Yanbing Liu, Guobin Zhao

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 研究针对MOF数据库CIF输入错误影响下游结果及人工检查的问题,提出MOF-Sleuth,通过强化引导CIF审核代理的两个模块,利用奖励引导强化学习将工具测量转化为监督,提升检测、归因及解释质量,在多基准测试中性能领先。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04122 2026-07-23 cs.CV 版本更新 57%

Contour Errors: Ego-Centric Matching for 3D Multi-Object Tracking Performance Evaluation

轮廓误差:用于 3D 多目标跟踪性能评估的自我中心匹配

Sharang Kaul, Simon Bultmann, Mario Berk, Abhinav Valada

机构 * CARIAD SE - Volkswagen Group(大众集团CARIAD分公司) Department of Computer Science, University of Freiburg(弗赖堡大学计算机科学系)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 研究自动驾驶 3D 多目标跟踪开环性能评估问题,提出基于豪斯多夫型推理的轮廓误差(CE)自我中心匹配标准,相比现有方法,CE 能提供分级方向敏感性,评估显示其可提高匹配率,是改善开环感知评估的主要因素。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12381 2026-07-23 quant-ph 版本更新 50%

Enhanced quantum illumination of a lossy target: A sequential interaction model

增强的损失性目标量子照明:一个顺序交互模型

Shilpi Srivastava, Shubhrangshu Dasgupta

专题命中 感知 :LiDAR(abstract)

AI总结 研究在现实环境中量子照明对损失性目标的有效性,比较高斯双模压缩态与最优经典协议的性能,发现TMSS在低反射率目标下具有更高的SNR和更强的抗热噪声能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09974 2026-07-23 math.OC cs.SY eess.SY 50%

Towards Resilient Tracking in Autonomous Vehicles: A Distributionally Robust Input and State Estimation Approach

面向自动驾驶车辆的鲁棒跟踪:一种分布鲁棒的输入和状态估计方法

Kasra Azizi, Kumar Anurag, Wenbin Wan

专题命中 感知 :autonomous driving(abstract)

AI总结 本文提出一种分布鲁棒的输入和状态估计方法,用于提高自动驾驶车辆在模型不确定性和测量异常情况下的鲁棒跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 4 篇

2607.19194 2026-07-23 cs.RO cs.CV 版本更新 81%

Cognitive Dual-Process Planning for Autonomous Driving with Structured Scene Knowledge and Verifiable Reasoning-Action Consistency

基于结构化场景知识和可验证推理-行动一致性的自动驾驶认知双过程规划

Zhongyao Yang, Haoyu Li, Yu Yan, Zhuangxuan Yu, Jiangfeng Nan, Jinrui Nan

机构 * School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院) National Engineering Research Center of Electric Vehicles, Beijing Institute of Technology(北京理工大学电动车辆国家工程研究中心) School of Mechanical Engineering, Southeast University(东南大学机械工程学院)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 研究自动驾驶高级规划问题,提出认知双过程规划框架,用S-CoT模式表示场景知识,通过自动数据引擎、视觉仲裁器及验证器实现自适应推理和规则验证,提升规划准确性、逻辑一致性并降低延迟,明确性能下降条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19650 2026-07-23 cs.RO cs.MA 新提交 79%

Remote ID Spoofing-Aware Trajectory Planning for Small Unmanned Aerial Systems

小型无人机系统的远程ID欺骗感知轨迹规划

Jeremiah Webb, Bryce Bjorkman, Abel Diaz Gonzalez, Austin Coursey, Noah Dahle, Kailani Lemieux Mack, Filippos Fotiadis, Gautam Biswas, Bryan C. Ward, Abenezer Taye

专题命中 规划控制 :trajectory planning(title,abstract);分类 cs.RO

AI总结 针对小型无人机在RID位置欺骗攻击下的轨迹规划问题,提出分散式欺骗感知框架,利用物理层观测评估广播可信度,检测定位欺骗代理,集成到规划器中,仿真显示可减少近空中碰撞事件且保持计算效率。

Comments 9 pages, 3 figures, to be published in IEEE DASC 2026 Conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13626 2026-07-23 eess.SY cs.RO cs.SY 版本更新 70%

Unifying Decision-Making and Trajectory-Planning in Unsignalized Intersections Using Time-Varying Potential Fields

使用时变势场统一无信号交叉口自动驾驶车辆的决策与轨迹规划

David Costa, Francesco Cerrito, Massimo Canale, Carlo Novara

机构 * Dipartimento di Elettronica e Telecomunicazioni, Politecnico di Torino(电子工程与电信学院,托斯卡纳理工学院) Dipartimento di Automatica e Informatica, Politecnico di Torino(自动化与信息学院,托斯卡纳理工学院)

专题命中 规划控制 :occupancy(abstract);trajectory planning(abstract);分类 cs.RO

AI总结 针对无信号交叉口自动驾驶车辆,提出用有限时域最优控制问题结合时变人工势场的新框架统一决策与轨迹规划,利用短视运动预测等考虑潜在碰撞,仿真验证了该方法可生成可行安全参考轨迹。

Comments Published in the "2026 34th Mediterranean Conference on Control and Automation (MED)". v2 adds the final IEEE citation and DOI; technical content unchanged

Journal ref 2026 34th Mediterranean Conference on Control and Automation (MED), Ancona, Italy, 2026, pp. 251-256

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19508 2026-07-23 cs.NI 新提交 50%

Scalable Multi-Controller Coordination in Periplus via Border-Switch Forwarding Graphs

通过边界交换转发图在Periplus中实现可扩展的多控制器协调

E. M. Castro Barbero, P. de las Heras Quirós, F. J. Simó Reigadas

专题命中 规划控制 :occupancy(abstract)

AI总结 研究带内SDN控制平面中多控制器协调问题,提出Periplus的多控制器协调平面,通过C-Adv消息发现邻居、构建路由,评估基于Ryu在Mininet中的实现,结果显示其可扩展性好、收敛快且无需修改交换机固件。

Comments 22 pages, 10 figures, 2 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2607.19774 2026-07-23 cs.RO 新提交 57%

Defer to Plan: Adaptive Multi-Agent Fusion for End-to-End V2X Driving

听从计划:用于端到端车路协同驾驶的自适应多智能体融合

Nuoran Li, Zhang Zhang, Yueran Zhao, Tianze Wang, Chao Sun

专题命中 端到端驾驶 :autonomous driving(abstract);分类 cs.RO

AI总结 研究车路协同辅助自动驾驶中现有方法不足,提出端到端协同驾驶系统,用MotionNetwork融合信息、注意力机制压缩特征、自回归解码器融合多智能体特征及引入MoE架构,提升驾驶分数并保持通信效率。

Comments Accepted at IEEE ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 5 篇

2603.06210 2026-07-23 cs.CV cs.RO 版本更新 84%

VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction

VG3S:基于视觉几何的高斯散射用于语义占用预测

Xiaoyang Yan, Muleilan Pei, Shaojie Shen

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 VG3S 通过引入视觉基础模型的几何 grounding 能力,提升语义占用预测的准确性与泛化能力。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19583 2026-07-23 math.PR 新提交 78%

Density-Dependent McKean--Vlasov Diffusions: Subgaussian Occupancy Bounds and Polynomial Propagation of Chaos

密度依赖的McKean-Vlasov扩散:次高斯占有界与混沌的多项式传播

Denis Belomestny, Ekaterina Morozova

专题命中 BEV与占用 :occupancy(title,abstract)

AI总结 研究密度依赖的McKean-Vlasov扩散及直方图粒子近似,在两个解析条件下用路径空间熵证明,得出相关占有界和误差估计,还介绍了直方图估计器的可扩展性及低评估成本。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19911 2026-07-23 cs.CV 新提交 57%

LoRFT: Benchmarking Long-Range Vehicle Trajectory Reconstruction from Fixed Highway Cameras

LoRFT:基于固定高速公路摄像头的长距离车辆轨迹重建基准测试

Yufan Zhu, Kefu Yi, Xueju Zhang, Yunyang Tian, Long Chen, Zixuan Xiao

机构 * School of Transportation, Changsha University of Science and Technology(长沙理工大学交通运输工程学院)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV

AI总结 研究针对从固定高速公路摄像头恢复长距离车辆轨迹的难题,提出Map-RSTNet模型,引入LoRFT基准测试。实验表明该模型能有效降低误差,证明道路几何感知重建的有效性,为长距离车辆轨迹重建提供了可重复测试平台。

Comments 17 pages, 5 figures. Code and processed annotations: https://github.com/YvfanZhu/LoRFT

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11605 2026-07-23 cs.NI 50%

Optimizing QoS in HD Map Updates: Cross-Layer Multi-Agent with Hierarchical and Independent Learning

在HD地图更新中优化服务质量:跨层多智能体与分层独立学习

Jeffrey Redondo, Nauman Aslam, Juan Zhang, Zhenhui Yuan

专题命中 BEV与占用 :LiDAR(abstract)

AI总结 本文提出了一种跨层多智能体方法,通过分层和独立学习优化HD地图更新的QoS,显著降低不同服务的延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03825 2026-07-23 cs.LG 版本更新 50%

The Geometry of Learning to Avoid Interventions

从紧急停止干预中学习鲁棒性干预

Ethan Pronovost, Khimya Khetarpal, Siddhartha Srinivasa

机构 * Paul G. Allen School of Computer Science \& Engineering, University of Washington, Seattle, USA Google DeepMind, Seattle, USA

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文提出残差干预微调算法,通过结合先验策略解决干预信号不明确的问题,实现鲁棒的策略改进。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 1 篇

2511.09089 2026-07-23 quant-ph physics.optics 78%

Inherently unpredictable beam steering for quantum LiDAR

固有不可预测的量子雷达光束定向

Junyeop Kim, Dongjin Lee, Woncheol Shin, Yeoulheon Seong, Heedeuk Shin

专题命中 激光雷达 :LiDAR(title,abstract)

AI总结 本研究提出了一种固有不可预测的量子雷达光束定向方法,通过光子对中的波长随机性实现不可预测的衍射方向,从而显著提升信号与噪声比,为量子增强传感开辟新途径。

Comments Main text (11 pages and 5 figures), Supplementary information (9 pages and 7 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 3 篇

2607.19701 2026-07-23 cs.CV 新提交 74%

SafeGen: Goal-Conditioned Video Diffusion of Safety-Critical Scenarios for VLM-Based Autonomous Driving

SafeGen:基于视觉语言模型的自动驾驶安全关键场景的目标条件视频扩散

Jiangfan Liu, Zexuan Cui, Tianyuan Zhang, Zonglei Jing, Zonghao Ying, Yaoyuan Zhang, Jiakai Wang, Xiaoqi Jiang, Aishan Liu, Xianglong Liu

机构 * Beihang University(北京航空航天大学) Zhongguancun Laboratory(中关村实验室) Chery Automobile Co., Ltd.(奇瑞汽车股份有限公司)

专题命中 仿真评测 :autonomous driving(title);分类 cs.CV

AI总结 研究针对VLM在自动驾驶系统中的应用,提出SafeGen框架,将场景生成设为目标条件扩散过程,引入上下文接地最终状态推理和最终状态条件下的视频演化,实验表明该框架能提升评判得分,微调后可提高真实驾驶场景性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19528 2026-07-23 cs.CV cs.AI 新提交 73%

D3VL: Understanding Driving Scenes from 3D Time Series Data and Video with Language Models

D3VL:利用语言模型从3D时间序列数据和视频中理解驾驶场景

Heesang Han, A. Lynn Abbott, Abhijit Sarkar

机构 * Bradley Department of Electrical and Computer Engineering, Virginia Tech(弗吉尼亚理工大学布拉德利电气与计算机工程系) Virginia Tech Transportation Institute(弗吉尼亚理工大学交通研究所) Sanghani Center for Artificial Intelligence and Data Analytics(桑哈尼人工智能与数据分析中心)

专题命中 仿真评测 :autonomous driving(abstract);LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 本文针对自动驾驶中多模态大语言模型,提出D3VL框架,整合2D和3D时间序列数据,回答交通场景相关问题,在KITTI问答数据集上性能提升11%,并引入Waymo QA数据集扩展以评估模型在多样驾驶条件下处理3D和时间序列数据的能力。

Comments Accepted to IEEE IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19502 2026-07-23 cs.IT cs.ET cs.SY eess.SY math.IT 新提交 50%

MC-BRIDGE: A Modular Receiver-Chain Simulation Framework for OECT-Based Molecular Communication

MC-BRIDGE:用于基于有机电化学晶体管的分子通信的模块化接收链仿真框架

Hongbin Ni, Ozgur B. Akan

专题命中 仿真评测 :occupancy(abstract)

AI总结 研究基于OECT的分子通信,提出MC-BRIDGE模块化框架,连接多种过程到电荷域检测,能生成噪声、支持多种键控,通过公共接口估计相关指标并分析干扰,经测试得出满足SER目标的预算上限,揭示多种因素对接收器结论的影响。

Comments 13 pages, 7 figures, submitted to IEEE Transactions on Molecular, Biological, and Multi-Scale Communications (TMBMC)

详情

展开后加载摘要…

URL PDF HTML 收藏