arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-03-11 至 2026-03-11 共收录 19 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 4 篇

2510.09035 2026-03-11 cs.CV cs.LG cs.RO 84%

Exploring Single Domain Generalization of LiDAR-based Semantic Segmentation under Imperfect Labels

探索基于LiDAR的语义分割在不完美标签下的单域泛化

Weitong Kong, Zichao Zeng, Di Wen, Jiale Wei, Kunyu Peng, June Moh Goo, Jan Boehm, Rainer Stiefelhagen

机构 * Institute for Anthropomatics and Robotics, Karlsruhe Institute of Technology(自动化与机器人研究所,卡尔斯鲁厄技术大学) Department of Civil, Environmental and Geomatic Engineering, University College London(土木、环境与地理工程系,伦敦大学学院)

专题命中 感知 :LiDAR(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 本文提出DuNe框架,通过双视图和置信度感知过滤,实现基于LiDAR的语义分割在噪声标签下的域泛化,取得SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03538 2026-03-11 cs.CV cs.AI 81%

SDR-GAIN: A High Real-Time Occluded Pedestrian Pose Completion Method for Autonomous Driving

SDR-GAIN: 一种用于自动驾驶的高实时遮挡行人姿态补全方法

Honghao Fu, Yongli Gu, Yidong Yan, Yilang Shen, Yiwen Wu, Libo Sun

机构 * School of Instrument Science and Engineering, Southeast University(仪器科学与工程学院,东南大学) School of Geospatial Engineering and Science, Sun Yat-sen University(地理信息工程与科学学院,中山大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 SDR-GAIN通过自监督对抗学习实现高实时遮挡行人姿态补全,提升自动驾驶系统鲁棒性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09320 2026-03-11 cs.CV cs.AI 62%

SpaceSense-Bench: A Large-Scale Multi-Modal Benchmark for Spacecraft Perception and Pose Estimation

SpaceSense-Bench: 一个大规模多模态基准用于航天器感知与姿态估计

Aodi Wu, Jianhong Zuo, Zeyuan Zhao, Xubo Luo, Ruisuo Wang, Xue Wan

机构 * University of Chinese Academy of Sciences(中国科学院大学) Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 SpaceSense-Bench通过大规模多模态数据集提升航天器感知与姿态估计的鲁棒性与准确性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07737 2026-03-11 cs.CV 57%

SpikeSMOKE: Spiking Neural Networks for Monocular 3D Object Detection with Cross-Scale Gated Coding

SpikeSMOKE:用于单目3D目标检测的脉冲神经网络与跨尺度门控编码

Xuemei Chen, Huamin Wang, Jing Peng, Hangchi Shen, Shukai Duan, Shiping Wen, Tingwen Huang

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 SpikeSMOKE通过跨尺度门控编码机制提升单目3D目标检测的低功耗性能,实现参数和计算量的显著减少

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 7 篇

2603.09482 2026-03-11 cs.RO 83%

StyleVLA: Driving Style-Aware Vision Language Action Model for Autonomous Driving

StyleVLA: 驾驶风格感知的视觉语言动作模型用于自动驾驶

Yuan Gao, Dengyuan Hua, Mattia Piccinini, Finn Rasmus Schäfer, Korbinian Moller, Lin Li, Johannes Betz

专题命中 规划控制 :autonomous driving(title,abstract);BEV(abstract);分类 cs.RO

AI总结 StyleVLA通过引入物理约束和混合损失,生成多样且物理合理的驾驶行为,优于现有专有和先进模型。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09961 2026-03-11 cs.RO cs.AI cs.CV 67%

BEACON: Language-Conditioned Navigation Affordance Prediction under Occlusion

BEACON: 语言条件下的遮挡区域导航可行性预测

Xinyu Gao, Gang Chen, Javier Alonso-Mora

机构 * Department of Cognitive Robotics (CoR), Delft University of Technology(认知机器人学系(CoR),代尔夫特理工大学)

专题命中 规划控制 :BEV(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 BEACON通过融合视觉语言模型与深度信息,提升遮挡区域导航可行性预测的准确性。

Comments 8 pages. Project page: https://xin-yu-gao.github.io/beacon

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09188 2026-03-11 cs.RO 57%

Robust Spatiotemporal Motion Planning for Multi-Agent Autonomous Racing via Topological Gap Identification and Accelerated MPC

多智能体自主赛车中鲁棒时空运动规划 via 拓扑间隙识别与加速MPC

Mingyi Zhang, Cheng Hu, Yiqin Wang, Haotong Qin, Hongye Su, Lei Xie

机构 * Department of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Center for Project-Based Learning, D-ITET, ETH Zurich(苏黎世联邦理工学院项目导向学习中心)

专题命中 规划控制 :occupancy(abstract);分类 cs.RO

AI总结 本文提出基于拓扑间隙识别与加速MPC的框架,通过预测对手行为和动态占用走廊,实现高速多智能体自主赛车中鲁棒的时空规划与高精度控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09163 2026-03-11 cs.RO 57%

SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation

SPAN-Nav: 通用空间感知用于多功能视觉-语言导航

Jiahang Liu, Tianyu Xu, Jiawei Chen, Lu Yue, Jiazhao Zhang, Zhiyong Wang, Minghan Li, Qisheng Zhao, Anqi Li, Qi Su, Zhizheng Zhang, He Wang

机构 * Peking University(北京大学) Galbot BAAI(北京人工智能研究院)

专题命中 规划控制 :occupancy(abstract);分类 cs.RO

AI总结 SPAN-Nav通过端到端模型和空间感知机制,在复杂环境中实现高效的视觉-语言导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07409 2026-03-11 eess.SY cs.LG cs.MA cs.RO cs.SY 57%

Learning responsibility allocations for multi-agent interactions: A differentiable optimization approach with control barrier functions

多智能体交互中的责任分配学习:一种基于可微优化与控制屏障函数的方法

Isaac Remy, David Fridovich-Keil, Karen Leung

机构 * University of Washington, Department of Aeronautics and Astronautics(华盛顿大学航空航天系) University of Texas, Austin, Department of Aerospace Engineering and Engineering Mechanics(得克萨斯大学奥斯汀分校航空航天工程与工程力学系) NVIDIA

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO

AI总结 本文提出一种基于控制屏障函数和可微优化的方法,用于学习多智能体交互中的责任分配,通过数据驱动的方式实现对安全交互行为的可解释性分析。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04359 2026-03-11 cs.AI cs.NE cs.SE 57%

Dance of the ADS: Orchestrating Failures through Historically-Informed Scenario Fuzzing

ADS的舞蹈:通过历史启发的场景模糊测试来编排故障

Tong Wang, Taotao Gu, Huan Deng, Hu Li, Xiaohui Kuang, Gang Zhao

机构 * Academy of Military Sciences(军事科学院)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.AI

AI总结 本文提出ScenarioFuzz方法,通过历史启发的场景模糊测试发现自动驾驶系统中的漏洞,提升安全性验证效率。

Comments This paper was accepted by 33rd ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2024)

Journal ref ISSTA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08831 2026-03-11 cs.RO cs.SY eess.SY 57%

Predictive Control with Indirect Adaptive Laws for Payload Transportation by Quadrupedal Robots

四足机器人负载运输的间接自适应律预测控制

Leila Amanzadeh, Taizoon Chunawala, Randall T. Fawcett, Alexander Leonessa, Kaveh Akbari Hamed

机构 * Department of Mechanical Engineering, Virginia Tech(机械工程系,弗吉尼亚理工学院)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 本文提出一种基于间接自适应律的预测控制框架,用于四足机器人在复杂地形中稳健运输未知负载。

Comments 8 pages, 6 figures. Published in IEEE Robotics and Automation Letters

Journal ref IEEE Robotics and Automation Letters, vol. 9, no. 11, pp. 10359-10366, Nov. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏

3. BEV与占用 3 篇

2603.09737 2026-03-11 cs.CV cs.RO eess.IV 89%

$M^2$-Occ: Resilient 3D Semantic Occupancy Prediction for Autonomous Driving with Incomplete Camera Inputs

$M^2$-Occ: 用于自动驾驶的不完整摄像机输入下的鲁棒3D语义占位预测

Kaixin Lin, Kunyu Peng, Di Wen, Yufan Chen, Ruiping Liu, Kailun Yang

机构 * School of Artificial Intelligence and Robotics and the National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University, China(湖南大学人工智能与机器人学院及机器人视觉感知与控制技术国家工程研究中心,中国) Institute for Anthropomatics and Robotics, Karlsruhe Institute of Technology, Germany(卡尔斯鲁厄理工学院人机学与机器人研究所,德国)

专题命中 BEV与占用 :autonomous driving(title,abstract);occupancy(title,abstract);分类 cs.RO、cs.CV、eess.IV

AI总结 $M^2$-Occ通过多视图遮蔽重建和特征记忆模块,在不完整摄像机输入下提升自动驾驶的3D语义占位预测鲁棒性。

Comments The source code will be publicly released at https://github.com/qixi7up/M2-Occ

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01133 2026-03-11 quant-ph 50%

A thermal-noise-resilient microwave quantum network traversing 4 K

4开低温微波量子网络抗热噪声

Jiawei Qiu, Zihao Zhang, Zilin Wang, Libo Zhang, Yuxuan Zhou, Xuandong Sun, Jiawei Zhang, Xiayu Linpeng, Song Liu, Jingjing Niu, Youpeng Zhong, Dapeng Yu

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本研究提出一种4 K低温微波量子网络,通过过耦合冷负载实现抗热噪声的量子态传输,达到高于经典通信的保真度。

Journal ref Nature Electronics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05144 2026-03-11 physics.flu-dyn cond-mat.soft 50%

Interface shapes in microfluidic porous media: conditions allowing steady, simultaneous two-phase flow

微流体多孔介质中的界面形状:允许稳定同时两相流的条件

S. J. Cox, A. Davarpanah, W. R. Rossen

专题命中 BEV与占用 :occupancy(abstract)

AI总结 研究探讨了微流体多孔介质中稳定同时两相流的条件,通过分析毛细压力和几何形状的影响,揭示了桥接现象和snap-off发生的机制。

Comments 20 pages, 10 figures

Journal ref Transp. Porous. Media 147: 197-216, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 激光雷达 3 篇

2412.18380 2026-03-11 cs.CV cs.GR 79%

ARSGaussian: 3D Gaussian Splatting with LiDAR for Aerial Remote Sensing Novel View Synthesis

ARSGaussian:基于LiDAR的3D高斯点分布用于航空遥感新视角合成

Yiling Yao, Bing Zhang, Wenjuan Zhang, Lianru Gao, Dailiang Peng, Bocheng Li, Yaning Wang, Bowen Wang

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 ARSGaussian通过整合LiDAR点云约束,改进3D高斯点分布方法,解决航空遥感中视角合成的漂浮物和过度生长问题,提升几何估计精度。

Comments This is the author's version of a work that was accepted for publication in [ISPRS]. Changes resulting from the publishing process... may not be reflected in this document

Journal ref ISPRS Journal of Photogrammetry and Remote Sensing,Volume 231,2026,Pages 288-306,ISSN 0924-2716,

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18384 2026-03-11 cs.CV 79%

LiDAR Remote Sensing Meets Weak Supervision: Concepts, Methods, and Perspectives

LiDAR遥感与弱监督学习:概念、方法与展望

Yuan Gao, Shaobo Xia, Pu Wang, Xiaohuan Xi, Sheng Nie, Cheng Wang

机构 * aircas.ac.cn(航空科学研究院)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 本文从弱监督学习视角系统回顾了LiDAR遥感的最新进展,探讨了弱监督方法在数据解释、参数反演及跨域适应中的应用,并展望了WSL在提升LiDAR遥感性能与泛化能力方面的未来方向。

Journal ref ISPRS Journal of Photogrammetry and Remote Sensing Volume 235, May 2026, Pages 72-104

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09826 2026-03-11 cs.CV 57%

VLM-Loc: Localization in Point Cloud Maps via Vision-Language Models

基于视觉-语言模型的点云地图定位

Shuhao Kang, Youqi Liao, Peijie Wang, Wenlong Liao, Qilin Zhang, Benjamin Busam, Xieyuanli Chen, Yun Liu

专题命中 激光雷达 :BEV(abstract);分类 cs.CV

AI总结 VLM-Loc通过视觉-语言模型的空间推理能力,实现了更准确的文本到点云定位,提升了复杂环境中的定位鲁棒性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仿真评测 2 篇

2603.08897 2026-03-11 cs.CV 79%

Comparative Analysis of Patch Attack on VLM-Based Autonomous Driving Architectures

基于VLM的自动驾驶架构中补丁攻击的比较分析

David Fernandez, Pedram MohajerAnsari, Amir Salarpour, Long Cheng, Abolfazl Razi, Mert D. Pesé

机构 * School of Computing, Clemson University(计算机学院,克莱姆森大学)

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.CV

AI总结 本文比较了三种基于VLM的自动驾驶架构对物理对抗攻击的鲁棒性,发现所有架构均存在严重漏洞,揭示了不同架构在对抗威胁下的脆弱性。

Comments Accepted at the 2025 IEEE Intelligent Vehicles Symposium (IV 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09512 2026-03-11 cs.CV 57%

Probing the Reliability of Driving VLMs: From Inconsistent Responses to Grounded Temporal Reasoning

探测驾驶视觉语言模型的可靠性:从不一致响应到基于现实的时序推理

Chun-Peng Chang, Chen-Yu Wang, Holger Caesar, Alain Pagani

机构 * DFKI Augmented Vision(DFKI增强视觉实验室) TU Delft(代尔夫特理工大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 本文研究了驾驶视觉语言模型的可靠性问题,通过引入FutureVQA数据集和自监督微调方法,提升模型在时序推理和一致性上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏