arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

共收录 21154 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 6049 篇

2602.13293 2026-03-19 cs.CV eess.IV 81%

NutVLM: A Self-Adaptive Defense Framework against Full-Dimension Attacks for Vision Language Models in Autonomous Driving

NutVLM: 一种针对自动驾驶中视觉语言模型全维度攻击的自适应防御框架

Xiaoxu Peng, Dong Zhou, Jianwen Zhang, Guanghui Sun, Anh Tu Ngo, Anupam Chattopadhyay

机构 * Department of Control Science and Engineering, Harbin Institute of Technology(控制科学与工程系,哈尔滨工业大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、eess.IV

AI总结 本文提出NutVLM框架,通过NutNet++ sentinel检测并净化良性样本、局部修补和全局扰动,结合高效灰度遮蔽和专家引导的对抗提示调优,提升自动驾驶中视觉语言模型的鲁棒性与性能。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14386 2026-03-17 cs.CV cs.AI 81%

Cheating Stereo Matching in Full-scale: Physical Adversarial Attack against Binocular Depth Estimation in Autonomous Driving

全尺寸场景中的欺骗立体匹配:针对自动驾驶双目深度估计的物理对抗攻击

Kangqiao Zhao, Shuo Huai, Xurui Song, Jun Luo

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出一种基于纹理的物理对抗攻击方法,用于攻击自动驾驶中的立体匹配模型,通过3D物理对抗示例和新的3D立体匹配渲染模块,提升攻击的隐蔽性和有效性。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18991 2026-03-17 cs.CV cs.AI 81%

Training-Free Global Geometric Association for 4D LiDAR Panoptic Segmentation

无需训练的全局几何关联用于4D激光雷达全景分割

Gyeongrok Oh, Youngdong Jang, Jonghyun Choi, Suk-Ju Kang, Guang Lin, Sangpil Kim

专题命中 感知 :LiDAR(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出Geo-4D框架,通过全局几何关联策略实现无需训练的4D激光雷达全景分割,提升长时间视景的感知能力,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11093 2026-03-13 cs.AI cs.RO 81%

A Survey of Reasoning in Autonomous Driving Systems: Open Challenges and Emerging Paradigms

自动驾驶系统推理的综述:开放挑战与新兴范式

Kejin Yu, Yuhan Sun, Taiqiang Wu, Ruixu Zhang, Zhiqiang Lin, Yuxin Meng, Junjie Wang, Yujiu Yang

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 本文综述了自动驾驶系统推理的挑战与新兴范式,提出认知层次分解驾驶任务,并系统化七个核心推理挑战,强调发展可验证的神经符号架构以解决高延迟推理与安全需求的矛盾。

Comments Published in TMLR (March 2026) | OpenReview: https://openreview.net/forum?id=XwQ7dc4bqn

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03538 2026-03-11 cs.CV cs.AI 81%

SDR-GAIN: A High Real-Time Occluded Pedestrian Pose Completion Method for Autonomous Driving

SDR-GAIN: 一种用于自动驾驶的高实时遮挡行人姿态补全方法

Honghao Fu, Yongli Gu, Yidong Yan, Yilang Shen, Yiwen Wu, Libo Sun

机构 * School of Instrument Science and Engineering, Southeast University(仪器科学与工程学院,东南大学) School of Geospatial Engineering and Science, Sun Yat-sen University(地理信息工程与科学学院,中山大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 SDR-GAIN通过自监督对抗学习实现高实时遮挡行人姿态补全,提升自动驾驶系统鲁棒性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04222 2026-03-05 cs.RO cs.AI 81%

PRAM-R: A Perception-Reasoning-Action-Memory Framework with LLM-Guided Modality Routing for Adaptive Autonomous Driving

PRAM-R:一种具有LLM引导模态路由的感知-推理-行动-记忆框架,用于自适应自动驾驶

Yi Zhang, Xian Zhang, Saisi Zhao, Yinglei Song, Chengdong Wu, Nenad Petrovic, Alois Knoll

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 PRAM-R通过LLM引导的模态路由和分层记忆模块,实现高效自适应的多模态感知,提升自动驾驶的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09980 2026-02-17 cs.CV cs.RO 81%

V2V-LLM: Vehicle-to-Vehicle Cooperative Autonomous Driving with Multimodal Large Language Models

V2V-LLM:基于多模态大语言模型的车与车协同自动驾驶

Hsu-kuang Chiu, Ryo Hachiuma, Chien-Yi Wang, Stephen F. Smith, Yu-Chiang Frank Wang, Min-Hung Chen

机构 * NVIDIA Carnegie Mellon University(卡内基梅隆大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于多模态大语言模型的V2V-LLM,通过车与车协同感知提升自动驾驶安全性和性能。

Comments Accepted by ICRA 2026 (IEEE International Conference on Robotics and Automation). Project: https://eddyhkchiu.github.io/v2vllm.github.io/ Code: https://github.com/eddyhkchiu/V2V-LLM Dataset: https://huggingface.co/datasets/eddyhkchiu/V2V-GoT-QA

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10771 2026-02-12 cs.CV cs.RO 81%

From Steering to Pedalling: Do Autonomous Driving VLMs Generalize to Cyclist-Assistive Spatial Perception and Planning?

从转向到踩踏:自动驾驶VLMs是否能泛化到骑行辅助的空间感知与规划?

Krishna Kanth Nakka, Vedasri Nakka

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出CyclingVQA基准,评估自动驾驶VLMs在骑行辅助场景中的感知与推理能力,发现现有模型在骑行特定交通提示理解上存在不足,需进一步改进。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10160 2026-02-12 cs.CV cs.AI 81%

AD$^2$: Analysis and Detection of Adversarial Threats in Visual Perception for End-to-End Autonomous Driving Systems

AD$^2$:面向端到端自动驾驶系统的视觉感知中对抗威胁的分析与检测

Ishan Sahu, Somnath Hazra, Somak Aditya, Soumyajit Dey

机构 * Indian Institute of Technology Kharagpur(印度理工学院卡里格普尔分校) TCS Research, India(印度塔塔咨询公司研究)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 AD$^2$通过基于注意力机制的轻量级模型,检测端到端自动驾驶系统中由物理模糊、电磁干扰和数字攻击引起的对抗威胁,提升系统安全性。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08434 2026-01-21 cs.RO cs.AI 81%

Large Multimodal Models for Embodied Intelligent Driving: The Next Frontier in Self-Driving?

大规模多模态模型用于具身智能驾驶:自我驾驶的下一个前沿?

Long Zhang, Yuchen Xia, Bingqing Wei, Zhen Liu, Shiwen Mao, Zhu Han, Mohsen Guizani

机构 * School of Information and Electrical Engineering, Hebei University of Engineering(河北工程大学信息与电子工程学院) School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院) Department of Electrical and Computer Engineering, Auburn University(阿肯色大学电气与计算机工程系) Department of Electrical and Computer Engineering, University of Houston(休斯顿大学电气与计算机工程系) Department of Computer Science and Engineering, Kyung Hee University(庆熙大学计算机科学与工程系) Machine Learning Department, Mohamed Bin Zayed University of Artificial Intelligence(Mohamed Bin Zayed人工智能大学机器学习系)

专题命中 感知 :self-driving(title);autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种语义和策略双驱动的混合决策框架,用于提升具身智能驾驶中的持续学习与联合决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03672 2026-01-21 cs.CV cs.AI 81%

MetaSSC: Enhancing 3D Semantic Scene Completion for Autonomous Driving through Meta-Learning and Long-sequence Modeling

MetaSSC: 通过元学习和长序列建模增强自动驾驶中的3D语义场景补全

Yansong Qu, Zixuan Xu, Zilin Huang, Zihao Sheng, Tiantian Chen, Sikai Chen

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 MetaSSC通过元学习和长序列建模提升自动驾驶中3D语义场景补全的性能与效率。

Journal ref Communications in Transportation Research 5 (2025): 100184

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01893 2026-01-07 cs.RO eess.IV 81%

DriveNetBench: An Affordable and Configurable Single-Camera Benchmarking System for Autonomous Driving Networks

DriveNetBench: 一种经济实惠且可配置的单摄像头自动驾驶网络基准测试系统

Ali Al-Bustami, Humberto Ruiz-Ochoa, Jaerock Kwon

机构 * Department of Electrical and Computer Engineering, University of Michigan-Dearborn(电气与计算机工程系,密歇根大学-德城)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、eess.IV

AI总结 DriveNetBench提供了一种经济实惠且可配置的单摄像头系统,用于评估自动驾驶网络的性能,通过开源软件实现标准化测试和可重复的度量标准,提升研究可及性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24712 2026-01-06 cs.RO cs.AI 81%

LSRE: Latent Semantic Rule Encoding for Real-Time Semantic Risk Detection in Autonomous Driving

LSRE: 隐式语义规则编码用于自动驾驶中的实时语义风险检测

Qian Cheng, Weitao Zhou, Cheng Jing, Nanshan Deng, Junze Wen, Zhaoyang Liu, Kun Jiang, Diange Yang

机构 * School of Vehicle and Mobility, Tsinghua University(车辆与移动系统学院,清华大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 LSRE通过隐式语义规则编码实现自动驾驶中的实时语义风险检测,以10 Hz速度提供高效准确的危险预判。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15195 2025-12-18 cs.RO cs.CV 81%

EPSM: A Novel Metric to Evaluate the Safety of Environmental Perception in Autonomous Driving

EPSM:一种用于评估自动驾驶中环境感知安全性的新指标

Jörg Gamerdinger, Sven Teufel, Stephan Amann, Lukas Marc Listl, Oliver Bringmann

机构 * University of Tübingen, Faculty of Science, Department of Computer Science, Embedded Systems Group(图宾根大学,科学学院,计算机科学系,嵌入式系统组)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 EPSM提出了一种新的安全指标,用于评估自动驾驶中环境感知系统的安全性能,通过整合物体和车道检测任务的相互依赖性,识别传统指标无法捕捉的安全关键错误。

Comments Submitted at IEEE IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07020 2025-12-15 cs.RO cs.AI cs.LG 81%

Driving Through Uncertainty: Risk-Averse Control with LLM Commonsense for Autonomous Driving under Perception Deficits

在不确定性中驾驶:利用大语言模型常识实现风险厌恶控制以应对自动驾驶中的感知缺陷

Yuting Hu, Chenhui Xu, Ruiyang Qin, Dancheng Liu, Amir Nassereldine, Yiyu Shi, Jinjun Xiong

机构 * University at Buffalo(布法罗大学) University of Notre Dame(诺特尔大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出LLM-RCO框架,利用大语言模型整合人类驾驶常识,以提升自动驾驶在感知缺陷下的风险规避与适应性控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02018 2025-12-02 cs.CV cs.RO 81%

Data-Centric Visual Development for Self-Driving Labs

以数据为中心的自动驾驶实验室视觉发展

Anbang Liu, Guanzhong Hu, Jiayi Wang, Ping Guo, Han Liu

机构 * Department of Computer Science, Northwestern University(计算机科学系,西北大学) Department of Mechanical Engineering, Northwestern University(机械工程系,西北大学)

专题命中 感知 :self-driving(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种融合真实与虚拟数据生成的混合管道,用于解决自动驾驶实验室中pipetting任务的训练数据稀缺问题,通过人机协作和图像生成技术提升气泡检测的鲁棒性。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14306 2025-11-25 cs.RO cs.AI 81%

Label-Free Model Failure Detection for Lidar-based Point Cloud Segmentation

无需标签的激光雷达点云分割模型失效检测

Daniel Bogdoll, Finn Sartoris, Vincent Geppert, Svetlana Pavlitska, J. Marius Zöllner

机构 * FZI Research Center for Information Technology, Germany(德国弗赖堡信息科技研究中心) Karlsruhe Institute of Technology, Germany(德国卡尔斯鲁厄理工学院)

专题命中 感知 :LiDAR(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种无需标签的激光雷达点云分割模型失效检测方法,利用大规模无标签数据进行监督和自监督学习,引入LidarCODA数据集用于失效模式分析。

Comments Daniel Bogdoll, Finn Sartoris, and Vincent Geppert contributed equally. Accepted for publication at IV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00709 2025-11-13 cs.CV cs.AI 81%

TopoStreamer: Temporal Lane Segment Topology Reasoning in Autonomous Driving

Yiming Yang, Yueru Luo, Bingkun He, Hongbin Lin, Suzhong Fu, Chao Zheng, Zhipeng Cao, Erlong Li, Chao Yan, Shuguang Cui, Zhen Li

机构 * FNii, CUHK-Shenzhen(CUHK-Shenzhen FNii) SSE, CUHK-Shenzhen(CUHK-Shenzhen SSE) SCSE, WHU(WHU SCSE) T Lab, Tencent(腾讯 T Lab)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05227 2025-11-04 cs.RO cs.CV cs.LG cs.MM cs.SY eess.SY 81%

NavigScene: Bridging Local Perception and Global Navigation for Beyond-Visual-Range Autonomous Driving

Qucheng Peng, Chen Bai, Guoxiang Zhang, Bo Xu, Xiaotong Liu, Xiaoyin Zheng, Chen Chen, Cheng Lu

机构 * Center for Research in Computer Vision, University of Central Florida(计算机视觉研究中心,中央佛罗里达大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

Comments Accepted by ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25901 2025-10-31 cs.CV cs.RO 81%

BikeScenes: Online LiDAR Semantic Segmentation for Bicycles

Denniz Goren, Holger Caesar

机构 * Denniz Goren(独立研究者) Holger Caesar(独立研究者)

专题命中 感知 :LiDAR(title,abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24152 2025-10-29 cs.CV cs.AI 81%

Enhancing Vision-Language Models for Autonomous Driving through Task-Specific Prompting and Spatial Reasoning

Aodi Wu, Xubo Luo

机构 * University of Chinese Academy of Sciences(中国科学院大学) Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

Comments RoboSense Challenge with IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01795 2025-10-13 cs.RO cs.AI 81%

Nav-EE: Navigation-Guided Early Exiting for Efficient Vision-Language Models in Autonomous Driving

Haibo Hu, Lianming Huang, Xinyu Wang, Yufei Cui, Shangyu Wu, Nan Guan, Chun Jason Xue

机构 * Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) Department of Computer Science, McGill University(麦吉尔大学计算机科学系) Department of Computer Science, Mohamed bin Zayed University of Artificial Intelligence(马尔代夫穆罕默德· bin·扎耶德人工智能大学计算机科学系)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05404 2025-10-13 cs.CV cs.AI 81%

AD-EE: Early Exiting for Fast and Reliable Vision-Language Models in Autonomous Driving

Lianming Huang, Haibo Hu, Yufei Cui, Jiacheng Zuo, Shangyu Wu, Nan Guan, Chun Jason Xue

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

Comments We believe that the contribution of this paper is not enough, so we integrated it into another new paper. The arXiv ID of the new paper is arXiv:2510.01795

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06876 2025-10-09 cs.CV cs.RO 81%

HARP-NeXt: High-Speed and Accurate Range-Point Fusion Network for 3D LiDAR Semantic Segmentation

Samir Abou Haidar, Alexandre Chariot, Mehdi Darouich, Cyril Joly, Jean-Emmanuel Deschaud

机构 * Paris-Saclay University, CEA, List(巴黎-萨克雷大学,CEA,List) Mines Paris, PSL University, Centre for Robotics (CAOR)(巴黎矿业学院,PSL大学,机器人中心(CAOR))

专题命中 感知 :LiDAR(title,abstract);分类 cs.RO、cs.CV

Comments Accepted at IROS 2025 (IEEE/RSJ International Conference on Intelligent Robots and Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23641 2025-09-30 cs.CV cs.RO 81%

From Static to Dynamic: a Survey of Topology-Aware Perception in Autonomous Driving

Yixiao Chen, Ruining Yang, Xin Chen, Jia He, Dongliang Xu, Yue Yao

机构 * Sems Shandong University(山东大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.01850 2025-09-10 cs.CV cs.AI 81%

On the Real-World Adversarial Robustness of Real-Time Semantic Segmentation Models for Autonomous Driving

Giulio Rossolini, Federico Nesti, Gianluca D'Amico, Saasha Nair, Alessandro Biondi, Giorgio Buttazzo

机构 * Department of Excellence in Robotics \& AI, Scuola Superiore Sant'Anna, Pisa, Italy

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

Journal ref IEEE Transactions on Neural Networks and Learning Systems ( Volume: 35, Issue: 12, December 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04735 2025-09-08 cs.CV cs.AI 81%

Enhancing Self-Driving Segmentation in Adverse Weather Conditions: A Dual Uncertainty-Aware Training Approach to SAM Optimization

Dharsan Ravindran, Kevin Wang, Zhuoyuan Cao, Saleh Abdelrahman, Jeffery Wu

机构 * Queen's University(女王大学)

专题命中 感知 :self-driving(title);autonomous driving(abstract);分类 cs.CV、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07865 2025-08-21 cs.CV cs.RO 81%

AnoVox: A Benchmark for Multimodal Anomaly Detection in Autonomous Driving

Daniel Bogdoll, Iramm Hamdard, Lukas Namgyu Rößler, Felix Geisler, Muhammed Bayram, Felix Wang, Jan Imhof, Miguel de Campos, Anushervon Tabarov, Yitian Yang, Hanno Gottschalk, J. Marius Zöllner

机构 * FZI Research Center for Information Technology(弗劳恩霍夫研究所信息技术研究中心) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Technical University of Berlin(柏林技术大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

Comments Daniel Bogdoll, Iramm Hamdard, and Lukas Namgyu Rößler contributed equally. Accepted for publication at ECCV 2024 W-CODA workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08555 2025-08-15 cs.RO cs.CV 81%

Detection and Tracking of MAVs Using a Rosette Scanning Pattern LiDAR

Sándor Gazdag, Tom Möller, Anita Keszler, András L. Majdik

机构 * HUN-REN SZTAKI Institute for Computer Science and Control(HUN-REN SZTAKI计算机科学与控制研究所) Budapest University of Technology and Economics(布达佩斯技术与经济大学) Eötvös Loránd University (ELTE)(欧多立·洛朗大学) KTH Royal Institute of Technology(皇家理工学院)

专题命中 感知 :LiDAR(title,abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22477 2025-08-01 cs.CV cs.AI 81%

LIDAR: Lightweight Adaptive Cue-Aware Fusion Vision Mamba for Multimodal Segmentation of Structural Cracks

Hui Liu, Chen Jia, Fan Shi, Xu Cheng, Mengfei Shi, Xia Xie, Shengyong Chen

机构 * Tianjin University of Technology(天津理工大学) Hainan University(海南大学)

专题命中 感知 :LiDAR(title,abstract);分类 cs.CV、cs.AI

Comments This paper has been accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏