arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-03-17 至 2026-03-17 共收录 52 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 21 篇

2603.14822 2026-03-17 cs.CV 83%

RadarXFormer: Robust Object Detection via Cross-Dimension Fusion of 4D Radar Spectra and Images for Autonomous Driving

RadarXFormer: 通过4D雷达光谱与图像的跨维度融合实现稳健的目标检测用于自动驾驶

Yue Sun, Yeqiang Qian, Zhe Wang, Tianhui Li, Chunxiang Wang, Ming Yang

机构 * Global Institute of Future Technology, Shanghai Jiao Tong University(上海交通大学未来技术全球研究院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Key Laboratory of System Control and Information Processing, Ministry of Education of China(中国教育部系统控制与信息处理重点实验室) SAIC GM Wuling Automobile Company Co., Ltd.(上汽通用五菱汽车有限公司) Guangxi Laboratory of New Energy Automobile(广西新能源汽车实验室)

专题命中 感知 :autonomous driving(title,abstract);LiDAR(abstract);分类 cs.CV

AI总结 本文提出RadarXFormer框架,通过融合4D雷达光谱与RGB图像的跨维度信息,提升自动驾驶中的目标检测鲁棒性和准确性,同时保持实时推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14386 2026-03-17 cs.CV cs.AI 81%

Cheating Stereo Matching in Full-scale: Physical Adversarial Attack against Binocular Depth Estimation in Autonomous Driving

全尺寸场景中的欺骗立体匹配:针对自动驾驶双目深度估计的物理对抗攻击

Kangqiao Zhao, Shuo Huai, Xurui Song, Jun Luo

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出一种基于纹理的物理对抗攻击方法,用于攻击自动驾驶中的立体匹配模型,通过3D物理对抗示例和新的3D立体匹配渲染模块,提升攻击的隐蔽性和有效性。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18991 2026-03-17 cs.CV cs.AI 81%

Training-Free Global Geometric Association for 4D LiDAR Panoptic Segmentation

无需训练的全局几何关联用于4D激光雷达全景分割

Gyeongrok Oh, Youngdong Jang, Jonghyun Choi, Suk-Ju Kang, Guang Lin, Sangpil Kim

专题命中 感知 :LiDAR(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出Geo-4D框架,通过全局几何关联策略实现无需训练的4D激光雷达全景分割,提升长时间视景的感知能力,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15364 2026-03-17 cs.AI cs.CL 79%

CRASH: Cognitive Reasoning Agent for Safety Hazards in Autonomous Driving

CRASH:面向自动驾驶安全隐患的认知推理代理

Erick Silva, Rehana Yasmin, Ali Shoker

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹科技大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.AI

AI总结 本文提出CRASH,一种基于大语言模型的自动驾驶安全隐患分析工具,通过自动化处理事故报告,识别事故原因并评估自动驾驶系统对事故的影响,验证其在事故分析中的有效性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09783 2026-03-17 cs.RO cs.SY eess.SY 79%

Lightweight 3D LiDAR-Based UAV Tracking: An Adaptive Extended Kalman Filtering Approach

轻量级基于3D激光雷达的无人机跟踪:一种自适应扩展卡尔曼滤波方法

Nivand Khosravi, Meysam Basiri, Rodrigo Ventura

机构 * Institute for Systems and Robotics(系统与机器人研究所)

专题命中 感知 :LiDAR(title,abstract);分类 cs.RO

AI总结 本文提出一种轻量级基于3D激光雷达的无人机跟踪系统,采用自适应扩展卡尔曼滤波框架,解决稀疏、噪声和非均匀点云数据的跟踪问题,适用于小无人机的严格载荷约束。

Comments Presented at the 19th International Conference on Intelligent Autonomous Systems, IAS-19, Genoa, Italy, June 30 to July 4, 2025. To appear in the Springer post-proceedings of the conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03886 2026-03-17 cs.RO cs.SY eess.SY 79%

A Modular Architecture Design for Autonomous Driving Racing in Controlled Environments

一种用于受控环境自动驾驶赛车的模块化架构设计

Brais Fontan-Costas, M. Diaz-Cacho, Ruben Fernandez-Boullon, Manuel Alonso-Carracedo, Javier Perez-Robles

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO

AI总结 本文提出一种模块化自动驾驶架构,用于Formula Student无人驾驶竞赛车辆在封闭赛道环境中的应用,通过YOLOv11实现交通锥检测,结合神经立体深度估计实现3D定位,提升厘米级定位精度,并通过三次样条插值路径规划与纯追求控制器实现高效控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13399 2026-03-17 cs.CV 79%

FlowAD: Ego-Scene Interactive Modeling for Autonomous Driving

FlowAD: 无人驾驶中的自体场景交互建模

Mingzhe Guo, Yixiang Yang, Chuanrong Han, Rufeng Zhang, Shirui Li, Ji Wan, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab) Baidu Inc(百度公司)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV

AI总结 本文提出FlowAD框架,通过自体场景交互建模提升自动驾驶性能,利用场景流建模动态变化,结合新颖的FCP指标评估场景理解能力,实验表明其在碰撞率和驾驶评分上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16119 2026-03-17 cs.CV 70%

RadarGaussianDet3D: Gaussian Representation-based Real-time 3D Object Detection with 4D Automotive Radars

RadarGaussianDet3D: 基于高斯表示的实时3D目标检测与4D汽车雷达

Weiyi Xiong, Bing Zhu, Zewei Zheng

专题命中 感知 :autonomous driving(abstract);BEV(abstract);分类 cs.CV

AI总结 本文提出RadarGaussianDet3D,通过高斯表示提升4D雷达的3D目标检测性能,采用点高斯编码器和3D高斯点划技术生成密集特征图,结合新的高斯损失函数实现更高效的检测与推理。

Comments Accepted by IEEE Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11453 2026-03-17 cs.CV cs.AI cs.RO 67%

Beyond Frame-wise Tracking: A Trajectory-based Paradigm for Efficient Point Cloud Tracking

超越帧级跟踪:一种基于轨迹的高效点云跟踪范式

BaiChen Fan, Yuanxi Cui, Jian Li, Qin Wang, Shibo Zhao, Muqing Cao, Sifan Zhou

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 本文提出基于轨迹的跟踪范式TrajTrack,通过隐式学习历史轨迹提升跟踪精度,实现高效且鲁棒的3D单目标跟踪。

Comments Acceptted in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13365 2026-03-17 cs.CV cs.AI 62%

WaveComm: Lightweight Communication for Collaborative Perception via Wavelet Feature Distillation

WaveComm: 通过小波特征蒸馏实现轻量级协作感知通信

Erdemt Bao, Jin Yang

机构 * School of Mechanical Science and Engineering, Huazhong University of Science and Technology(华中科技大学机械科学与工程学院)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 WaveComm通过小波变换减少通信开销,保持低带宽环境下感知性能,实验显示在通信量减少至原值86.3%和87.0%时仍保持先进性能。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15470 2026-03-17 cs.CV 57%

Automated Counting of Stacked Objects in Industrial Inspection

工业检测中堆叠物体的自动化计数

Corentin Dumery, Noa Etté, Aoxiang Fan, Ren Li, Jingyi Xu, Hieu Le, Pascal Fua

机构 * EPFL(苏黎世联邦理工学院) MBZUAI(马克斯·普朗克人工智能研究所) Southern University of Science and Technology(南方科技大学) Stony Brook University(石溪大学) University of North Carolina(北卡罗来纳大学)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出一种新的3D计数方法,通过多视角图像估计堆叠物体的3D几何和占用率,解决容器中堆叠物体遮挡问题,验证了在大规模合成和真实数据上的鲁棒性。

Comments This preprint is a journal extension of our ICCV25 Oral paper: https://corentindumery.github.io/projects/stacks.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14909 2026-03-17 cs.CV 57%

TopoVST: Toward Topology-fidelitous Vessel Skeleton Tracking

TopoVST:迈向拓扑忠实的血管骨架跟踪

Yaoyu Liu, Minghui Zhang, Junjun He, Yun Gu

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Shanghai AI Lab(上海人工智能实验室)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出TopoVST,通过多尺度球图和图神经网络实现血管骨架跟踪,结合门控特征融合和几何感知加权方案,有效解决拓扑忠实性和类别不平衡问题,实验表明其在重叠和拓扑指标上表现优异。

Comments 10 pages, 9 figures. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12908 2026-03-17 cs.RO 57%

GoalSwarm: Multi-UAV Semantic Coordination for Open-Vocabulary Object Navigation

GoalSwarm:多无人机语义协调用于开放词汇物体导航

MoniJesu Wonders James, Amir Atef Habel, Aleksey Fedoseev, Dzmitry Tsetserokou

专题命中 感知 :occupancy(abstract);分类 cs.RO

AI总结 本文提出GoalSwarm框架,通过轻量语义地图构建、零样本目标检测和去中心化协调策略,实现多无人机在未知环境中的开放词汇物体导航。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01535 2026-03-17 cs.CV 57%

Benchmarking Semantic Segmentation Models via Appearance and Geometry Attribute Editing

通过外观和几何属性编辑评估语义分割模型

Zijin Yin, Bing Li, Kongming Liang, Hao Sun, Zhongjiang He, Zhanyu Ma, Jun Guo

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出Gen4Seg数据生成管道,通过生成具有不同属性变化的挑战样本来评估语义分割模型,构建了Pascal-EA和COCO-EA两个新基准,发现开放词汇模型在几何变化下不比封闭集方法更鲁棒,数据增强技术在提升外观变化鲁棒性上有限。

Comments Accepted to IEEE TPAMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16443 2026-03-17 cs.CV 57%

VGGT-Long: Chunk it, Loop it, Align it -- Pushing VGGT's Limits on Kilometer-scale Long RGB Sequences

VGGT-Long:分块、循环、对齐——在千米级长RGB序列上推动VGGT的极限

Kai Deng, Zexin Ti, Jiawei Xu, Jian Yang, Jin Xie

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出VGGT-Long,通过分块处理、重叠对齐和轻量循环闭合优化,解决现有模型的可扩展性瓶颈,实现千米级户外环境的单目3D重建。

Comments IEEE International Conference on Robotics & Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11477 2026-03-17 cs.LG cs.AI 57%

TraffiDent: A Dataset for Understanding the Interplay Between Traffic Dynamics and Incidents

TraffiDent: 一个用于理解交通动态与事件相互作用的数据集

Xiaochuan Gou, Ziyue Li, Tian Lan, Junpeng Lin, Zhishuai Li, Bingyu Zhao, Chen Zhang, Di Wang, Xiangliang Zhang

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 TraffiDent数据集首次将交通动态与事件在时空对齐的大型区域(16972个交通节点)中整合,包含交通流量、车道占用率和平均车速的时间序列数据,以及七类事件记录,支持交通-事件交互分析和因果关系研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14309 2026-03-17 cs.CV 57%

In-Field 3D Wheat Head Instance Segmentation From TLS Point Clouds Using Deep Learning Without Manual Labels

基于TLS点云的田间小麦头实例分割:无需手动标注的深度学习方法

Tomislav Medic, Liangliang Nan

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 本文提出一种无需手动标注的深度学习方法,直接从TLS点云中实现田间小麦头实例分割,通过两阶段流程提升分割效果,优于现有基于多视角RGB图像和3D高斯点划法的解决方案。

Comments to be published in ISPRS Annals of Photogrammetry and Remote Sensing at XXV ISPRS Congress, Toronto, Canada, July 2026, 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23194 2026-03-17 cs.CV 57%

Unsupervised Online 3D Instance Segmentation with Synthetic Sequences and Dynamic Loss

无监督在线3D实例分割与合成序列及动态损失

Yifan Zhang, Wei Zhang, Chuangxin He, Zhonghua Miao, Junhui Hou

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 本文提出一种通过合成点云序列生成增强训练分布的新框架,采用灵活的采样策略和动态加权损失,提升3D实例分割的准确性和时间关联性。

Comments Accepted to TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06251 2026-03-17 cs.CV 57%

NexusFlow: Unifying Disparate Tasks under Partial Supervision via Invertible Flow Networks

NexusFlow:通过可逆流网络在部分监督下统一分散任务

Fangzhou Lin, Yuping Wang, Yuliang Guo, Zixun Huang, Xinyu Huang, Haichong Zhang, Kazunori Yamada, Zhengzhong Tu, Liu Ren, Ziming Zhang

机构 * Worcester Polytechnic Institute(沃斯特理工大学) Texas A&M University(德克萨斯A&M大学) Tohoku University(东北大学) University of Michigan(密歇根大学) Bosch Research North America & Bosch Center for AI(博世北美研究与人工智能中心)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 NexusFlow通过可逆耦合层对任务潜在特征分布对齐,实现结构多样任务下的知识迁移,优于现有部分监督基线,在自动驾驶和NYUv2数据集上均取得新突破。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13613 2026-03-17 stat.ML cs.LG math.ST stat.TH 50%

Robust Sequential Tracking via Bounded Information Geometry and Non-Parametric Field Actions

通过有界信息几何和非参数场动作实现鲁棒序列跟踪

Carlos C. Rodriguez

机构 * Department of Mathematics and Statistics(数学与统计学系)

专题命中 感知 :LiDAR(abstract)

AI总结 本文通过分析元先验层面的推断抽象序列,利用非参数场和严格不变的Delta信息分离,解决了序列推断中极端异常值导致的不可归一化问题,实验证明其在多个领域中能有效截断异常值,实现稳健估计。

Comments 1o pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13440 2026-03-17 cs.LG cs.IT math.IT 50%

Improving Channel Estimation via Multimodal Diffusion Models with Flow Matching

通过多模态扩散模型与流匹配改进信道估计

Xiaotian Fan, Xingyu Zhou, Le Liang, Xiao Li, Shi Jin

机构 * School of Information Science and Engineering, Southeast University(信息科学与工程学院,东南大学) Purple Mountain Laboratories(紫金山实验室)

专题命中 感知 :LiDAR(abstract)

AI总结 本文提出基于流匹配和扩散变压器的多模态信道估计框架MultiCE-Flow,通过融合LiDAR、相机和位置数据生成语义条件,利用稀疏试点作为结构条件,实现高保真信道重建,优于传统方法和生成模型。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 10 篇

2603.14408 2026-03-17 eess.SY cs.SY 78%

DRCC-LPVMPC: Robust Data-Driven Control for Autonomous Driving and Obstacle Avoidance

DRCC-LPVMPC:面向自动驾驶和障碍物避让的鲁棒数据驱动控制

Shiming Fang, Xilin Li, Changzhi Wu, Kaiyan Yu

专题命中 规划控制 :autonomous driving(title,abstract)

AI总结 本文提出DRCC-LPVMPC框架,通过处理模型偏差和不确定性,提升自动驾驶中的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17317 2026-03-17 math.OC math.PR 78%

Continuous-time optimal control for trajectory planning under uncertainty

在不确定性下的连续时间最优控制用于轨迹规划

Ange Valli, Shangyuan Zhang, Abdel Lisser

专题命中 规划控制 :trajectory planning(title,abstract)

AI总结 本文提出了一种连续时间最优控制框架,用于生成具有不确定性的驾驶场景中的参考轨迹。通过将之前离散时间随机生成器扩展到连续时间,提高了生成器在实时环境中的鲁棒性,并展示了连续时间随机模型在捕捉不确定性方面的有效性。

Comments Postprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14739 2026-03-17 cs.CV cs.AI 62%

TrajMamba: An Ego-Motion-Guided Mamba Model for Pedestrian Trajectory Prediction from an Egocentric Perspective

TrajMamba:一种基于自身运动的Mamba模型,用于从第一人称视角预测行人轨迹

Yusheng Peng, Gaofeng Zhang, Liping Zheng

专题命中 规划控制 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 本文提出基于Mamba模型的TrajMamba模型,通过提取行人和自身运动特征,结合自身运动引导解码器预测未来轨迹,实现在自动驾驶和机器人导航中的高性能表现。

Comments Accept by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14948 2026-03-17 cs.CV 57%

Bridging Scene Generation and Planning: Driving with World Model via Unifying Vision and Motion Representation

弥合场景生成与规划:通过统一视觉与运动表示进行驾驶世界模型

Xingtai Gui, Meijie Zhang, Tianyi Yan, Wencheng Han, Jiahao Gong, Feiyang Tan, Cheng-zhong Xu, Jianbing Shen

机构 * SKL-IOTSC, CIS, University of Macau(澳门大学SKL-IOTSC、CIS) Afari Intelligent Drive(Afari智能驾驶)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出WorldDrive框架,通过统一视觉与运动表示弥合场景生成与规划之间的差距,利用轨迹感知驾驶世界模型和未来感知奖励器提升自动驾驶规划性能。

Comments 16 pages, 9 figures. The code is available at https://github.com/TabGuigui/WorldDrive

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14940 2026-03-17 eess.SY cs.LG cs.RO cs.SY 57%

Intelligent Control of Differential Drive Robots Subject to Unmodeled Dynamics with EKF-based State Estimation

具有未建模动态的差分驱动机器人智能控制与状态估计

Amos Alwala, Yuchen Hu, Gabriel da Silva Lima, Wallace Moreira Bessa

机构 * With the Smart Systems , Department of Mechanical and Materials Engineering, Faculty of Technology, University of Turku(智能系统,机械与材料工程系,技术学院,图尔库大学)

专题命中 规划控制 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出结合Lyapunov非线性控制器与自适应神经网络及EKF多传感器融合的统一控制与状态估计框架,通过在线适应方案改进RBF权重,实现未知非线性建模,并通过Lyapunov分析保证闭环稳定性,实验显示在速度跟踪性能上有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14704 2026-03-17 cs.LG cs.CV stat.ML 57%

Chain-of-Trajectories: Unlocking the Intrinsic Generative Optimality of Diffusion Models via Graph-Theoretic Planning

轨迹链:通过图论规划解锁扩散模型的内在生成最优性

Ping Chen, Xiang Liu, Xingpeng Zhang, Fei Shen, Xun Gong, Zhaoxiang Liu, Zezhou Chen, Huan Hu, Kai Wang, Shiguo Lian

专题命中 规划控制 :trajectory planning(abstract);分类 cs.CV

AI总结 本文提出轨迹链框架,通过图论规划解决扩散模型在高维状态空间中的计算瓶颈,提升生成质量与稳定性。

Comments 12 figues, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14056 2026-03-17 cs.RO cs.SY eess.SY 57%

Amortizing Trajectory Diffusion with Keyed Drift Fields

通过键控漂移场实现轨迹扩散的 amortization

Gokul Puthumanaillam, Melkior Ornik

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 本文提出键控漂移策略,通过单步推理实现轨迹扩散行为,保留多样候选计划生成和实时控制循环中的状态条件能力,降低规划延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14540 2026-03-17 cs.RO 57%

Multimodal Belief-Space Covariance Steering with Active Probing and Influence for Interactive Driving

多模态信念空间协方差操控与主动探测及影响的交互驾驶

Devodita Chakravarty, John Dolan, Yiwei Lyu

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO

AI总结 本文提出一种多模态信念空间协方差操控方法,通过主动探测和影响策略,在交互驾驶中提升安全性和决策效率。

Comments Accepted to IEEE International Conference on Robotics and Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01403 2026-03-17 eess.SY cs.SY 50%

Risk Aware Safe Control with Multi-Modal Sensing for Dynamic Obstacle Avoidance

具有多模感知的动态障碍物避让风险感知安全控制

Pei Yu Chang, Qizhe Xu, Vishnu Renganathan, Qadeer Ahmed

专题命中 规划控制 :LiDAR(abstract)

AI总结 本文提出一种融合概率状态估计与条件风险值控制障碍函数的安全框架,通过 Wasserstein barycenter 结合多模感知数据,提升自动驾驶在动态环境中的安全性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏