arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-03-17 至 2026-03-17 共收录 21 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 21 篇

2603.14822 2026-03-17 cs.CV 83%

RadarXFormer: Robust Object Detection via Cross-Dimension Fusion of 4D Radar Spectra and Images for Autonomous Driving

RadarXFormer: 通过4D雷达光谱与图像的跨维度融合实现稳健的目标检测用于自动驾驶

Yue Sun, Yeqiang Qian, Zhe Wang, Tianhui Li, Chunxiang Wang, Ming Yang

机构 * Global Institute of Future Technology, Shanghai Jiao Tong University(上海交通大学未来技术全球研究院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Key Laboratory of System Control and Information Processing, Ministry of Education of China(中国教育部系统控制与信息处理重点实验室) SAIC GM Wuling Automobile Company Co., Ltd.(上汽通用五菱汽车有限公司) Guangxi Laboratory of New Energy Automobile(广西新能源汽车实验室)

专题命中 感知 :autonomous driving(title,abstract);LiDAR(abstract);分类 cs.CV

AI总结 本文提出RadarXFormer框架,通过融合4D雷达光谱与RGB图像的跨维度信息,提升自动驾驶中的目标检测鲁棒性和准确性,同时保持实时推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14386 2026-03-17 cs.CV cs.AI 81%

Cheating Stereo Matching in Full-scale: Physical Adversarial Attack against Binocular Depth Estimation in Autonomous Driving

全尺寸场景中的欺骗立体匹配:针对自动驾驶双目深度估计的物理对抗攻击

Kangqiao Zhao, Shuo Huai, Xurui Song, Jun Luo

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出一种基于纹理的物理对抗攻击方法,用于攻击自动驾驶中的立体匹配模型,通过3D物理对抗示例和新的3D立体匹配渲染模块,提升攻击的隐蔽性和有效性。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18991 2026-03-17 cs.CV cs.AI 81%

Training-Free Global Geometric Association for 4D LiDAR Panoptic Segmentation

无需训练的全局几何关联用于4D激光雷达全景分割

Gyeongrok Oh, Youngdong Jang, Jonghyun Choi, Suk-Ju Kang, Guang Lin, Sangpil Kim

专题命中 感知 :LiDAR(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出Geo-4D框架,通过全局几何关联策略实现无需训练的4D激光雷达全景分割,提升长时间视景的感知能力,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15364 2026-03-17 cs.AI cs.CL 79%

CRASH: Cognitive Reasoning Agent for Safety Hazards in Autonomous Driving

CRASH:面向自动驾驶安全隐患的认知推理代理

Erick Silva, Rehana Yasmin, Ali Shoker

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹科技大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.AI

AI总结 本文提出CRASH,一种基于大语言模型的自动驾驶安全隐患分析工具,通过自动化处理事故报告,识别事故原因并评估自动驾驶系统对事故的影响,验证其在事故分析中的有效性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09783 2026-03-17 cs.RO cs.SY eess.SY 79%

Lightweight 3D LiDAR-Based UAV Tracking: An Adaptive Extended Kalman Filtering Approach

轻量级基于3D激光雷达的无人机跟踪:一种自适应扩展卡尔曼滤波方法

Nivand Khosravi, Meysam Basiri, Rodrigo Ventura

机构 * Institute for Systems and Robotics(系统与机器人研究所)

专题命中 感知 :LiDAR(title,abstract);分类 cs.RO

AI总结 本文提出一种轻量级基于3D激光雷达的无人机跟踪系统,采用自适应扩展卡尔曼滤波框架,解决稀疏、噪声和非均匀点云数据的跟踪问题,适用于小无人机的严格载荷约束。

Comments Presented at the 19th International Conference on Intelligent Autonomous Systems, IAS-19, Genoa, Italy, June 30 to July 4, 2025. To appear in the Springer post-proceedings of the conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03886 2026-03-17 cs.RO cs.SY eess.SY 79%

A Modular Architecture Design for Autonomous Driving Racing in Controlled Environments

一种用于受控环境自动驾驶赛车的模块化架构设计

Brais Fontan-Costas, M. Diaz-Cacho, Ruben Fernandez-Boullon, Manuel Alonso-Carracedo, Javier Perez-Robles

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO

AI总结 本文提出一种模块化自动驾驶架构,用于Formula Student无人驾驶竞赛车辆在封闭赛道环境中的应用,通过YOLOv11实现交通锥检测,结合神经立体深度估计实现3D定位,提升厘米级定位精度,并通过三次样条插值路径规划与纯追求控制器实现高效控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13399 2026-03-17 cs.CV 79%

FlowAD: Ego-Scene Interactive Modeling for Autonomous Driving

FlowAD: 无人驾驶中的自体场景交互建模

Mingzhe Guo, Yixiang Yang, Chuanrong Han, Rufeng Zhang, Shirui Li, Ji Wan, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab) Baidu Inc(百度公司)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV

AI总结 本文提出FlowAD框架,通过自体场景交互建模提升自动驾驶性能,利用场景流建模动态变化,结合新颖的FCP指标评估场景理解能力,实验表明其在碰撞率和驾驶评分上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16119 2026-03-17 cs.CV 70%

RadarGaussianDet3D: Gaussian Representation-based Real-time 3D Object Detection with 4D Automotive Radars

RadarGaussianDet3D: 基于高斯表示的实时3D目标检测与4D汽车雷达

Weiyi Xiong, Bing Zhu, Zewei Zheng

专题命中 感知 :autonomous driving(abstract);BEV(abstract);分类 cs.CV

AI总结 本文提出RadarGaussianDet3D,通过高斯表示提升4D雷达的3D目标检测性能,采用点高斯编码器和3D高斯点划技术生成密集特征图,结合新的高斯损失函数实现更高效的检测与推理。

Comments Accepted by IEEE Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11453 2026-03-17 cs.CV cs.AI cs.RO 67%

Beyond Frame-wise Tracking: A Trajectory-based Paradigm for Efficient Point Cloud Tracking

超越帧级跟踪:一种基于轨迹的高效点云跟踪范式

BaiChen Fan, Yuanxi Cui, Jian Li, Qin Wang, Shibo Zhao, Muqing Cao, Sifan Zhou

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 本文提出基于轨迹的跟踪范式TrajTrack,通过隐式学习历史轨迹提升跟踪精度,实现高效且鲁棒的3D单目标跟踪。

Comments Acceptted in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13365 2026-03-17 cs.CV cs.AI 62%

WaveComm: Lightweight Communication for Collaborative Perception via Wavelet Feature Distillation

WaveComm: 通过小波特征蒸馏实现轻量级协作感知通信

Erdemt Bao, Jin Yang

机构 * School of Mechanical Science and Engineering, Huazhong University of Science and Technology(华中科技大学机械科学与工程学院)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 WaveComm通过小波变换减少通信开销,保持低带宽环境下感知性能,实验显示在通信量减少至原值86.3%和87.0%时仍保持先进性能。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15470 2026-03-17 cs.CV 57%

Automated Counting of Stacked Objects in Industrial Inspection

工业检测中堆叠物体的自动化计数

Corentin Dumery, Noa Etté, Aoxiang Fan, Ren Li, Jingyi Xu, Hieu Le, Pascal Fua

机构 * EPFL(苏黎世联邦理工学院) MBZUAI(马克斯·普朗克人工智能研究所) Southern University of Science and Technology(南方科技大学) Stony Brook University(石溪大学) University of North Carolina(北卡罗来纳大学)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出一种新的3D计数方法,通过多视角图像估计堆叠物体的3D几何和占用率,解决容器中堆叠物体遮挡问题,验证了在大规模合成和真实数据上的鲁棒性。

Comments This preprint is a journal extension of our ICCV25 Oral paper: https://corentindumery.github.io/projects/stacks.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14909 2026-03-17 cs.CV 57%

TopoVST: Toward Topology-fidelitous Vessel Skeleton Tracking

TopoVST:迈向拓扑忠实的血管骨架跟踪

Yaoyu Liu, Minghui Zhang, Junjun He, Yun Gu

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Shanghai AI Lab(上海人工智能实验室)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出TopoVST,通过多尺度球图和图神经网络实现血管骨架跟踪,结合门控特征融合和几何感知加权方案,有效解决拓扑忠实性和类别不平衡问题,实验表明其在重叠和拓扑指标上表现优异。

Comments 10 pages, 9 figures. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12908 2026-03-17 cs.RO 57%

GoalSwarm: Multi-UAV Semantic Coordination for Open-Vocabulary Object Navigation

GoalSwarm:多无人机语义协调用于开放词汇物体导航

MoniJesu Wonders James, Amir Atef Habel, Aleksey Fedoseev, Dzmitry Tsetserokou

专题命中 感知 :occupancy(abstract);分类 cs.RO

AI总结 本文提出GoalSwarm框架,通过轻量语义地图构建、零样本目标检测和去中心化协调策略,实现多无人机在未知环境中的开放词汇物体导航。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01535 2026-03-17 cs.CV 57%

Benchmarking Semantic Segmentation Models via Appearance and Geometry Attribute Editing

通过外观和几何属性编辑评估语义分割模型

Zijin Yin, Bing Li, Kongming Liang, Hao Sun, Zhongjiang He, Zhanyu Ma, Jun Guo

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出Gen4Seg数据生成管道,通过生成具有不同属性变化的挑战样本来评估语义分割模型,构建了Pascal-EA和COCO-EA两个新基准,发现开放词汇模型在几何变化下不比封闭集方法更鲁棒,数据增强技术在提升外观变化鲁棒性上有限。

Comments Accepted to IEEE TPAMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16443 2026-03-17 cs.CV 57%

VGGT-Long: Chunk it, Loop it, Align it -- Pushing VGGT's Limits on Kilometer-scale Long RGB Sequences

VGGT-Long:分块、循环、对齐——在千米级长RGB序列上推动VGGT的极限

Kai Deng, Zexin Ti, Jiawei Xu, Jian Yang, Jin Xie

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出VGGT-Long,通过分块处理、重叠对齐和轻量循环闭合优化,解决现有模型的可扩展性瓶颈,实现千米级户外环境的单目3D重建。

Comments IEEE International Conference on Robotics & Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11477 2026-03-17 cs.LG cs.AI 57%

TraffiDent: A Dataset for Understanding the Interplay Between Traffic Dynamics and Incidents

TraffiDent: 一个用于理解交通动态与事件相互作用的数据集

Xiaochuan Gou, Ziyue Li, Tian Lan, Junpeng Lin, Zhishuai Li, Bingyu Zhao, Chen Zhang, Di Wang, Xiangliang Zhang

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 TraffiDent数据集首次将交通动态与事件在时空对齐的大型区域(16972个交通节点)中整合,包含交通流量、车道占用率和平均车速的时间序列数据,以及七类事件记录,支持交通-事件交互分析和因果关系研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14309 2026-03-17 cs.CV 57%

In-Field 3D Wheat Head Instance Segmentation From TLS Point Clouds Using Deep Learning Without Manual Labels

基于TLS点云的田间小麦头实例分割:无需手动标注的深度学习方法

Tomislav Medic, Liangliang Nan

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 本文提出一种无需手动标注的深度学习方法,直接从TLS点云中实现田间小麦头实例分割,通过两阶段流程提升分割效果,优于现有基于多视角RGB图像和3D高斯点划法的解决方案。

Comments to be published in ISPRS Annals of Photogrammetry and Remote Sensing at XXV ISPRS Congress, Toronto, Canada, July 2026, 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23194 2026-03-17 cs.CV 57%

Unsupervised Online 3D Instance Segmentation with Synthetic Sequences and Dynamic Loss

无监督在线3D实例分割与合成序列及动态损失

Yifan Zhang, Wei Zhang, Chuangxin He, Zhonghua Miao, Junhui Hou

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 本文提出一种通过合成点云序列生成增强训练分布的新框架,采用灵活的采样策略和动态加权损失,提升3D实例分割的准确性和时间关联性。

Comments Accepted to TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06251 2026-03-17 cs.CV 57%

NexusFlow: Unifying Disparate Tasks under Partial Supervision via Invertible Flow Networks

NexusFlow:通过可逆流网络在部分监督下统一分散任务

Fangzhou Lin, Yuping Wang, Yuliang Guo, Zixun Huang, Xinyu Huang, Haichong Zhang, Kazunori Yamada, Zhengzhong Tu, Liu Ren, Ziming Zhang

机构 * Worcester Polytechnic Institute(沃斯特理工大学) Texas A&M University(德克萨斯A&M大学) Tohoku University(东北大学) University of Michigan(密歇根大学) Bosch Research North America & Bosch Center for AI(博世北美研究与人工智能中心)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 NexusFlow通过可逆耦合层对任务潜在特征分布对齐,实现结构多样任务下的知识迁移,优于现有部分监督基线,在自动驾驶和NYUv2数据集上均取得新突破。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13613 2026-03-17 stat.ML cs.LG math.ST stat.TH 50%

Robust Sequential Tracking via Bounded Information Geometry and Non-Parametric Field Actions

通过有界信息几何和非参数场动作实现鲁棒序列跟踪

Carlos C. Rodriguez

机构 * Department of Mathematics and Statistics(数学与统计学系)

专题命中 感知 :LiDAR(abstract)

AI总结 本文通过分析元先验层面的推断抽象序列,利用非参数场和严格不变的Delta信息分离,解决了序列推断中极端异常值导致的不可归一化问题,实验证明其在多个领域中能有效截断异常值,实现稳健估计。

Comments 1o pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13440 2026-03-17 cs.LG cs.IT math.IT 50%

Improving Channel Estimation via Multimodal Diffusion Models with Flow Matching

通过多模态扩散模型与流匹配改进信道估计

Xiaotian Fan, Xingyu Zhou, Le Liang, Xiao Li, Shi Jin

机构 * School of Information Science and Engineering, Southeast University(信息科学与工程学院,东南大学) Purple Mountain Laboratories(紫金山实验室)

专题命中 感知 :LiDAR(abstract)

AI总结 本文提出基于流匹配和扩散变压器的多模态信道估计框架MultiCE-Flow,通过融合LiDAR、相机和位置数据生成语义条件,利用稀疏试点作为结构条件,实现高保真信道重建,优于传统方法和生成模型。

详情

展开后加载摘要…

URL PDF HTML 收藏