arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-05-27 至 2026-05-27 共收录 23 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 10 篇

2604.12918 2026-05-27 cs.CV 91%

Radar-Camera BEV Multi-Task Learning with Cross-Task Attention Bridge for Joint 3D Detection and Segmentation

雷达-相机BEV多任务学习:用于联合3D检测与分割的跨任务注意力桥

Ahmet İnanç, Özgür Erkent

机构 * Hacettepe University(哈切特佩大学)

专题命中 感知 :BEV(title,title_cn);autonomous driving(abstract);分类 cs.CV

AI总结 提出CTAB(跨任务注意力桥)模块,通过共享BEV空间中的多尺度可变形注意力在检测和分割分支间交换特征,实现联合3D检测与分割的多任务学习,在nuScenes上提升分割性能且检测几乎不受影响。

Comments 8 pages, 5 figures, 3 Tables, Accepted at Radar in Robotics: New Frontiers workshop, at IEEE International Conference on Robotics & Automation (ICRA), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14702 2026-05-27 cs.AI cs.CV cs.RO 82%

Drive-P2D: A Progressive Perception-to-Decision Benchmark for VLMs in Autonomous Driving

Drive-P2D:自动驾驶中视觉语言模型的渐进式感知到决策基准

Zecong Tang, Zixu Wang, Yifei Wang, Weitong Lian, Tianjian Gao, Haoran Li, Tengju Ru, Lingyi Meng, Zhejun Cui, Yichen Zhu, Qi Kang, Kaixuan Wang, Yu Zhang

机构 * Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 提出Drive-P2D基准,通过分离推理与答案的协议,在目标、场景和决策三个层级上评估视觉语言模型的感知到决策能力,并分析错误模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26155 2026-05-27 cs.RO cs.AI cs.LG 82%

When Does Adaptive Guidance Help? Belief-Aware Privileged Distillation for Autonomous Driving Under Partial Observability

自适应引导何时有帮助?部分可观测条件下自动驾驶的信念感知特权蒸馏

Mehmet Haklidir

机构 * TUBITAK BILGEM Artificial Intelligence Institute(土耳其TUBITAK BILGEM人工智能研究所)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出信念感知GSAC(BA-GSAC),通过集成分歧动态调节蒸馏系数,系统研究自适应引导在部分可观测自动驾驶中的有效性,发现严重遮挡下系数过早崩溃,并揭示可观测性盲区问题。

Comments 9 pages, 3 figures, 7 tables. Accepted at CVPR 2026 Workshop on Autonomous Driving (WAD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26642 2026-05-27 cs.CV 81%

Adaptation-Free Heterogeneous Collaborative Perception with Unseen Agent Configurations

无适应异构协同感知:应对未见过的智能体配置

Hyunchul Bae, Heejin Ahn

机构 * School of Electrical Engineering(电气工程学院) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 感知 :BEV(abstract,abstract_cn);LiDAR(abstract,abstract_cn);分类 cs.CV

AI总结 提出ALF框架,通过将轻量级框级消息提升为自车兼容的辅助特征,实现与未见配置智能体的零适应协同感知,在V2X-Real上零样本评估中相对mAP@0.7提升35.91%,带宽仅需约9.6 Kbps。

Comments 9 pages main paper, 23 pages including references and appendix, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08540 2026-05-27 cs.CV 79%

Datasets for Lane Detection in Autonomous Driving: A Comprehensive Review

自动驾驶中车道检测数据集:全面综述

Jörg Gamerdinger, Sven Teufel, Oliver Bringmann

机构 * University of Tübingen, Faculty of Science, Department of Computer Science, Embedded Systems Group(图宾根大学,科学学院,计算机科学系,嵌入式系统小组)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV

AI总结 本文全面综述了20个公开车道检测数据集,通过多维质量指标分析其特性、优势和局限,并指出未来改进方向以推动鲁棒车道检测创新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26830 2026-05-27 cs.LG cs.AI cs.CV 73%

The Kalman Evolve: Closing the Gap in Kalman Filtering via Interpretable Algorithm Discovery

卡尔曼演化:通过可解释算法发现缩小卡尔曼滤波的差距

Vasileios Saketos, Ming Xiao

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 感知 :LiDAR(abstract,abstract_cn);分类 cs.CV、cs.AI

AI总结 针对非线性传感场景下卡尔曼滤波性能下降的问题,提出Kalman Evolve框架,联合优化噪声参数与更新结构,利用大语言模型生成可解释的非仿射修改,在多个基准上实现高达12%的RMSE降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26370 2026-05-27 cs.CV 70%

Joint Instance Segmentation and Geometric Attribute Regression for Roof Structures in Aerial Imagery

航空影像中屋顶结构的联合实例分割与几何属性回归

Luuk Versteeg, Rob G. J. Wijnhoven, Martin R. Oswald

机构 * University of Amsterdam (UvA)(阿姆斯特丹大学)

专题命中 感知 :LiDAR(abstract,abstract_cn);分类 cs.CV

AI总结 提出一种从单张航空正射影像中联合预测屋顶实例分割掩码和三个连续几何属性(建筑高度、屋顶坡度、屋顶方位角)的方法,通过条件方位角损失和对数归一化高度表示解决数据噪声和分布偏斜问题,在荷兰大规模数据集上实现了高精度,并可从单张图像重建简化3D建筑模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26501 2026-05-27 cs.CV cs.AI 62%

Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

揭示视觉-语言模型的脆弱性:通过纹理约束扰动和跨模态优化的多模态对抗协同

Xiang Fang, Wanlong Fang, Changshuo Wang

机构 * School of Software Engineering, Huazhong University of Science and Technology(华中科技大学软件学院) Nanyang Technological University, Singapore(新加坡南洋理工大学) University College London(伦敦大学学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 提出多模态对抗协同框架,通过纹理约束的通用对抗扰动和可学习的文本提示扰动,在黑盒设置下联合优化,揭示视觉-语言模型在多模态攻击下的脆弱性。

Comments Publish in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23327 2026-05-27 cs.CV 57%

GFSR: Geometric Fidelity and Spatial Refinement for Reliable Lane Detection

GFSR:用于可靠车道检测的几何保真度与空间细化

Tiancheng Wang, Zhaolu Ding, Richeng Xu, Tianhui Zheng, Hui Liu, Hanyu Xuan, Zhiliang Wu, Guanghui Yue

机构 * the School of Big Data and Statistics, Anhui University(安徽大学大数据与统计学院) the School of Artificial Intelligence and Data Science, University of Science and Technology of China(中国科学技术大学人工智能与数据科学学院) Institute of Dataspace, Hefei Comprehensive National Science Center(合肥综合性国家科学中心数据空间研究院) the College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) the School of Biomedical Engineering, Shenzhen University Medical School, Shenzhen University(深圳大学医学院生物医学工程学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 针对现有车道检测方法中分类置信度与几何质量脱节、回归模块弱化采样点关联导致复杂场景性能下降的问题,提出包含LaneIoU引导的置信度校准和自适应门控位置细化的GFSR框架,在CULane和CurveLanes上取得最优结果。

Comments Submitted to IEEE Transactions on Intelligent Transportation Systems. 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09606 2026-05-27 cs.CV 57%

SpaceVista: All-Scale Visual Spatial Reasoning from mm to km

SpaceVista:从毫米到公里的全尺度视觉空间推理

Peiwen Sun, Shiqiang Lang, Dongming Wu, Yi Ding, Kaituo Feng, Huadai Liu, Zhen Ye, Rui Liu, Yun-Hui Liu, Jianan Wang, Xiangyu Yue

机构 * Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室) Beijing University of Posts(北京邮电大学) Hong Kong University of Science(香港理工大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出全尺度空间推理解决方案,通过结构化知识系统、尺度感知建模和渐进训练范式,构建SpaceVista-1M数据集(38K视频场景、约1M空间QA对)和SpaceVista-7B模型,在5个基准上展现强泛化能力。

Comments Project Page: https://peiwensun2000.github.io/mm2km/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 5 篇

2406.03474 2026-05-27 cs.CV 79%

AD-H: Language-guided Autonomous Driving with Hierarchical Agents

AD-H:基于分层智能体的语言引导自动驾驶

Zaibin Zhang, Talas Fu, Shiyu Tang, Yuanhang Zhang, Yifan Wang, Lijun Wang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.CV

AI总结 提出AD-H分层多智能体框架,上层MLLM规划器生成中层驾驶指令,下层轻量控制器执行连续动作,通过规则重建1.15M中层指令对,以3B+350M参数超越7B模型,实现长时域泛化与指令遵循。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26928 2026-05-27 eess.SP 67%

NF-TrackLLM: Joint Prediction of UAV Trajectory and Near-Field Beam for LAE XL-MIMO Systems

NF-TrackLLM:用于LAE XL-MIMO系统的无人机轨迹与近场波束联合预测

Qianfan Lu, Mengyuan Li, Jiachen Tian, Yu Han, Xiao Li, Shi Jin

专题命中 规划控制 :LiDAR(abstract,abstract_cn)

AI总结 提出NF-TrackLLM框架,通过多模态语义感知和GPT-2时空推理,联合预测近场XL-MIMO系统中无人机轨迹和波束,实现高精度跟踪与波束预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26577 2026-05-27 eess.SY cs.AI cs.LG cs.SY math.OC 57%

Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial

桥接控制与神经网络验证器 alpha-beta-CROWN:教程

Haoyu Li, Xiangru Zhong, Hao Cheng, Bin Hu, Huan Zhang

机构 * Department of Computer Science(计算机科学系) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.AI

AI总结 本教程提出一个统一框架,通过将控制问题与神经网络验证器 α,β-CROWN 桥接,实现控制器属性的可扩展形式验证。

Comments ACC 2026 Tutorial

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26406 2026-05-27 cs.NI 50%

mmDiff: A Noise-Robust Differentiable Ray-Tracing Framework for mmWave Scene Calibration and Channel Prediction

mmDiff: 一种用于毫米波场景校准和信道预测的噪声鲁棒可微分光线追踪框架

Haofan Lu, Yadi Cao, Wanghao Yi, Omid Abari

专题命中 规划控制 :LiDAR(abstract)

AI总结 针对重建模型几何噪声导致无线仿真不准确的问题,提出可微分方向散射模型近似镜面反射,实现噪声鲁棒的信道预测与材料校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23015 2026-05-27 cond-mat.mes-hall 50%

Effects of electron-electron interaction and spin-orbit coupling on Andreev pair qubits in quantum dot Josephson junctions

电子-电子相互作用和自旋-轨道耦合对量子点约瑟夫森结中Andreev对量子比特的影响

Teodor Iličin, Rok Žitko

专题命中 规划控制 :occupancy(abstract)

AI总结 研究自旋-轨道耦合和电子-电子相互作用如何通过混合单占据YSR成分增强Andreev对量子比特中的自旋跃迁,并探讨其对退相干和量子转导的影响。

Comments 42 pages, 18 figures; v3 update has improved discussion of symmetries, a new section on effects of p-h asymmetry, and improved discussion of experimental observability, parity control and parity lifetimes

Journal ref SciPost Phys. 20, 147 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. BEV与占用 3 篇

2605.26500 2026-05-27 cs.CV 57%

3D Gaussian Map with Open-Set Semantic Grouping for Vision-Language Navigation

面向视觉-语言导航的开放集语义分组3D高斯地图

Jianzhe Gao, Rui Liu, Wenguan Wang

机构 * The State Key Lab of Brain-Machine Intelligence(脑机智能国家重点实验室)

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.CV

AI总结 提出一种3D高斯地图表示环境,通过在线构建自中心场景地图和开放集语义分组操作增强几何与语义信息,并设计多层级动作预测策略,在三个公开基准上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27021 2026-05-27 eess.SY cs.SY 50%

In-Orbit Intelligence or Ground Offloading? Inference Freshness under Intermittent Satellite Connectivity

在轨智能还是地面卸载?间歇性卫星连接下的推理新鲜度

Ayse Nur Pehlivanoglu, Aimin Li, Elif Uysal

专题命中 BEV与占用 :occupancy(abstract)

AI总结 针对低轨卫星间歇性连接下的推理新鲜度优化问题,提出一种混合策略,通过半马尔可夫决策过程建模并求解,在减少卫星计算和通信资源需求的同时降低平均推理年龄。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00946 2026-05-27 astro-ph.EP 50%

Near-Earth asteroids in Main Belt-crossing orbits

主带穿越轨道上的近地小行星

P. S. Zain, R. P. Di Sisto, R. Gil-Hutton

专题命中 BEV与占用 :occupancy(abstract)

AI总结 通过N体模拟和碰撞演化模型,研究了主带穿越轨道上的近地小行星的动力学与碰撞演化,揭示了其轨道寿命、主带驻留时间分布及碰撞对表面和总体大小频率分布的影响。

Comments Accepted by Astronomy&Astrophysics

Journal ref A&A 709, A261 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 激光雷达 3 篇

2603.12647 2026-05-27 cs.CV cs.AI 88%

LR-SGS: Robust LiDAR-Reflectance-Guided Salient Gaussian Splatting for Self-Driving Scene Reconstruction

LR-SGS:用于自动驾驶场景重建的鲁棒激光雷达反射率引导显著高斯泼溅

ZY Chen, F Zhu, H Zhu, DY Kong, XK Kuang, YJ Zhang, CM Jiang

机构 * Waymo Open Dataset(Waymo开放数据集)

专题命中 激光雷达 :self-driving(title,abstract);LiDAR(title,abstract);分类 cs.CV、cs.AI

AI总结 提出一种结合激光雷达反射率与RGB的显著高斯表示方法,通过结构感知初始化、反射率校准和联合对齐,实现高效鲁棒的自动驾驶场景重建。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26456 2026-05-27 cs.CV 79%

Sparse-LiDAR Prompting of Monocular Geometry Foundations: An Empirical Study Toward Long-Range Driving Depth

稀疏激光雷达提示的单目几何基础:面向长距离驾驶深度的实证研究

Kai Zheng, Qiang Feng, Xingjian Liu, Wenquan Tan, Yuan Li

机构 * Benewake (Beijing) Co., Ltd.(北京 Benewake 公司)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 本文提出SLIM,首次将MoGe-2适配为接受真正稀疏激光雷达输入,通过部分卷积稀疏编码器和多尺度融合网络,在长距离(100-150米)将绝对相对误差降低39-51%。

Comments 6 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26455 2026-05-27 physics.optics 67%

High-resolution mid-infrared single-photon upconversion ranging

高分辨率中红外单光子上转换测距

Shuhong Jiang, Kun Huang, Tingting Yu, Jianan Fang, Ben Sun, Yan Liang, Qiang Hao, E Wu, Ming Yan, Heping Zeng

专题命中 激光雷达 :LiDAR(abstract,abstract_cn)

AI总结 通过非线性异步光学采样和时间相关光子计数技术,实现了中红外单光子灵敏度和亚微米级测距精度。

Journal ref Photonics Research 12, 1294 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仿真评测 2 篇

2605.20255 2026-05-27 cs.LG cs.AI cs.HC cs.RO 81%

Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty

行人行为不确定性下安全自动驾驶的多智能体强化学习

Prakash Aryan, Kaushik Raghupathruni, Timo Kehrer, Sebastiano Panichella

机构 * University of Bern(伯恩大学) AI4I, The Italian Institute of Artificial Intelligence(意大利人工智能研究所)

专题命中 仿真评测 :autonomous driving(title);self-driving(abstract);分类 cs.RO、cs.AI

AI总结 本文使用多智能体近端策略优化(MAPPO)联合训练自动驾驶汽车和12个行人,通过隐藏的行人特质模拟乱穿马路行为,相比固定策略基线显著降低了碰撞率,并揭示了速度差异指标可用于检测未预期的乱穿马路行为。

Comments Accepted to ICRA 2026 Workshop "8th Workshop on Long-term Human Motion Prediction"

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27038 2026-05-27 cs.RO 79%

TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving

TPS-Drive: 基于VLM的自动驾驶任务引导表示净化

Jiaxiang Li, Yumao Liu, Ke Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.RO

AI总结 提出TPS-Drive框架,通过任务引导的表示净化(Agent-Centric Tokenizer)解决VLM在自动驾驶中的空间幻觉和表示干扰问题,实现精确的3D空间预测与安全规划。

详情

展开后加载摘要…

URL PDF HTML 收藏