arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-06-17 至 2026-06-17 共收录 13 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 3 篇

2606.18242 2026-06-17 cs.CV 新提交 57%

EventDrive: Event Cameras for Vision-Language Driving Intelligence

EventDrive: 用于视觉-语言驾驶智能的事件相机

Dongyue Lu, Rong Li, Ao Liang, Lingdong Kong, Wei Yin, Lai Xing Ng, Benoit R. Cottereau, Camille Simon Chane, Wei Tsang Ooi

机构 * NUS(新加坡国立大学) HKUST(GZ)(香港科技大学(广州)) Horizon Robotics(地平线机器人) A*STAR, I2R(新加坡科技研究局,资讯通信研究院) IPAL, CNRS IRL 2955, Singapore(IPAL,法国国家科学研究中心国际联合实验室2955,新加坡) University Toulouse, CNRS, CerCo, Toulouse, France(图卢兹大学,法国国家科学研究中心,CerCo,法国图卢兹) ETIS UMR 8051, CY Cergy Paris University, ENSEA, CNRS, France(ETIS UMR 8051,CY塞尔吉-巴黎大学,ENSEA,法国国家科学研究中心,法国)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 提出EventDrive基准和模型套件,通过多时域事件金字塔和时域混合专家模块融合事件流与RGB帧,在感知、理解、预测和规划四维度提升驾驶推理性能。

Comments CVPR2026, 34 pages, 15 figures, 15 tables, project page: https://dylanorange.github.io/projects/eventdrive

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17982 2026-06-17 cs.RO 新提交 57%

LAGO Policy: Latency-Aware Asynchronous Diffusion Policies with Goal-Directed Collision-Free Planning for Smooth Manipulation

LAGO策略:面向平滑操作的延迟感知异步扩散策略与目标导向无碰撞规划

Guowei Shi, Xupeng Xie, Yiming Luo, Jian Guo, Jun Ma, Boyu Zhou

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) International Digital Economy Academy(国际数字经济学院) The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 提出LAGO策略,通过延迟感知条件引导和时空轨迹优化,解决异步扩散策略的间断和碰撞问题,实现平滑安全的操作。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17630 2026-06-17 cs.RO 新提交 57%

FLAP: FOV-Constrained Active Perception Planning for Prior-Map-Free 3D Navigation

FLAP: 面向无先验地图3D导航的视场约束主动感知规划

Mengke Zhang, Sitong Li, Tiancheng Lai, Ruitian Pang, Mingxuan Zhang, Qingcheng Chen, Fei Gao, Chao Xu, Yanjun Cao

机构 * The State Key Laboratory of Industrial Control Technology, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院工业控制技术国家重点实验室) Huzhou Institute, Zhejiang University(浙江大学湖州研究院) Huzhou Key Laboratory of Autonomous System(湖州市自动驾驶系统重点实验室) Shanghai Institute of Special Equipment Inspection and Technical Research Co., Ltd(上海市特种设备监督检验技术研究院有限公司)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 提出一种将主动感知直接融入轨迹优化的规划框架,通过传感器坐标系下的视场几何约束和速度触发机制,在保证安全的同时提升效率,并支持任意3D机动。

Comments 18 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 2 篇

2606.17082 2026-06-17 cs.RO cs.AI 新提交 89%

ParkingTransformer: LLM-Enhanced End-to-End Trajectory Planning for Autonomous Parking

ParkingTransformer: 基于大语言模型增强的端到端自主泊车轨迹规划

Hauteng Wu, Xu Li, Dong Kong, Zihang Wang, Xieyuanli Chen, Benwu Wang, Wenkai Zhu

机构 * School of Instrument Science and Engineering, Southeast University(东南大学仪器科学与工程学院) School of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) College of Transportation, Shandong University of Science and Technology(山东科技大学交通学院) National University of Defense Technology(国防科技大学)

专题命中 规划控制 :BEV(summary_cn,abstract);trajectory planning(title);autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 提出ParkingTransformer框架,利用多视角感知和大语言模型场景理解能力,结合轨迹查询与隐状态特征,直接输出规划轨迹,无需密集BEV表示,通过3D位置编码、固定窗口流机制和粗到细解码策略提升性能,在CARLA和实车实验中验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17897 2026-06-17 cs.AI cs.RO 新提交 62%

Learn to Quantify Social Interaction with Constraints for Pedestrian Walking

学习量化行人行走中的社交互动约束

Xiaodan Shi

机构 * Department of Computer and Systems Sciences, Stockholm University(斯德哥尔摩大学计算机与系统科学系)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 提出Learn to Cluster方法,通过概率潜变量生成模型从轨迹观测中无监督学习社交互动模式,并有效集成到行人轨迹预测中,提升预测鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. BEV与占用 3 篇

2606.17536 2026-06-17 cs.CV cs.AI 新提交 85%

OmniDrive: An LLM-Choreographed Multi-Agent World Model with Unified Latent Co-Compression for Multi-View Driving Video Generation

OmniDrive: 一种由LLM编排的多智能体世界模型,用于多视角驾驶视频生成的统一潜在协同压缩

Zijie Meng, Yufei Liu, Chengqian Ma, Zhiyu Li, Jiyuan Liu, Wenhua Nie, Bingcai Wei, Shuqin Chen, Weichen Xu, Jiquan Yuan, Miao Zhang

机构 * Peking University(北京大学) Xiamen University(厦门大学) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) National Taiwan University(国立台湾大学) Wuhan University(武汉大学) Wuhan University of Technology(武汉理工大学) Tsinghua University(清华大学) Jimei University(集美大学)

专题命中 BEV与占用 :BEV(summary_cn,abstract);autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 提出DRIVE-CHOREO,一种由LLM编排的多智能体世界模型,通过三个Qwen2.5-VL智能体协同生成位置感知的潜在序列,并利用视图-时间置换与3D VAE协同压缩,实现可控多视角视频生成,在nuScenes上达到SOTA多视角一致性和BEV mAP 21.6。

Comments 24 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17080 2026-06-17 cs.RO cs.AI cs.CV 新提交 83%

HRDX: A Large-Scale Vector HD-Map Dataset

HRDX:大规模矢量高清地图数据集

Sahith Reddy Chada, Isht Dwivedi, Nirav Savaliya

机构 * Honda Research Institute US(本田美国研究院)

专题命中 BEV与占用 :BEV(abstract,abstract_cn);autonomous driving(abstract);LiDAR(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 提出HRDX大规模矢量高清地图数据集,覆盖1400公里驾驶数据,含10类地图元素和20多种属性,并引入复合评分评估几何与属性准确性。

Comments https://usa.honda-ri.com/hrdx

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18020 2026-06-17 cond-mat.stat-mech physics.bio-ph 新提交 50%

Equilibrium cluster statistics of cooperative and anticooperative binding on finite one-dimensional rings

有限一维环上协同和反协同结合的平衡簇统计

Thomas Alfonsi, Jérôme Dorignac, John Palmeri, Nils-Ole Walliser

专题命中 BEV与占用 :occupancy(abstract)

AI总结 研究有限一维环上晶格气体模型的平衡簇统计,通过精确推导平均占据数、畴壁数和簇数等表达式,揭示了协同和反协同相互作用下的空间组织变化及有限尺寸和奇偶效应。

Comments 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 激光雷达 3 篇

2606.17562 2026-06-17 cs.CR cs.SY eess.SY 新提交 89%

Anywhere, Any-Stymie: Remote Activation of Trojan Malware on LiDAR with Modulated Signals

任意地点,任意干扰:利用调制信号远程激活LiDAR上的特洛伊恶意软件

R. Spencer Hallyburton, Miroslav Pajic

专题命中 激光雷达 :LiDAR(title,title_cn)

AI总结 本研究设计了一种嵌入LiDAR固件的特洛伊恶意软件,并利用光学触发通过调制信号远程激活,实现虚假目标注入和真实目标抑制,威胁自动驾驶安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17908 2026-06-17 quant-ph 新提交 78%

Twin-beam advantage in quantum LiDAR under correlated noise

相关噪声下量子激光雷达的双光束优势

Valeria Cimini

专题命中 激光雷达 :LiDAR(title,abstract)

AI总结 研究在相关噪声环境下,使用双光束纠缠态和零差探测实现目标距离与速度联合估计,发现纠缠在相关干扰下提供超越局部压缩的鲁棒性优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18067 2026-06-17 physics.optics physics.app-ph 新提交 50%

Kerr Soliton Generation in Ultra-Compact Photonic Devices

超紧凑光子器件中的克尔孤子产生

Garrett J. Beals, Yun Zhao, Sai Kanth Dacha, James Eckstein, Karl McNulty, Michal Lipson, Alexander L. Gaeta

专题命中 激光雷达 :LiDAR(abstract)

AI总结 本文在紧凑螺旋微谐振器中实现了确定性和高稳定的克尔孤子梳,间距低至16 GHz,并通过快速反馈回路克服热不稳定性,实现孤子态的稳定和控制。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 多传感器融合 1 篇

2606.17534 2026-06-17 cs.RO 新提交 70%

RICH-SLAM: Radar SLAM with Incremental and Continuous Hilbert Mapping

RICH-SLAM:基于增量连续希尔伯特映射的雷达SLAM

Bingbing Zhang, Huan Yin, Yang Xu, Shuo Liu, Shaojie Shen, Fumin Zhang, Wen Xu

机构 * State Key Laboratory of Ocean Sensing, Zhejiang University(浙江大学海洋传感国家重点实验室) Interdisciplinary Student Training Platform for Marine areas, Zhejiang University(浙江大学海洋交叉学科学生培养平台) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港科技大学电子与计算机工程系) School of AI and Robotics, Hunan University(湖南大学人工智能与机器人学院) Ocean College, Zhejiang University(浙江大学海洋学院) Institute of Deep-Sea Science and Engineering, Chinese Academy of Sciences(中国科学院深海科学与工程研究所)

专题命中 多传感器融合 :LiDAR(abstract);occupancy(abstract);分类 cs.RO

AI总结 提出RICH-SLAM框架,采用Rao-Blackwellized粒子滤波后端和增量希尔伯特空间降秩高斯过程映射,从稀疏雷达测量中构建连续占用地图,并支持不确定性感知规划。

Comments 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2606.17362 2026-06-17 cs.CV cs.AI cs.LG cs.RO 新提交 82%

DriveJudge: Rethinking Autonomous Driving Evaluation with Vision-Language Models

DriveJudge: 用视觉-语言模型重新思考自动驾驶评估

Xinglong Sun, Kevin Xie, Jenny Schmalfuss, Despoina Paschalidou, Xiuming Zhang, Sanja Fidler, Kashyap Chitta, Jose M. Alvarez

机构 * NVIDIA(英伟达)

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 提出DriveJudge,结合规则评估与VLM推理,通过选择性调用物理规则函数实现可解释且上下文感知的驾驶评估,在驾驶质量分类和轨迹偏好选择任务上超越现有方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏