arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-06-19 至 2026-06-19 共收录 17 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 5 篇

2606.19675 2026-06-19 cs.RO 新提交 81%

ForEnt: A Multi-Modal Dataset for Characterizing Quadruped Robot Entrapments in Forest Environments

ForEnt: 用于表征四足机器人在森林环境中被困的多模态数据集

Natapat Kirdwichai, Danesh Tarapore

机构 * University of Southampton(南安普顿大学)

专题命中 感知 :LiDAR(summary_cn,abstract);分类 cs.RO

AI总结 针对四足机器人在森林中因植被缠绕而倾覆的问题,提出多模态数据集ForEnt,包含RGB-D、LiDAR、本体感知和第三人称视频,记录69次被困事件,支持可重复的基准测试。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10688 2026-06-19 cs.RO 新提交 79%

Self-Supervised Relevance Modelling in Autonomous Driving via Counterfactual Analysis

自动驾驶中基于反事实分析的自监督相关性建模

Luca Lusvarghi, Javier Gozalvez, Pablo Urbano Hidalgo

机构 * Networked Systems Lab, Universidad Miguel Hernandez de Elche(网络系统实验室,米格尔·希内斯·埃尔切大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO

AI总结 提出一种基于反事实分析的自监督方法,用于量化自动驾驶中物体的相关性,实现毫秒级实时估计,并生成相关性热图以辅助感知与规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18112 2026-06-19 cs.RO cs.CV 新提交 62%

Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System

Qwen-RobotNav 技术报告:为智能体导航系统设计的可扩展导航模型

Jiazhao Zhang, Gengze Zhou, Hale Yin, Yiyang Huang, Zixing Lei, Qihang Peng, Haoqi Yuan, Jie Zhang, Xudong Guo, Xiaoyue Chen, An Yang, Fei Huang, Zhibo Yang, Junyang Lin, Dayiheng Liu, Jingren Zhou, Zhuoyuan Yu, Jingyang Fan, Zhixuan Liang, Pei Lin, Ye Wang, Haoyang Li, Anzhe Chen, Kun Yan, Xiao Xu, Jiahao Li, Lulu Hu, Minying Zhang, Shurui Li, Wenhu Xiao, Shuai Bai, Xuancheng Ren, Chenxu Lv, Chenfei Wu, Xiong-Hui Chen

机构 * Qwen Team(通义实验室)

专题命中 感知 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 提出 Qwen-RobotNav 可扩展导航模型,通过参数化接口支持多种任务模式和可调观测参数,在15.6M样本上训练,联合视觉语言数据防止行为坍缩,在多个导航基准上取得新最优结果,并展示零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19555 2026-06-19 cs.RO 新提交 57%

SCAN-Planner: Spatial Collision-Aware Local Planning for Route-Guided Long-Range Quadruped Navigation

SCAN-Planner:用于路线引导的远程四足导航的空间碰撞感知局部规划

Han Zheng, Zhe Chen, Yiwen Fu, Ming Yang, Tong Qin

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 感知 :occupancy(abstract);分类 cs.RO

AI总结 提出SCAN-Planner框架,通过偏航感知双圆柱足迹和投影A*搜索实现空间碰撞感知的局部规划,在密集杂乱、3D非结构化环境和远程导航中生成安全平滑轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09969 2026-06-19 hep-th cs.IT gr-qc hep-ph math.IT 新提交 50%

Calling the Brane Next Door: The Kaluza-Klein Tower as a Gravitational Information Channel

呼唤隔壁的膜:卡鲁扎-克莱因塔作为引力信息通道

Karim Benakli

专题命中 感知 :occupancy(abstract)

AI总结 研究邻近膜世界通过引力通信的可能性,提出将卡鲁扎-克莱因塔视为多输入多输出通信信道,分析其信道矩阵和信息论特性。

Comments 17 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 1 篇

2606.20120 2026-06-19 cs.RO cs.AI 新提交 62%

Dual-Agent Framework for Cross-Model Verified Translation of Natural-Language Protocols into Robotic Laboratory Platform

用于将自然语言协议翻译为机器人实验室平台的双智能体跨模型验证框架

Hyeonna Choi, Jung Yup Kim, Hyuneui Lim, Seunggyu Jeon

机构 * Department of Bionic Machinery, Research Institute of AI Robot, Korea Institute of Machinery & Materials(生物机械系、人工智能机器人研究所、韩国机械材料研究院)

专题命中 规划控制 :self-driving(abstract);分类 cs.RO、cs.AI

AI总结 提出双智能体框架,通过解析器形式化协议、规则映射引擎生成控制命令、异构LLM验证器纠错,实现自然语言微孔板协议到机器人平台可执行命令的转换,并验证了端到端自主执行。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 2 篇

2606.19836 2026-06-19 cs.RO cs.CV 新提交 84%

World Engine: Towards the Era of Post-Training for Autonomous Driving

World Engine:迈向自动驾驶后训练时代

Tianyu Li, Li Chen, Caojun Wang, Haochen Liu, Kashyap Chitta, Zhenjie Yang, Yuhang Lu, Naisheng Ye, Yihang Qiu, Yufei Wang, Luoxi Zou, Jiaxin Peng, Jin Pan, Zhaoyu Su, Andrei Bursuc, Shengbo Eben Li, Andreas Geiger, Peng Su, Hongyang Li

机构 * The University of Hong Kong(香港大学) Huawei(华为) Shanghai Innovation Institute(上海创新研究院) Archon Robotics(Archon机器人) KE:SAI NVIDIA Research(NVIDIA研究) NTU(南洋理工大学) Tsinghua University(清华大学)

专题命中 端到端驾驶 :autonomous driving(title,abstract);end-to-end driving(abstract);分类 cs.RO、cs.CV

AI总结 提出World Engine生成式框架,通过从真实日志重建高保真交互环境并外推安全关键变体,利用强化后训练对齐策略与安全约束,显著减少罕见安全关键场景故障,提升自动驾驶安全性。

Comments Technical Report. Project Page: https://opendrivelab.com/WorldEngine/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20274 2026-06-19 cs.AI 新提交 83%

Lagrange: An Open-Vocabulary, Energy-Based Sparse Framework for Generalized End-to-End Driving

Lagrange: 一种面向通用端到端驾驶的开放词汇、基于能量的稀疏框架

Shihao Ji, HongXi Li, Zihui Song, Mingyu Li

专题命中 端到端驾驶 :end-to-end driving(title);autonomous driving(abstract);occupancy(abstract);分类 cs.AI

AI总结 提出Lagrange框架,利用掩码潜在场和视觉语言模型实现开放词汇、稀疏计算,通过拉格朗日动作最小化确保运动学约束,在nuScenes和CODA基准上验证了鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 3 篇

2606.19776 2026-06-19 cs.CV 新提交 79%

Occ-VLM: Occupancy Grounded Vision Language Model for Indoor Scene Understanding

Occ-VLM: 面向室内场景理解的占用接地视觉语言模型

Jianing Li, Zhou Fang, Yijiang Liu, Li Du

机构 * School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与工程学院)

专题命中 BEV与占用 :occupancy(title,abstract);分类 cs.CV

AI总结 提出Occ-VLM,仅用姿态RGB图像和单一2D视觉编码器,通过重建3D占用作为几何先验,实现统一的3D场景理解,在占用预测、3D VQA和密集描述任务上达到领先水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20352 2026-06-19 physics.flu-dyn 新提交 50%

Planar Lagrangian transport and scalar-gradient organization in a turbulent reacting shear layer

湍流反应剪切层中的平面拉格朗日输运与标量梯度组织

Sriram P. Kalathoor, Joseph C. Oefelein

专题命中 BEV与占用 :occupancy(abstract)

AI总结 通过三维直接数值模拟的时均中平面数据,结合有限时间李雅普诺夫指数场、柯西-格林变形测度及双曲测地线拉格朗日相干结构提取,分析了超音速反应氢气-空气混合层中的平面拉格朗日输运与标量梯度组织,揭示了有限时间拉伸对反应剪切层结构的组织作用。

Comments 20 pages, 23 figures, 19 tables, to be submitted to Chaos

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20425 2026-06-19 cond-mat.str-el 新提交 50%

Non-Hermitian Skin Effect Enhances Pairing Correlations in Moiré Hubbard Systems

非厄米趋肤效应增强莫尔哈伯德系统中的配对关联

Yang Zhou, Jianwen Chen, Ruipeng Wei

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文发现非厄米趋肤效应通过通道选择性机制增强莫尔哈伯德系统中的配对关联,在非互易强度γ∈[0.5,1.2]t的“黄金窗口”内,边界态密度增大,局域配对倾向增强,双占据数非单调变化,配对磁化率在3×3团簇上提升98%。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 5 篇

2606.20103 2026-06-19 cs.CV 新提交 90%

Geometry-Preserving in 3D Gaussian Splatting for LiDAR-Camera Extrinsic Calibration

3D高斯溅射中保持几何结构的LiDAR-相机外参标定

Kyoleen Kwak, Daeho Kim, Jeong Woon Lee, Hyoseok Hwang

机构 * Kyung Hee University(庆熙大学)

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.CV

AI总结 针对LiDAR-相机标定中跨模态特征稀缺问题,提出通过多视图LiDAR深度监督和阻止光度梯度更新高斯空间参数来保持3DGS代理的度量几何,提升标定精度。

Comments Accepted to ECCV 2026. 15 pages (excluding references), 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20455 2026-06-19 cs.CV 新提交 83%

PCFootprint: A Large-Scale Dataset and Benchmark for Vectorized Building Footprint Extraction from Aerial LiDAR Point Clouds

PCFootprint:用于从航空LiDAR点云中提取矢量化建筑足迹的大规模数据集与基准

Haoyuan Shen, Kuihao Wang, Ruisheng Wang, Yujun Liu

机构 * School of Architecture and Urban Planning, Shenzhen University(深圳大学建筑与城市规划学院)

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.CV

AI总结 提出首个大规模航空激光扫描点云建筑足迹提取数据集PCFootprint,含33000个瓦片及跨域测试集,通过评估主流方法揭示复杂地理环境下的挑战。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19929 2026-06-19 cs.RO 新提交 81%

Motor Angular Speed Preintegration for Multirotor UAV State Estimation

多旋翼无人机状态估计中的电机角速度预积分

Matěj Petrlík, Filip Novák, Robert Pěnička, Martin Saska

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(电子工程系控制学系,布拉格捷克技术大学)

专题命中 激光雷达 :LiDAR(summary_cn,abstract);分类 cs.RO

AI总结 针对无人机振动导致IMU精度下降的问题,提出基于电机转速加速度预积分的方法,替代IMU进行状态传播,并构建因子用于图优化,结合LiDAR形成MAS-LO算法,相比LIO-SAM位置精度提升28%,速度精度提升65%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20424 2026-06-19 cs.RO 新提交 79%

LIT-GS: LiDAR-Inertial-Thermal Gaussian Splatting for Illumination-Robust Mapping

LIT-GS: 面向光照鲁棒建图的激光雷达-惯性-热高斯泼溅

Shikuan Shi, Chunran Zheng, Jiaming Xu, Tianyong Ye, Tao Yu, Yukang Cui

机构 * College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院) Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.RO

AI总结 提出LIT-GS框架,利用激光雷达平面几何约束联合优化位姿与高斯,解决光照变化和纹理缺失场景下RGB依赖的脆弱性问题,提升几何精度与渲染质量。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20291 2026-06-19 cs.LG cs.CV 新提交 79%

Integrating national forest inventory, airborne lidar, and satellite imagery for wall-to-wall mapping of forest structure with computer vision

整合国家森林清查、机载激光雷达和卫星影像,利用计算机视觉实现森林结构的全覆盖制图

Luke J. Zachmann, David D. Diaz, Vincent A. Landau, Chelsey Walden-Schreiner, Tony Chang, Nathan E. Rutenbeck, Katharyn A. Duffy, Kiarie Ndegwa, Andreas Gros, Scott Conway, Guy Bayes

机构 * Vibrant Planet Public Benefit Corporation(Vibrant Planet 公益公司)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 提出VibrantForests框架,结合卫星影像、激光雷达样本和计算机视觉,以10米分辨率生成美国本土的冠层覆盖、高度、生物量等森林属性图,减少饱和与回归均值问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2606.20110 2026-06-19 cs.CV 新提交 57%

FrozenDrive: Zero-Shot Text-Guided Driving Scene Generation and Data Augmentation with Parameter-Free Frozen Diffusion Model

FrozenDrive: 零样本文本引导驾驶场景生成与数据增强的无参数冻结扩散模型

Yuhwan Jeong, Hyeonseong Kim, Daehyun We, Seonkyu Song, Jinnyeong Yang, Hyun-Kurl Jang, Youngho Yoon, Kuk-Jin Yoon

机构 * KAIST, Visual Intelligence Lab(韩国科学技术院视觉智能实验室)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出FrozenDrive框架,利用冻结的预训练扩散模型,通过知识保留的时空注意力实现多视图一致性和时间连贯性,无需微调即可生成恶劣天气下的驾驶场景,提升自动驾驶模型鲁棒性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏