arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

共收录 3758 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. BEV与占用 3758 篇

2604.25388 2026-04-29 cs.CV cs.RO 62%

COMPASS: COmpact Multi-channel Prior-map And Scene Signature for Floor-Plan-Based Visual Localization

COMPASS:基于平面图的多通道先验图与场景签名用于基于平面图的视觉定位

Muhammad Shaheer, Miguel Fernandez-Cortizas, Asier Bikandi-Noya, Holger Voos, Jose Luis Sanchez-Lopez

机构 * Automation and Robotics Research Group, Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg (UL)(自动化与机器人研究组,安全、可靠性与信任跨学科中心(SnT),卢森堡大学(UL))

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 本文提出COMPASS算法,利用平面图中的几何和语义先验信息,通过多通道径向描述符估计配备双鱼眼相机的机器人姿态,验证了跨模态结构匹配的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18484 2026-04-21 cs.CV cs.MM cs.RO 62%

XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments

XEmbodied:一种具有增强几何和物理线索的大型规模具身环境基础模型

Kangan Qian, ChuChu Xie, Yang Zhong, Jingrui Pang, Siwen Jiao, Sicong Jiang, Zilin Huang, Yunlong Wang, Kun Jiang, Mengmeng Yang, Hao Ye, Guanghao Zhang, Hangjun Ye, Guang Chen, Long Chen, Diange Yang

机构 * Tsinghua University(清华大学) Automotive and Robotics, Xiaomi Corporation(小鹏汽车与机器人部,小鹏科技) National University of Singapore(新加坡国立大学) McGill University(麦吉尔大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.RO、cs.CV

AI总结 XEmbodied通过整合3D几何表示和物理线索,提升视觉-语言-动作模型在大规模具身环境中的空间推理和语义理解能力,其在18个公开基准测试中表现出色。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16482 2026-04-21 cs.CV cs.RO 62%

A Survey of Spatial Memory Representations for Efficient Robot Navigation

一种用于高效机器人导航的空间记忆表示综述

Ma. Madecheen S. Pangaliman, Steven S. Sison, Erwin P. Quilloy, Rowel Atienza

机构 * University of the Philippines Diliman(菲律宾大学杜马扬分校) University of Santo Tomas(圣托马斯大学)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.RO、cs.CV

AI总结 本文综述了88篇文献,探讨了空间记忆效率问题,提出α指标评估部署可行性,揭示了内存架构对实际部署的影响。

Comments Accepted at the Women in Computer Vision (WiCV) Workshop at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01134 2026-04-02 cs.RO cs.DB eess.IV 62%

VRUD: A Drone Dataset for Complex Vehicle-VRU Interactions within Mixed Traffic

VRUD:一种用于复杂车辆-行人交互的无人机数据集

Ziyu Wang, Hongrui Kou, Cheng Wang, Ruochen Li, Hubert P. H. Shum, Amir Atapour-Abarghouei, Yuxin Zhang

机构 * National Key Laboratory of Automotive Chassis Integration and Bionics, Jilin University(吉林大学汽车底盘集成与仿生全国重点实验室) DRIVEResearch School of Engineering and Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院) Department of Computer Science, Durham University(杜伦大学计算机科学系)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、eess.IV

AI总结 本文提出VRUD数据集,用于复杂城市交通环境中的车辆-行人交互研究,包含高精度轨迹数据和多智能体交互场景,填补了现有数据集在无结构城市环境中的空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19328 2026-03-13 cs.LG cs.AI cs.CV 62%

Capturing Temporal Dynamics in Large-Scale Canopy Tree Height Estimation

在大规模树冠高度估计中捕捉时间动态

Jan Pauls, Max Zimmer, Berkant Turan, Sassan Saatchi, Philippe Ciais, Sebastian Pokutta, Fabian Gieseke

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 本文提出了一种基于Sentinel-1和Sentinel-2数据生成欧洲大陆2019-2022年10米分辨率时间树冠高度地图的方法,利用GEDI激光雷达数据提升精度,实现大范围森林监测。

Comments ICML Camera-Ready, 9 pages main paper, 8 pages references and appendix, 9 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10847 2026-03-12 cs.RO cs.AI 62%

Semantic Landmark Particle Filter for Robot Localisation in Vineyards

语义地标粒子滤波器用于葡萄园中机器人的局部化

Rajitha de Silva, Jonathan Cox, James R. Heselden, Marija Popović, Cesar Cadena, Riccardo Polvara

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出语义地标粒子滤波器,通过整合树干和杆地标检测与LiDAR,在葡萄园等重复性高环境中提升机器人定位的鲁棒性。

Comments Submmitted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14191 2026-03-10 cs.RO cs.CV 62%

MCGS-SLAM: A Multi-Camera SLAM Framework Using Gaussian Splatting for High-Fidelity Mapping

MCGS-SLAM:一种基于高斯点划的多相机SLAM框架用于高保真的地图构建

Zhihao Cao, Hanyu Wu, Li Wa Tang, Zizhou Luo, Wei Zhang, Marc Pollefeys, Zihan Zhu, Martin R. Oswald

机构 * Department of Mathematics, ETH Zurich(苏黎世联邦理工学院数学系) Department of Mechanical and Process Engineering, ETH Zurich(苏黎世联邦理工学院机械与工艺工程系) Department of Informatics, University of Zurich(苏黎世大学信息系) Institute for Photogrammetry, University of Stuttgart(斯图加特大学摄影测量研究所) Computer Vision and Geometry Group, ETH Zurich(苏黎世联邦理工学院计算机视觉与几何组) Microsoft Spatial AI Lab(微软空间AI实验室) Computer Vision Research Group, University of Amsterdam(阿姆斯特丹大学计算机视觉研究组)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 MCGS-SLAM通过多相机和高斯点划技术实现高保真的SLAM,提供精确轨迹和逼真重建,优于单目方法。

Comments Accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16590 2026-02-19 cs.CV cs.AI cs.LG 62%

A Contrastive Learning Framework Empowered by Attention-based Feature Adaptation for Street-View Image Classification

一种由基于注意力的特征适应增强的对比学习框架用于街景图像分类

Qi You, Yitai Cheng, Zichao Zeng, James Haworth

机构 * SpaceTimeLab(时空实验室) University College London(伦敦大学学院)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 CLIP-MHAdapter通过引入基于注意力的特征适应机制,提升街景图像属性分类的准确性和效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00810 2026-02-03 cs.CV cs.RO 62%

VVLoc: Prior-free 3-DoF Vehicle Visual Localization

VVLoc: 无需先验信息的3自由度车辆视觉定位

Ze Huang, Zhongyang Xiao, Mingliang Song, Longan Yang, Hongyuan Yuan, Li Sun

机构 * Fudan University(复旦大学) NIO(蔚来汽车) Bosch XC(博世XC)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 VVLoc通过单一神经网络实现多摄像头下的车辆拓扑与度量定位,无需先验信息,提升定位精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23993 2026-02-03 cs.CV cs.AI 62%

DenseFormer: Learning Dense Depth Map from Sparse Depth and Image via Conditional Diffusion Model

DenseFormer: 通过条件扩散模型学习稀疏深度和图像的密集深度图

Ming Yuan, Chuang Zhang, Lei He, Qing Xu, Jianqiang Wang

机构 * the School of Vehicle and Mobility(车辆与移动学院) Tsinghua University(清华大学)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 DenseFormer通过条件扩散模型,结合特征提取和深度细化模块,实现从稀疏深度和图像生成密集深度图,优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16780 2026-01-26 eess.IV cs.CV 62%

PocketDVDNet: Realtime Video Denoising for Real Camera Noise

PocketDVDNet:为真实相机噪声实现实时视频去噪

Crispian Morris, Imogen Dexter, Fan Zhang, David R. Bull, Nantheera Anantrasirichai

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV、eess.IV

AI总结 PocketDVDNet通过模型压缩框架结合稀疏引导剪枝、物理噪声模型和知识蒸馏,实现高效实时视频去噪,减少模型大小74%并提升去噪质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02727 2026-01-07 cs.CV cs.AI 62%

Foreground-Aware Dataset Distillation via Dynamic Patch Selection

前景感知的数据集蒸馏 via 动态补丁选择

Longzhen Li, Guang Li, Ren Togo, Keisuke Maeda, Takahiro Ogawa, Miki Haseyama

机构 * Graduate School of Information Science and Technology, Hokkaido University(信息科学与技术研究生学校,北海道大学) Education and Research Center for Mathematical and Data Science, Hokkaido University(数学与数据科学教育与研究中心,北海道大学) Faculty of Information Science and Technology, Hokkaido University(信息科学与技术学部,北海道大学)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.CV、cs.AI

AI总结 本文提出一种前景感知的数据集蒸馏方法,通过动态补丁选择策略提升蒸馏效果,减少冗余背景信息,增强模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26170 2025-12-19 cs.RO cs.CV 62%

Self-localization on a 3D map by fusing global and local features from a monocular camera

通过融合单目相机的全局和局部特征实现3D地图上的自定位

Satoshi Kikuchi, Masaya Kato, Tsuyoshi Tasaki

机构 * Meijo University(名古屋大学)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出结合CNN与视觉Transformer的方法,提升单目相机在动态障碍物环境下的3D地图自定位精度。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09780 2025-11-04 cs.CV cs.AI 62%

Combinative Matching for Geometric Shape Assembly

Nahyuk Lee, Juhong Min, Junhong Lee, Chunghyun Park, Minsu Cho

机构 * POSTECH Samsung Research America(三星美国研究院) RLWRLD

专题命中 BEV与占用 :occupancy(abstract);分类 cs.CV、cs.AI

Comments Accepted to ICCV 2025 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05341 2025-10-24 cs.CV cs.AI 62%

Direct Numerical Layout Generation for 3D Indoor Scene Synthesis via Spatial Reasoning

Xingjian Ran, Yixuan Li, Linning Xu, Mulin Yu, Bo Dai

机构 * The University of Hong Kong(香港大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 BEV与占用 :BEV(abstract);分类 cs.CV、cs.AI

Comments Project Page: https://directlayout.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24625 2025-10-23 cs.CV cs.AI 62%

Learning from Videos for 3D World: Enhancing MLLMs with 3D Vision Geometry Priors

Duo Zheng, Shijia Huang, Yanyang Li, Liwei Wang

机构 * The Chinese University of Hong Kong(香港中文大学)

专题命中 BEV与占用 :BEV(abstract);分类 cs.CV、cs.AI

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06969 2025-10-09 cs.CV cs.AI 62%

Learning Global Representation from Queries for Vectorized HD Map Construction

Shoumeng Qiu, Xinrun Li, Yang Long, Xiangyang Xue, Varun Ojha, Jian Pu

机构 * Fudan University(复旦大学) Newcastle University(新castle大学) Durham University(Durham大学)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV、cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14685 2025-10-07 cs.RO cs.CV 62%

DriveSceneGen: Generating Diverse and Realistic Driving Scenarios from Scratch

Shuo Sun, Zekai Gu, Tianchen Sun, Jiawei Sun, Chengran Yuan, Yuhang Han, Dongen Li, Marcelo H. Ang

机构 * Advanced Robotics Centre, National University of Singapore(新加坡国立大学先进机器人中心)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

Comments 8 pages, 5 figures, 2 tables

Journal ref IEEE Robotics and Automation Letters, vol. 9, no. 8, pp. 7007-7014, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05752 2025-09-10 cs.RO cs.CV cs.GR 62%

PINGS: Gaussian Splatting Meets Distance Fields within a Point-Based Implicit Neural Map

Yue Pan, Xingguang Zhong, Liren Jin, Louis Wiesmann, Marija Popović, Jens Behley, Cyrill Stachniss

机构 * Center for Robotics, University of Bonn(博恩大学机器人中心) MAVLab, TU Delft(代尔夫特理工大学MAVLab) Lamarr Institute for Machine Learning and Artificial Intelligence(德国拉马尔人工智能与机器学习研究所)

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.RO、cs.CV

Comments 15 pages, 8 figures, presented at RSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00823 2025-08-04 cs.CV cs.RO 62%

IGL-Nav: Incremental 3D Gaussian Localization for Image-goal Navigation

Wenxuan Guo, Xiuwei Xu, Hang Yin, Ziwei Wang, Jianjiang Feng, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学)

专题命中 BEV与占用 :BEV(abstract);分类 cs.RO、cs.CV

Comments Accepted to ICCV 2025. Project page: https://gwxuan.github.io/IGL-Nav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19354 2025-07-28 cs.CV cs.LG cs.RO 62%

EffiComm: Bandwidth Efficient Multi Agent Communication

Melih Yazgan, Allen Xavier Arasan, J. Marius Zöllner

机构 * FZI Research Center for Information Technology, Department of Technical Cognitive Systems(FZI信息技术研究中心,技术认知系统部门) Karlsruhe Institute of Technology (KIT), Institute of Applied Technical Cognitive Systems(卡尔斯鲁厄理工学院(KIT),应用技术认知系统研究所) Karlsruhe Institute of Technology (KIT), Institute for Information Processing Technology(卡尔斯鲁厄理工学院(KIT),信息处理技术研究所)

专题命中 BEV与占用 :BEV(abstract);分类 cs.RO、cs.CV

Comments Accepted for publication at ITSC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16062 2025-06-06 cs.RO cs.CV 62%

ForesightNav: Learning Scene Imagination for Efficient Exploration

Hardik Shah, Jiaxu Xing, Nico Messikommer, Boyang Sun, Marc Pollefeys, Davide Scaramuzza

机构 * ETH Zurich(苏黎世联邦理工学院) University of Zurich(苏黎世大学) Microsoft(微软公司)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.RO、cs.CV

Journal ref IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), Nashville, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10258 2025-05-16 cs.CV cs.RO 62%

Inferring Driving Maps by Deep Learning-based Trail Map Extraction

Michael Hubbertz, Pascal Colling, Qi Han, Tobias Meisen

机构 * University of Wuppertal(乌尔姆大学) Aptiv Services Deutschland GmbH(Aptiv Services 德国公司)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

Comments This paper was accepted at the CVPR WAD 2025 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08808 2025-05-15 cs.CV cs.AI 62%

SparseMeXT Unlocking the Potential of Sparse Representations for HD Map Construction

Anqing Jiang, Jinhao Chai, Yu Gao, Yiru Wang, Yuwen Heng, Zhigang Sun, Hao Sun, Zezhong Zhao, Li Sun, Jian Zhou, Lijuan Zhu, Shugong Xu, Hao Zhao

机构 * Bosch Corporate Research, Bosch (China) Investment Ltd.(博世企业研究院,博世(中国)投资有限公司) School of Communication and Information Engineering, Shanghai University(上海大学通信与信息工程学院) Bosch Mobility Solutions, Robert Bosch GmbH(博世移动解决方案,罗伯特·博世有限公司) AIR, Tsinghua University(空气动力学研究所,清华大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学)

专题命中 BEV与占用 :BEV(abstract);分类 cs.CV、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10363 2025-04-29 cs.RO cs.AI cs.LG 62%

BeamDojo: Learning Agile Humanoid Locomotion on Sparse Footholds

Huayi Wang, Zirui Wang, Junli Ren, Qingwei Ben, Tao Huang, Weinan Zhang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.RO、cs.AI

Comments Published at RSS 2025. Project website: https://why618188.github.io/beamdojo

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00060 2025-04-24 cs.LG cs.AI cs.CV 62%

CF-CAM: Cluster Filter Class Activation Mapping for Reliable Gradient-Based Interpretability

Hongjie He, Xu Pan, Yudong Yao

机构 * School of Physics, Mathematics, and Computing(物理、数学与计算学院) University of Western Australia(西澳大学) Hefei University of Technology(合肥工业大学) Department of Electrical and Computer Engineering(电气与计算机工程系) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10751 2025-04-16 cs.RO cs.AI cs.MA 62%

Communication-aware Hierarchical Map Compression of Time-Varying Environments for Mobile Robots

Daniel T. Larsson, Dipankar Maity

专题命中 BEV与占用 :occupancy(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23488 2025-04-14 cs.RO cs.CV 62%

PACER: Preference-conditioned All-terrain Costmap Generation

Luisa Mao, Garrett Warnell, Peter Stone, Joydeep Biswas

专题命中 BEV与占用 :BEV(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23780 2025-04-11 cs.CV cs.AI 62%

Driving by the Rules: A Benchmark for Integrating Traffic Sign Regulations into Vectorized HD Map

Xinyuan Chang, Maixuan Xue, Xinran Liu, Zheng Pan, Xing Wei

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.CV、cs.AI

Comments 26 pages, 16 figures. Accepted as a Highlight at CVPR 2025. Project page: https://miv-xjtu.github.io/MapDR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23963 2025-04-01 cs.CV cs.RO 62%

A Benchmark for Vision-Centric HD Mapping by V2I Systems

Miao Fan, Shanshan Yu, Shengtong Xu, Kun Jiang, Haoyi Xiong, Xiangzeng Liu

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

Comments Accepted by IEEE IV'25

详情

展开后加载摘要…

URL PDF HTML 收藏