arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

共收录 3755 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. BEV与占用 3755 篇

2301.07870 2023-01-20 cs.CV 85%

Fast-BEV: Towards Real-time On-vehicle Bird's-Eye View Perception

Bin Huang, Yangguang Li, Enze Xie, Feng Liang, Luya Wang, Mingzhu Shen, Fenggang Liu, Tianqi Wang, Ping Luo, Jing Shao

专题命中 BEV与占用 :BEV(title,abstract);autonomous driving(abstract);LiDAR(abstract);分类 cs.CV

Comments Accepted by NeurIPS2022_ML4AD on October 22, 2022

Journal ref NeurIPS2022_ML4AD

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.08144 2022-11-16 cs.CV 85%

Monocular BEV Perception of Road Scenes via Front-to-Top View Projection

Wenxi Liu, Qi Li, Weixiang Yang, Jiaxin Cai, Yuanlong Yu, Yuexin Ma, Shengfeng He, Jia Pan

专题命中 BEV与占用 :BEV(title);autonomous driving(abstract);LiDAR(abstract);occupancy(abstract)

Comments Extension to CVPR'21 paper "Projecting Your View Attentively: Monocular Road Scene Layout Estimation via Cross-View Transformation"

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.08659 2022-05-06 cs.RO 85%

Dynamic Occupancy Grid Mapping with Recurrent Neural Networks

Marcel Schreiber, Vasileios Belagiannis, Claudius Gläser, Klaus Dietmayer

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);LiDAR(abstract);分类 cs.RO

Journal ref 2021 IEEE International Conference on Robotics and Automation (ICRA), May 30 - June 5, 2021, Xi'an, China, pp. 6717-6724

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17536 2026-06-17 cs.CV cs.AI 新提交 85%

OmniDrive: An LLM-Choreographed Multi-Agent World Model with Unified Latent Co-Compression for Multi-View Driving Video Generation

OmniDrive: 一种由LLM编排的多智能体世界模型,用于多视角驾驶视频生成的统一潜在协同压缩

Zijie Meng, Yufei Liu, Chengqian Ma, Zhiyu Li, Jiyuan Liu, Wenhua Nie, Bingcai Wei, Shuqin Chen, Weichen Xu, Jiquan Yuan, Miao Zhang

机构 * Peking University(北京大学) Xiamen University(厦门大学) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) National Taiwan University(国立台湾大学) Wuhan University(武汉大学) Wuhan University of Technology(武汉理工大学) Tsinghua University(清华大学) Jimei University(集美大学)

专题命中 BEV与占用 :BEV(summary_cn,abstract);autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 提出DRIVE-CHOREO,一种由LLM编排的多智能体世界模型,通过三个Qwen2.5-VL智能体协同生成位置感知的潜在序列,并利用视图-时间置换与3D VAE协同压缩,实现可控多视角视频生成,在nuScenes上达到SOTA多视角一致性和BEV mAP 21.6。

Comments 24 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13108 2026-08-10 cs.RO cs.CV eess.IV 版本更新 85%

Panoramic Multimodal Semantic Occupancy Prediction for Quadruped Robots

四足机器人全景多模态语义占用预测

Guoqiang Zhao, Zhe Yang, Sheng Wu, Fei Teng, Mengfei Duan, Yuanfan Zheng, Kai Luo, Kailun Yang

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、eess.IV

AI总结 本文提出PanoMMOcc数据集和VoxelHound框架,通过垂直抖动补偿和多模态信息融合提升四足机器人全景多模态3D感知性能。

Comments The dataset and code will be publicly released at https://github.com/SXDR/PanoMMOcc

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01081 2026-04-02 cs.CV cs.LG cs.RO eess.IV 85%

ProOOD: Prototype-Guided Out-of-Distribution 3D Occupancy Prediction

ProOOD:基于原型的分布外3D占用预测

Yuheng Zhang, Mengfei Duan, Kunyu Peng, Yuhang Wang, Di Wen, Danda Pani Paudel, Luc Van Gool, Kailun Yang

机构 * Hunan University(湖南大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、eess.IV

AI总结 本文提出ProOOD方法,通过原型引导的语义填充和尾部挖掘提升3D占用预测和分布外检测性能,实验表明其在多个数据集上均取得显著改进。

Comments Accepted to CVPR 2026. The source code is publicly available at https://github.com/7uHeng/ProOOD

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28887 2026-04-01 cs.CV cs.AI cs.RO 85%

OccSim: Multi-kilometer Simulation with Long-horizon Occupancy World Models

OccSim:基于长期占用世界模型的多公里模拟

Tianran Liu, Shengwen Zhao, Mozhgan Pourkeshavarz, Weican Li, Nicholas Rhinehart

机构 * Learning, Embodied Autonomy, and Forecasting (LEAF) Lab, University of Toronto(多伦多大学学习、具身自主与预测(LEAF)实验室)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 OccSim通过无需连续日志或HD地图,仅依赖初始帧和未来动作序列生成超过3000帧的3D占用地图,实现多公里规模的稳定生成,提升占用世界模型的生成长度达80倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03571 2026-03-17 cs.RO cs.CV eess.IV 85%

OneOcc: Semantic Occupancy Prediction for Legged Robots with a Single Panoramic Camera

OneOcc: 为四足机器人和人形机器人提供基于单个全景相机的语义占用预测

Hao Shi, Ze Wang, Shangwei Guo, Mengfei Duan, Song Wang, Teng Chen, Kailun Yang, Lin Wang, Kaiwei Wang

专题命中 BEV与占用 :occupancy(title,abstract);LiDAR(abstract);分类 cs.RO、cs.CV、eess.IV

AI总结 OneOcc通过双投影融合、双格体素化、轻量解码器和步态位移补偿模块,实现四足机器人和人形机器人的语义占用预测,解决了步态引起的身体抖动和360度连续性问题。

Comments Accepted to CVPR 2026. Datasets and code will be publicly available at https://github.com/MasterHow/OneOcc

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08006 2026-02-10 cs.CV cs.AI cs.LG cs.RO 85%

ForecastOcc: Vision-based Semantic Occupancy Forecasting

ForecastOcc: 基于视觉的语义占用预测

Riya Mohan, Juana Valeria Hurtado, Rohit Mohan, Abhinav Valada

机构 * Department of Computer Science, University of Freiburg(计算机科学系,弗赖堡大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 ForecastOcc 是首个基于视觉的语义占用预测框架,通过联合预测未来占用状态和语义类别,提升自动驾驶环境感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13430 2025-12-04 cs.CV cs.AI cs.LG cs.RO 85%

AugMapNet: Improving Spatial Latent Structure via BEV Grid Augmentation for Enhanced Vectorized Online HD Map Construction

AugMapNet: 通过BEV网格增强改进空间潜在结构以提升矢量化的在线HD地图构建

Thomas Monninger, Md Zafar Anwar, Stanislaw Antol, Steffen Staab, Sihao Ding

机构 * Mercedes-Benz Research & Development North America, USA(梅赛德斯-奔驰北美研究与开发)

专题命中 BEV与占用 :BEV(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 AugMapNet通过BEV网格增强改进空间潜在结构,提升矢量化在线HD地图构建的性能和结构化表示。

Comments Accepted to 2026 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22141 2025-10-28 cs.CV cs.CL cs.LG cs.RO eess.IV 85%

LOC: A General Language-Guided Framework for Open-Set 3D Occupancy Prediction

Yuhang Gao, Xiang Xiang, Sheng Zhong, Guoyou Wang

专题命中 BEV与占用 :occupancy(title,abstract);LiDAR(abstract);分类 cs.RO、cs.CV、eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21423 2025-07-30 cs.CV cs.AI cs.LG cs.RO 85%

MapDiffusion: Generative Diffusion for Vectorized Online HD Map Construction and Uncertainty Estimation in Autonomous Driving

Thomas Monninger, Zihan Zhang, Zhipeng Mo, Md Zafar Anwar, Steffen Staab, Sihao Ding

机构 * Mercedes-Benz Research & Development North America(梅赛德斯-奔驰北美研发有限公司) University of Stuttgart(斯图加特大学) Institute for Artificial Intelligence(人工智能研究所) University of California, San Diego(加州大学圣地亚哥分校) University of Southampton(南安普顿大学)

专题命中 BEV与占用 :autonomous driving(title,abstract);BEV(abstract);分类 cs.RO、cs.CV、cs.AI

Comments Accepted for 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02578 2025-03-05 cs.CV cs.RO eess.IV 85%

TS-CGNet: Temporal-Spatial Fusion Meets Centerline-Guided Diffusion for BEV Mapping

Xinying Hong, Siyu Li, Kang Zeng, Hao Shi, Bomin Peng, Kailun Yang, Zhiyong Li

专题命中 BEV与占用 :BEV(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、eess.IV

Comments The source code will be publicly available at https://github.com/krabs-H/TS-CGNet

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15792 2024-10-29 cs.CV cs.AI cs.RO 85%

WildOcc: A Benchmark for Off-Road 3D Semantic Occupancy Prediction

Heng Zhai, Jilin Mei, Chen Min, Liang Chen, Fangzhou Zhao, Yu Hu

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11803 2024-09-20 cs.CV cs.AI cs.LG cs.RO 85%

TempBEV: Improving Learned BEV Encoders with Combined Image and BEV Space Temporal Aggregation

Thomas Monninger, Vandana Dokkadi, Md Zafar Anwar, Steffen Staab

专题命中 BEV与占用 :BEV(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

Comments Accepted for 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02197 2024-07-03 cs.AI cs.CV cs.RO 85%

Research on Reliable and Safe Occupancy Grid Prediction in Underground Parking Lots

JiaQi Luo

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

Comments 15 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18852 2024-05-30 cs.CV cs.AI cs.RO 85%

LetsMap: Unsupervised Representation Learning for Semantic BEV Mapping

Nikhil Gosala, Kürsat Petek, B Ravi Kiran, Senthil Yogamani, Paulo Drews-Jr, Wolfram Burgard, Abhinav Valada

专题命中 BEV与占用 :BEV(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02263 2024-04-04 cs.CV cs.AI cs.RO 85%

OFMPNet: Deep End-to-End Model for Occupancy and Flow Prediction in Urban Environment

Youshaa Murhij, Dmitry Yudin

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

Comments Accepted in Neurocomputing journal - 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.04530 2022-08-10 cs.CV cs.AI cs.RO 85%

VectorFlow: Combining Images and Vectors for Traffic Occupancy and Flow Prediction

Xin Huang, Xiaoyu Tian, Junru Gu, Qiao Sun, Hang Zhao

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV、cs.AI

Comments Technical report. 5 pages, 1 figure, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01338 2026-08-04 cs.CV 新提交 84%

Driver2Map: Imitating Human Driving for Online High-Definition Map Construction

Driver2Map:模仿人类驾驶的在线高清地图构建

Pan Yin, Runtian Xia, Weisong Kuang, Kaiyu Li, Cong Zhao, Xiangyong Cao

专题命中 BEV与占用 :BEV(summary_cn,abstract);autonomous driving(abstract);分类 cs.CV

AI总结 该研究提出受人类驾驶启发的Driver2Map模型,可融合三种模态数据,通过两阶段对齐、姿态引导BEV融合等模块提升在线高清地图构建性能,在IoU和AP指标上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17767 2026-07-21 cs.RO 新提交 84%

VLN-AVP: Zero-Shot Vision-Language Navigation with Hybrid Long-Short-Term Memory for Autonomous Valet Parking

VLN-AVP:用于自动代客泊车的基于混合长短时记忆的零样本视觉语言导航

Yijian Li, Xiangru Mu, Changze Li, Hantian Shi, Jiyuan Cai, Jia Cai, Xiaoxue Liu, Yajing Sun, Ming Yang, Tong Qin

机构 * Shanghai Jiao Tong University(上海交通大学) Yinwang Intelligent Technology Co., Ltd.(银望智能科技有限公司)

专题命中 BEV与占用 :BEV(summary_cn,abstract);autonomous driving(abstract);分类 cs.RO

AI总结 研究针对自主代客泊车依赖预建地图限制可扩展性问题,提出VLN-AVP零样本导航框架,结合BEV模型与VLM,引入混合记忆系统,构建数据集和基准,实验证明该方法在模拟和实际车辆实验中均有良好效果,提升了成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28196 2026-05-01 cs.CV 84%

HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation

HERMES++:迈向统一的驾驶世界模型用于3D场景理解和生成

Xin Zhou, Dingkang Liang, Xiwu Chen, Feiyang Tan, Dingyuan Zhang, Hengshuang Zhao, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Mach Drive University of Hong Kong(香港大学)

专题命中 BEV与占用 :BEV(summary_cn,abstract);autonomous driving(abstract);分类 cs.CV

AI总结 本文提出HERMES++,一种统一的驾驶世界模型,整合3D场景理解和未来几何预测。通过BEV表示、LLM增强世界查询和当前到未来链接等设计,提升驾驶场景的生成与理解能力。

Comments Extended version of ICCV 25 paper HERMES, Code: https://github.com/H-EmbodVis/HERMESV2, Project page: https://h-embodvis.github.io/HERMESV2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06210 2026-07-23 cs.CV cs.RO 版本更新 84%

VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction

VG3S:基于视觉几何的高斯散射用于语义占用预测

Xiaoyang Yan, Muleilan Pei, Shaojie Shen

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 VG3S 通过引入视觉基础模型的几何 grounding 能力,提升语义占用预测的准确性与泛化能力。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22971 2026-06-23 cs.RO cs.CV 新提交 84%

Humanoid-OmniOcc: Stereo-Based Full-View Occupancy Dataset for Embodied AI

Humanoid-OmniOcc:面向具身智能的立体全景占用数据集

Xianda Guo, Bohao Zhang, Chenwei Huang, Shiyuan Chen, Ruilin Wang, Yiqun Duan, Cong Yang, Qin Zou, Wei Sui

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) D-Robotics(地瓜机器人) Soochow University(苏州大学) UTS(悉尼科技大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 针对现有占用数据集局限于自动驾驶场景的问题,提出面向人形机器人的大规模全景立体占用数据集Humanoid-OmniOcc,采用Real2Sim2Real闭环范式,并设计立体引导占用模型,在模拟和真实环境中均优于单目基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13596 2026-03-06 cs.CV cs.RO 84%

Collaborative Learning of Local 3D Occupancy Prediction and Versatile Global Occupancy Mapping

局部3D占用预测与多功能全局占用映射的协同学习

Shanshuai Yuan, Julong Wei, Muer Tie, Xiangyun Ren, Zhongxue Gan, Wenchao Ding

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) State Key Laboratory of Intelligent Vehicle Safety Technology, Chongqing Changan Automobile Co., Ltd.(智能车辆安全技术重点实验室,重庆长安汽车有限公司)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 本文提出LMPOcc框架,通过整合全局占用先验提升局部预测性能,并实现全局地图的持续更新,适用于自动驾驶中的3D语义占用预测与大规模地图构建。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16552 2026-02-27 cs.CV cs.RO 84%

ST-GS: Vision-Based 3D Semantic Occupancy Prediction with Spatial-Temporal Gaussian Splatting

ST-GS:基于视觉的3D语义占用预测与空间-时间高斯点划法

Xiaoyang Yan, Muleilan Pei, Shaojie Shen

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 ST-GS通过空间-时间高斯点划法提升3D语义占用预测的时空建模能力,实现更优的时间一致性与性能

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14825 2026-02-23 cs.CV cs.AI 84%

GraphGSOcc: Semantic-Geometric Graph Transformer with Dynamic-Static Decoupling for 3D Gaussian Splatting-based Occupancy Prediction

GraphGSOcc: 基于语义-几何图变换器的3D高斯散射体占用预测方法,采用动态-静态解耦

Ke Song, Yunhe Wu, Chunchit Siu, Huiyuan Xiong

机构 * School of Intelligent Systems Engineering(智能系统工程学院) Sun Yat-sen University(中山大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 GraphGSOcc通过结合语义和几何图变换器,解耦动态-静态物体优化,提升3D高斯散射体占用预测的性能和效率。

Journal ref IEEE Transactions on Circuits and Systems for Video Technology 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14579 2025-12-23 cs.CV cs.AI 84%

GSRender: Deduplicated Occupancy Prediction via Weakly Supervised 3D Gaussian Splatting

GSRender: 通过弱监督的3D高斯点划法实现去重的占用预测

Qianpu Sun, Changyong Shu, Sifan Zhou, Runxi Cheng, Yongxian Wei, Zichen Yu, Dawei Yang, Sirui Han, Yuan Chun

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Houmo AI Dalian University of Technology(大连理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 GSRender通过弱监督3D高斯点划法和射线补偿模块,有效减少占用预测中的重复问题,提升户外自动驾驶的感知性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06272 2025-11-11 cs.CV cs.AI 84%

LaneDiffusion: Improving Centerline Graph Learning via Prior Injected BEV Feature Generation

Zijie Wang, Weiming Zhang, Wei Zhang, Xiao Tan, Hongxing Liu, Yaowei Wang, Guanbin Li

机构 * Sun Yat-sen University(中山大学) Shenzhen Loop Area Institute(深圳河套学院) Baidu Inc.(百度公司) Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室) Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室)

专题命中 BEV与占用 :BEV(title,abstract);autonomous driving(abstract);分类 cs.CV、cs.AI

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24623 2025-10-29 cs.RO cs.CV 84%

GroundLoc: Efficient Large-Scale Outdoor LiDAR-Only Localization

Nicolai Steinke, Daniel Goehring

机构 * Dahlem Center for Machine Learning and Robotics (DCMLR), Department of Mathematics and Computer Science, Freie Universität Berlin(达赫姆机器学习与机器人研究中心(DCMLR),数学与计算机科学系,柏林自由大学)

专题命中 BEV与占用 :LiDAR(title,abstract);BEV(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏