arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-03-10 至 2026-03-10 共收录 44 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. BEV与占用 6 篇

2603.06956 2026-03-10 cs.CV 57%

Virtual Intraoperative CT (viCT): Sequential Anatomic Updates for Modeling Tissue Resection Throughout Endoscopic Sinus Surgery

虚拟术中CT(viCT):用于内窥镜鼻窦手术中逐步更新解剖结构的建模方法

Nicole M. Gunderson, Graham J. Harris, Jeremy S. Ruthberg, Pengcheng Chen, Di Mao, Randall A. Bly, Waleed M. Abuzeid, Eric J. Seibel

机构 * Department of Otolaryngology–Head and Neck Surgery, University of Washington(耳鼻喉科-头颈外科系,华盛顿大学)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.CV

AI总结 viCT通过术中内窥镜视频生成3D重建,实现内窥镜鼻窦手术中解剖结构的逐步更新,提升术中可视化精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08623 2026-03-10 cs.NI cs.GT 50%

Time-based Fairness Improves Performance in Multi-rate WLANs

基于时间的公平性在多速率WLANs中的性能提升

Godfrey Tan, John Guttag

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文提出基于时间的公平性机制TBR,通过调节信道占用时间提升多速率WLAN的总体性能,同时保证节点访问不劣于单一速率网络。

Comments Published in the Proceedings of Usenix Annual Technical Conference in 2004

Journal ref Proc. USENIX Annual Technical Conference (ATC 04), pp. 23-36 (2004)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07596 2026-03-10 nucl-th 50%

Prolate-oblate shape competition and impact on charge radii in Bk isotopes

长轴-短轴形状竞争及其对Bk同位素电荷半径的影响

Ting-Ting Sun, Qi Zhang, Peng Wang, Zi-Dan Huang, Shuang-Quan Zhang

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文通过DRHBc理论研究Bk同位素长轴-短轴形状竞争,揭示短轴形状对电荷半径的增强效应及其微观机制。

Comments 9 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 激光雷达 3 篇

2507.23273 2026-03-10 cs.RO cs.CV 81%

LIVE-GS: Online LiDAR-Inertial-Visual State Estimation and Globally Consistent Mapping with 3D Gaussian Splatting

LIVE-GS: 在线激光雷达-惯性-视觉状态估计与全局一致映射的3D高斯点云绘制

Jaeseok Park, Chanoh Park, Minsu Kim, Minkyoung Kim, Soohwan Kim

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.RO、cs.CV

AI总结 LIVE-GS通过结合激光雷达与3D高斯点云绘制,实现高精度地图一致性,解决稀疏数据和计算效率问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07928 2026-03-10 cs.RO 79%

Omnidirectional Humanoid Locomotion on Stairs via Unsafe Stepping Penalty and Sparse LiDAR Elevation Mapping

全方位台阶行走的人形机器人:通过不安全踏步惩罚与稀疏Li DAR高度映射

Yuzhi Jiang, Yujun Liang, Junhao Li, Han Ding, Lijun Zhu

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(华中科技大学智能制造装备技术国家重点实验室) School of Mechanical Science and Engineering, Huazhong University of Science and Technology(华中科技大学机械科学与工程学院)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.RO

AI总结 本文提出一种单阶段训练框架,结合密集不安全踏步惩罚和稀疏LiDAR高度映射,实现人形机器人在台阶上的安全全方位行走。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08433 2026-03-10 cs.RO 57%

FoMo: A Multi-Season Dataset for Robot Navigation in Forêt Montmorency

FoMo:蒙莫朗西森林机器人导航多季节数据集

Matěj Boxan, Gabriel Jeanson, Alexander Krawciw, Effie Daum, Xinyuan Qiao, Sven Lilge, Timothy D. Barfoot, François Pomerleau

专题命中 激光雷达 :LiDAR(abstract);分类 cs.RO

AI总结 FoMo数据集通过多季节数据挑战机器人导航算法的鲁棒性,提供丰富的环境变化数据以评估定位与建图技术的适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 仿真评测 6 篇

2505.06746 2026-03-10 cs.RO cs.CV 86%

M3CAD: Towards Generic Cooperative Autonomous Driving Benchmark

M3CAD:迈向通用协作自动驾驶基准

Morui Zhu, Yongqi Zhu, Yihao Zhu, Qi Chen, Deyuan Qu, Song Fu, Qing Yang

机构 * University of North Texas(北卡罗来纳州立大学) Toyota InfoTech Labs(丰田信息技术实验室)

专题命中 仿真评测 :autonomous driving(title,abstract);LiDAR(abstract);occupancy(abstract);分类 cs.RO、cs.CV

AI总结 M3CAD是一个全面的协作自动驾驶基准,提供多模态数据支持多种自动驾驶任务,并提出多级融合方法以平衡通信效率与感知精度。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08113 2026-03-10 cs.CV 83%

SAMoE-VLA: A Scene Adaptive Mixture-of-Experts Vision-Language-Action Model for Autonomous Driving

SAMoE-VLA:一种面向自动驾驶的场景自适应混合专家视觉-语言-动作模型

Zihan You, Hongwei Liu, Chenxu Dang, Zhe Wang, Sining Ang, Aoqi Wang, Yan Wang

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) School of Instrument Science and Engineering, Southeast University(仪器科学与工程学院,东南大学) Zhili College, Tsinghua University(紫荆学院,清华大学) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学) Department of Automation, University of Science and Technology of China(自动化学院,中国科学技术大学) Department of Automation, University of Science and Technology Beijing(自动化学院,北京科技大学)

专题命中 仿真评测 :autonomous driving(title,abstract);BEV(abstract);分类 cs.CV

AI总结 SAMoE-VLA通过场景自适应混合专家机制提升自动驾驶中的视觉-语言-动作推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01528 2026-03-10 cs.CV cs.AI cs.RO 82%

DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving

DrivingGen:自主驾驶中生成视频世界模型的综合性基准

Yang Zhou, Hao Shao, Letian Wang, Zhuofan Zong, Hongsheng Li, Steven L. Waslander

机构 * University of Toronto(多伦多大学) CUHK MMLab(香港中文大学MMLab)

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 DrivingGen提出首个综合性基准,用于评估生成驾驶世界模型的视觉真实性、轨迹合理性、时间一致性和可控性,揭示通用与专用模型间的权衡。

Comments ICLR 2026 Poster; Project Website: https://drivinggen-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07552 2026-03-10 cs.CV cs.RO 81%

ReconDrive: Fast Feed-Forward 4D Gaussian Splatting for Autonomous Driving Scene Reconstruction

ReconDrive: 用于自动驾驶场景重建的快速前馈4D高斯点扩散

Haibao Yu, Kuntao Xiao, Jiahang Wang, Ruiyang Hao, Yuxin Huang, Guoran Hu, Haifang Qin, Bowen Jing, Yuntian Bo, Ping Luo

机构 * Tuojing Intelligence The University of Hong Kong(香港大学) King's College London(伦敦国王学院) The University of Sydney(悉尼大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 ReconDrive通过改进的4D高斯点扩散方法,在自动驾驶场景重建中实现高效高保真生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08645 2026-03-10 cs.CV cs.GR cs.LG 57%

Retrieval-Augmented Gaussian Avatars: Improving Expression Generalization

检索增强的高斯化身:提升表情泛化能力

Matan Levy, Gavriel Habib, Issar Tzachor, Dvir Samuel, Rami Ben-Ari, Nir Darshan, Or Litany, Dani Lischinski

机构 * The Hebrew University of Jerusalem(耶路撒冷希伯来大学) OriginAI Bar-Ilan University(巴伊兰大学) Technion(技术学院) NVIDIA(英伟达)

专题命中 仿真评测 :self-driving(abstract);分类 cs.CV

AI总结 RAF通过检索增强技术提升无模板头部化身的表情泛化能力,增强身份与表情解耦,提高表情分布偏移的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11165 2026-03-10 cs.CV 57%

Traffic-MLLM: Curiosity-Regularized Supervised Learning for Traffic Scenario Case-Based Reasoning

Traffic-MLLM: 基于好奇心正则化的交通场景案例推理监督学习

Waikit Xiu, Qiang Lu, Bingchen Liu, Chen Sun, Xiying Li

机构 * The University of Hong Kong(香港大学) Sun Yat-sen University(中山大学) University of Bristol(布里斯托大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 Traffic-MLLM通过好奇心驱动的结构化案例学习,提升多模态交通场景推理的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他自动驾驶 2 篇

2406.12253 2026-03-10 cs.RO 57%

Influence-Based Reward Modulation for Implicit Communication in Human-Robot Interaction

基于影响的奖励调节用于人机交互中的隐式通信

Haoyang Jiang, Elizabeth A. Croft, Michael G. Burke

机构 * Monash University(莫纳什大学) University of Victoria(维多利亚大学)

专题命中 其他自动驾驶 :autonomous driving(abstract);分类 cs.RO

AI总结 本文提出了一种基于转移熵的奖励调节方法,用于增强人机交互中的隐式通信,通过调节影响力提升协作与互动效果。

Comments Preprint. 26 pages, 15 figures. Submitted to IEEE Transactions on Human-Robot Interaction (THRI). Accepted manuscript version

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18281 2026-03-10 cs.IT cs.LG eess.SP math.IT 50%

GDM4MMIMO: Generative Diffusion Models for Massive MIMO Communications

GDM4MMIMO:用于大规模MIMO通信的生成扩散模型

Zhenzhou Jin, Li You, Huibin Zhou, Yuanshuo Wang, Xiaofeng Liu, Xinrui Gong, Xiqi Gao, Derrick Wing Kwan Ng, Xiang-Gen Xia

机构 * National Mobile Communications Research Laboratory, Southeast University, Nanjing 210096, China(南京东南大学国家移动通信研究实验室) Purple Mountain Laboratories, Nanjing 211100, China(南京紫金山实验室) Huawei Technologies Co., Ltd., Suzhou 215100, China(华为技术有限公司) School of Electrical Engineering and Telecommunications, University of New South Wales, Sydney, 2052, Australia(新南威尔士大学电子与电信学院) Department of Electrical and Computer Engineering, University of Delaware, Newark, DE 19716 USA(德克萨斯大学达勒姆分校电子与计算机工程系)

专题命中 其他自动驾驶 :autonomous driving(abstract)

AI总结 本文提出利用生成扩散模型(GDM)提升大规模MIMO通信中的信道状态信息(CSI)获取效率,探讨其在近场信道估计中的应用及未来研究方向。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏