arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-05-29 至 2026-05-29 共收录 16 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 4 篇

2605.29935 2026-05-29 cs.CV cs.AI 81%

CityGen: Structure-Guided City-Style Synthesis for Cross-City Autonomous Driving

CityGen: 结构引导的城市风格合成用于跨城市自动驾驶

Zezhong Qian, Zhao Yang, Lu Tan, Zhihao Yan, Weiyi Hong, Haizhuang Liu, Yawei Jueluo

机构 * Jiangsu Cytoderm Intelligent Technology Co., Ltd., China(江苏细胞膜智能科技有限公司,中国) Xi'an Jiaotong University, Xi'an, China(西安交通大学,中国) Tsinghua University, Beijing, China(清华大学,中国) University of Science and Technology of China, Hefei, China(中国科学技术大学,中国)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 提出CityGen,一种基于扩散模型的生成框架,通过高清地图条件和城市级视觉提示实现零标签城市适应,提升跨城市自动驾驶在感知、分割和规划任务上的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04733 2026-05-29 cs.CV cs.AI 81%

E3AD: An Emotion-Aware Vision-Language-Action Model for Human-Centric End-to-End Autonomous Driving

E3AD:面向以人为中心的端到端自动驾驶的情感感知视觉-语言-动作模型

Yihong Tang, Haicheng Liao, Tong Nie, Junlin He, Ao Qu, Kehua Chen, Wei Ma, Zhenning Li, Lijun Sun, Chengzhong Xu

机构 * McGill University(麦吉尔大学) University of Macau(澳门大学) The Hong Kong Polytechnic University(香港理工大学) Massachusetts Institute of Technology(麻省理工学院) University of Washington(华盛顿大学)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 提出E3AD框架,通过连续VAD情感模型和双路径空间推理模块,将情感理解融入视觉-语言-动作模型,实现开放域端到端自动驾驶中的情感感知轨迹规划,在真实数据集上达到SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30328 2026-05-29 cs.CV 57%

Supercharging Thermal Gaussian Splatting with Depth Estimation

利用深度估计增强热高斯泼溅

Manoj Biswanath, Chenxin Cai, Hannah Schieber, Daniel Roth, Benjamin Busam

机构 * Technical University of Munich(技术大学慕尼黑) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与人工智能研究所) Human-Centered Computing and Extended Reality Lab(以人为本计算与扩展现实实验室) TUM University Hospital(技术大学慕尼黑医院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 提出一种仅使用热红外图像和深度估计的单模态方法TDg,通过热到深度高斯泼溅推导辐射场,在渲染质量和训练时间上优于多模态基线。

Comments 8 pages, 4 figures. Accepted and will be published in ISPRS proceedings (ISPRS Congress 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13168 2026-05-29 stat.ME 50%

Variance-Aware Estimation and Inference for Michaelis--Menten Models with Heteroscedastic Errors and Clustered Measurements

异方差误差和聚类测量下Michaelis-Menten模型的方差感知估计与推断

Mijeong Kim, Minkyoung Cha, Ah Young Jeong

专题命中 感知 :self-driving(abstract)

AI总结 针对Michaelis-Menten模型,提出一种基于条件矩约束的方差感知估计与推断方法,通过简单条件高斯工作模型实现单曲线和聚类数据的参数估计,改善了异方差和聚类结构下的推断效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 4 篇

2512.11944 2026-05-29 cs.RO cs.AI 62%

A Review of Learning-Based Motion Planning: Toward a Data-Driven Optimal Control Approach

基于学习的运动规划综述:迈向数据驱动的最优控制方法

Jia Hu, Yang Chang, Haoran Wang

机构 * College of Transportation Key Laboratory of Road and Traffic Engineering of the Ministry of Education(交通运输学院 道路交通工程教育部重点实验室) Institute for Advanced Study(先进研究院) Tongji University(同济大学)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 本文系统综述了数据驱动最优控制范式,通过融合最优控制的理论保证与机器学习的自适应能力,为自动驾驶运动规划提供了三维实现路线图,并指出了四个未来研究方向。

Comments 44 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29704 2026-05-29 cs.RO 57%

FLIP: Real-Time and Resilient Formation Planning for Large-Scale DIstributed Swarms via Point Cloud Registration

FLIP:通过点云配准实现大规模分布式集群的实时弹性编队规划

Yuan Zhou, Guangtong Xu, Zhenyu Hou, Jialiang Hou, Fei Gao

机构 * Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院智能系统与控制研究所) Huzhou Institute, Zhejiang University(浙江大学湖州研究院)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 提出将最优编队位置序列计算转化为时空点云配准问题,利用带离群点剔除的PCR方法实现大规模分布式集群的弹性、高效轨迹规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29849 2026-05-29 eess.SY cs.LG cs.SY 50%

BuilDyn: Excitation-Driven Data Generation for Building Thermal Dynamics Modeling and Control

BuilDyn: 面向建筑热动力学建模与控制的激励驱动数据生成

Felix Koch, Thomas Krug, Fabian Raisch, Benjamin Schäfer, Benjamin Tischler

机构 * Technical University of Applied Sciences Rosenheim(应用技术大学罗森海姆) Technical University of Munich(慕尼黑技术大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 规划控制 :occupancy(abstract)

AI总结 本文提出BuilDyn包,通过可定制的激励策略生成控制导向的建筑数据,提升机器学习模型对未见工况的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29104 2026-05-29 eess.SY cs.SY 50%

Energy-Optimal Thermal Management of Heat-Pump Battery Electric Vehicles

热泵电池电动汽车的能量最优热管理

Prashant Lokur, Nikolce Murgovski

专题命中 规划控制 :BEV(abstract_cn)

AI总结 提出一种结合规则基监督层与连续非线性模型预测控制的混合控制框架,用于热泵电动汽车的热管理,在满足舒适性和温度约束下最小化热能耗,并在寒冷气候下实现20-28%的节能。

Comments This paper has been submitted for publication in IEEE Open Journal of Vehicular Technology (OJVT)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2605.29138 2026-05-29 cs.RO cs.AI cs.LG cs.SY eess.SY 81%

Multi-Resolution End-to-End Deep Neural Network for Optimizing Latency-Accuracy Tradeoff in Autonomous Driving

用于优化自动驾驶延迟-准确性权衡的多分辨率端到端深度神经网络

Qitao Weng, Heechul Yun

机构 * University of Kansas Lawrence(堪萨斯大学劳伦斯分校)

专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 提出一种多分辨率端到端CNN,通过运行时选择输入分辨率和分辨率重定向,在延迟预算下优化自动驾驶的延迟-安全性权衡。

Comments ICCPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 2 篇

2605.25059 2026-05-29 cs.CV 79%

VEOcc: Voxel-Centric Online Semantic Occupancy Prediction For Embodied Scene Understanding

VEOcc:面向具身场景理解的体素中心在线语义占用预测

Ruoyu Wang, Yong Liu, Sheng Tao, Yuhang Lin, Yukai Ma

机构 * Institute of Cyber-Systems and Control(控制系统研究院)

专题命中 BEV与占用 :occupancy(title,abstract);分类 cs.CV

AI总结 提出一种基于体素的递归感知-同化框架VEOcc,通过时空感知在线更新策略实现无需初始尺度估计的高效、鲁棒语义占用预测,在局部和具身场景中达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29266 2026-05-29 physics.soc-ph 50%

Quantifying real-world energy use and CO2 emissions of electric vehicles via a city-scale bottom-up framework

通过城市尺度自下而上框架量化电动汽车的真实能耗与二氧化碳排放

Shuhan Ge, Yanqiao Deng, Minda Ma

专题命中 BEV与占用 :BEV(abstract_cn)

AI总结 以上海为案例,构建涵盖2022年7月至2024年12月所有注册车型的自下而上框架,量化电动汽车的真实能耗、运营能源结构及CO2排放,发现测试循环值系统性低估实际能耗,电力部门排放主导运营CO2,纯电动车在当前政策下减排效果最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 3 篇

2605.30111 2026-05-29 cs.CV cs.AI 90%

xModel-KD: Cross-modal Knowledge Distillation for 3D Scene Perception using LiDAR

xModel-KD:基于LiDAR的3D场景感知跨模态知识蒸馏

Thenukan Pathmanathan, Kanchan Keisham, Thangarajah Akilan

机构 * Dept. of Computer Science Lakehead University Thunder Bay, Canada School of Computer Science Engg. \& Info. Systems Vellore Institute of Technology Tamil Nadu, India Dept. of Software Engg. Lakehead University Thunder Bay, Canada

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.CV、cs.AI

AI总结 提出跨模态知识蒸馏框架xModel-KD,通过对比学习对齐2D图像纹理与3D点云几何特征,在无额外标注下提升LiDAR点云分割性能。

Comments 3 figures, and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03010 2026-05-29 cs.CV cs.GR cs.RO 90%

SurfFill: Completion of LiDAR Point Clouds via Gaussian Surfel Splatting

SurfFill: 通过高斯曲面元填充完成LiDAR点云

Svenja Strobel, Matthias Innmann, Bernhard Egger, Marc Stamminger, Linus Franke

机构 * NavVis GmbH(NavVis公司) Inria, Université Côte d'Azur(Inria与阿尔卑斯海岸大学)

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.RO、cs.CV

AI总结 针对LiDAR点云缺失薄结构和边缘细节的问题,提出基于高斯曲面元(Gaussian surfel)的补全方案SurfFill,利用光束发散启发式识别模糊区域并优化曲面元重建以生长新点,在合成和真实场景中优于先前方法。

Comments Project page: https://lfranke.github.io/surffill

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15864 2026-05-29 cs.RO 79%

Environment-Adaptive Solid-State LiDAR-Inertial Odometry

环境自适应固态激光雷达-惯性里程计

Zhi Zhang, Chalermchon Satirapod, Bingtao Ma, Changjun Gu

机构 * School of Automation Chongqing University of Posts(自动化学院 重庆邮电大学) Department of Survey Engineering, Faculty of Engineering Chulalongkorn University Bangkok, Thailand(工程学院 测绘工程系 朱拉隆功大学 泰国曼谷) School of Cyberspace Security Hangzhou Dianzi University Hangzhou, China(网络空间安全学院 杭州电子科技大学 杭州中国)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.RO

AI总结 提出一种集成局部法向量约束与退化感知地图维护的环境自适应固态激光雷达-惯性里程计,以解决极端环境下的几何退化与观测不可靠导致的定位漂移和地图不一致问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2605.29114 2026-05-29 cs.CR cs.LG cs.RO 79%

ReasonBreak: Probing Vulnerabilities in Reasoning-Enabled Vision-Language-Action Models for Autonomous Driving

ReasonBreak: 探测自动驾驶中具备推理能力的视觉-语言-行动模型的脆弱性

Mohammadreza Teymoorianfard, Jean-Philippe Monteuuis, Jonathan Petit, Amir Houmansadr

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Qualcomm(高通)

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.RO

AI总结 本文通过黑盒攻击方法,首次系统研究了具备推理能力的视觉-语言-行动模型在自动驾驶中面对真实输入扰动时的脆弱性,发现其推理和轨迹生成均易受攻击,导致碰撞率上升。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他自动驾驶 1 篇

2605.05964 2026-05-29 cs.LG 50%

Uncertainty Estimation via Hyperspherical Confidence Mapping

基于超球面置信映射的不确定性估计

Eunseo Choi, Ho-Yeon Kim, Jaewon Lee, Taeyong jo, Myungjun lee, Heejin Ahn

机构 * KAIST(韩国科学技术院) Samsung Electronic Co., Ltd(三星电子有限公司)

专题命中 其他自动驾驶 :autonomous driving(abstract)

AI总结 提出超球面置信映射(HCM),通过将输出分解为幅度和归一化方向向量并利用几何约束违反程度实现无采样、无分布假设的不确定性估计,在回归和分类任务中匹配或超越集成与证据方法且推理成本更低。

Comments Accepted at ICLR 2026. 24 pages, 7 figures, including appendix. Updated references

详情

展开后加载摘要…

URL PDF HTML 收藏