arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-08-07 至 2026-08-07 共收录 21 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 3 篇

2608.05221 2026-08-07 cs.RO 新提交 70%

A System for Train Condition Monitoring and Structural Health Assessment of Rail Vehicles

轨道车辆的列车状态监测与结构健康评估系统

Maximilian Posner, Martin Dazer, Daniela Lauer, Robert Winkler-Höhn, Mathilde Laporte, Tobias Herrmann, Martin Köppel

机构 * DB InfraGO AG(DB InfraGO股份公司) DB Systemtechnik(DB系统技术公司) MSG Ammendorf(MSG阿门多夫公司)

专题命中 感知 :LiDAR(abstract,abstract_cn);分类 cs.RO

AI总结 本文提出一种融合结构传感器技术与AI数据分析的系统,用于轨道车辆状态监测与撞击检测,可自动检测相关事件、支持状态维护及设计优化,助力干线铁路向全自动运行过渡。

Journal ref IEEE Intelligent Vehicles Symposium, Detroit, USA, Jun, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05560 2026-08-07 cs.CV cs.CL 新提交 57%

From Sports to Safety: Benchmarking Proactive Risk Inference in MLLMs

从运动到安全:多模态大语言模型(MLLM)主动风险推理基准测试

Jiawei Qiu, Yichen Xu, Jianzhe Ma, Mingyang Yu, Wenbin Zhu, Yang Han, Pinzheng Lv, Wenxuan Wang

机构 * School of Information, Renmin University of China(中国人民大学信息学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 该研究构建了运动主动风险推理基准SPRINT,评估发现当前MLLM危险感知率高但原因识别率低,仅具备表层主动安全能力,缺乏稳定的基于原因的早期预警。

Comments Preprints

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05634 2026-08-07 cs.MM 新提交 50%

MEC-Patch: Visible-Infrared Cross-Modal Adversarial Attack Driven by Intrinsic Material Emissivity Laws

MEC-Patch:基于本征材料发射率定律的可见-红外跨模态对抗攻击

Zhixiang Huang, Xinbo Nie, Wenxuan Wang, Lu Yang, Xin Li, Xuelin Qian, Peng Wang

专题命中 感知 :autonomous driving(abstract)

AI总结 本文提出基于斯特藩-玻尔兹曼定律的MEC-Patch跨模态对抗攻击框架,结合NSGA-II与DAR策略,可欺骗多模态检测器并提升环境鲁棒性,为多模态感知系统安全评估提供新思路。

Comments Accepted by the 34th ACM International Conference on Multimedia (MM '26). Includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 4 篇

2608.05266 2026-08-07 cs.AI cond-mat.mtrl-sci cs.LG 新提交 74%

Agentic self-driving microscopy benchmarks support qualification but do not necessarily generalize to unseen tasks

智能体自动驾驶显微镜基准测试支持性能验证,但不一定能泛化到未见任务

Nathan S Johnson, Ian Abshire

机构 * Carl Zeiss Research Microscopy Solutions(卡尔蔡司研究显微镜解决方案)

专题命中 规划控制 :self-driving(title);分类 cs.AI

AI总结 本研究开发基准框架评估显微镜智能体架构等因素的性能,发现其虽可用于验证比较,但现有基准无法预测智能体在未见显微镜任务上的表现。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05673 2026-08-07 cs.AI cs.CV cs.LG 新提交 62%

A Unified Framework for Trajectory Prediction with Explicit Planning and Reaction Decomposition

显式规划与反应分解的轨迹预测统一框架

Jiaheng Chen, Jiaxing Li, Tinghe Zhang, Chaopeng Guo

机构 * Software College, Northeastern University(东北大学软件学院)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.CV、cs.AI

AI总结 针对现有轨迹预测方法未充分区分社会影响功能角色的问题,提出INTraJ框架,将社会影响分解为规划与反应两阶段,在四个基准上实现性能提升,验证了阶段性社会建模的重要性。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05365 2026-08-07 cs.RO 新提交 57%

Unified Planning-Learning Framework for Robust UUV Navigation Under Partial Observability

部分可观测条件下用于自主水下航行器(UUV)鲁棒导航的统一规划-学习框架

Md Ether Deowan, Eleni Kelasidi

机构 * NTNU(挪威科技大学)

专题命中 规划控制 :occupancy(abstract);分类 cs.RO

AI总结 该研究提出统一规划-学习框架,结合占用地图构建、规划与控制,通过行为树蒸馏等技术提升UUV在部分可观测动态水下环境的导航鲁棒性与安全性,经仿真验证优于基线方法。

Comments 8 pages, 6 figures. Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026), Philadelphia, PA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05824 2026-08-07 physics.med-ph physics.ins-det 新提交 50%

A Unified Analytical Framework for LYSO-SiPM Scintillation Pulse Dynamics

LYSO-SiPM 闪烁脉冲动力学的统一分析框架

Ao Qiu, Qingguo Xie

专题命中 规划控制 :occupancy(abstract)

AI总结 该研究提出 LYSO-SiPM 闪烁探测器的统一分析框架,关联各过程并经实验验证,能预测波形与计时极限,加深对探测器响应的物理理解。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2606.13460 2026-08-07 cs.CV 版本更新 83%

VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models

VISA: VLM引导的实例语义审计用于3D占据世界模型

Ruiqi Xian, Yuehan Xian, Jing Liang, Xuewei Qi, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学帕克分校) Nanjing University of Posts and Telecommunications(南京邮电大学) Stanford University(斯坦福大学) Motional AD Inc.(Motional AD公司)

专题命中 端到端驾驶 :occupancy(title,abstract);autonomous driving(abstract);分类 cs.CV

AI总结 提出VISA方法,利用离线VLM对每个物理对象实例进行结构化语义审计,并通过可靠性加权损失蒸馏到3D占据模型中,无需VLM推理即可提升封闭集占据mIoU。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 2 篇

2608.05209 2026-08-07 cs.CV 新提交 70%

MapTCL: Temporal Consistency Learning via Bidirectional Alignment for Vectorized HD Map Construction

MapTCL:用于矢量化高清地图构建的双向对齐时序一致性学习

Hyeonseo Kim, Juyeb Shin, Hyeonjun Jeong, Hiwon Shin, Dongsuk Kum

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 BEV与占用 :BEV(abstract,abstract_cn);分类 cs.CV

AI总结 针对动态城市环境下在线高清地图构建的时序稳定性问题,提出即插即用模块MapTCL,通过双向矢量一致性学习与栅格地图一致性学习联合训练,在两个基准上显著提升基线模型性能且无额外推理开销。

Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05901 2026-08-07 q-fin.MF math.OC 新提交 50%

From Value Bounds to Policy-Distance and Active-Face Certificates: Same-Grid Duality for Constrained Dynamic Portfolios

从价值边界到策略距离与主动面证书:约束动态投资组合的同网格对偶性

Jeonggyu Huh

专题命中 BEV与占用 :occupancy(abstract)

AI总结 该研究针对约束动态投资组合,提出同网格对偶框架,利用原始对偶 bracket 实现价值损失证明与最优策略定位,通过多类实验验证了方法在不同资产规模下的有效性及高维瓶颈问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 10 篇

2608.06014 2026-08-07 cs.CV 新提交 90%

Iterate or Widen? When Test-Time Refinement Helps LiDAR Scene Completion: A Controlled Study of Evidence Geometry, Training Coverage, and Compute

迭代还是拓宽?测试时优化对LiDAR场景补全的帮助:证据几何、训练覆盖率与计算资源的对照研究

Shijie Hao, Weining Zhang

机构 * Phillips Exeter Academy(菲利普斯埃克塞特学院) Cheung Kong Graduate School of Business(长江商学院)

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.CV

AI总结 本文通过对照实验,在LiDAR语义场景补全中发现,迭代优化仅能在连贯缺口场景下提升性能,广泛稀疏化需靠训练覆盖率,且无法修复加性杂波,明确了测试时优化的适用边界。

Comments 24 pages, 11 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25699 2026-08-07 cs.RO 版本更新 90%

SA-LIVO: Efficient LiDAR-Inertial-Visual Odometry with Subspace-Aware Degeneracy Handling

SA-LIVO: 基于子空间感知退化处理的轻量级LiDAR-惯性-视觉里程计

Yinong Cao, Xin He, Shouzheng Zhu, Senyuan Wang, Changhui Jiang, Chenyang Zhang, Pingfeng He, Tingwei Wang, Yuwei Chen, Shijie Liu, Chunlai Li, Genghua Huang, Jianyu Wang

机构 * Key Laboratory of Space Active Opto-Electronics Technology, Shanghai Institute of Technical Physics, Chinese Academy of Sciences(中国科学院上海技术物理研究所空间主动光电技术重点实验室) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.RO

AI总结 提出SA-LIVO系统,通过子空间感知信息融合(SAIF)框架对联合信息矩阵进行特征分解,在方向级别选择性融合LiDAR和视觉测量,解决LiDAR退化与视觉失效问题,实现高精度、低内存的实时里程计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05506 2026-08-07 cs.CV 版本更新 81%

Robust Scene Transfer for PointGoal Navigation via Privileged Sensor Guided Contrastive Learning

基于特权传感器引导对比学习的点目标导航鲁棒场景迁移

Amirhossein Zhalehmehrabi, Tiziano Tezze, Alberto Castelini, Alessandro Farinelli

机构 * University of Padua(帕多瓦大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 激光雷达 :LiDAR(summary_cn,abstract);分类 cs.CV

AI总结 提出一种传感器引导的自适应对比学习框架,利用特权LiDAR传感器在训练时引导视觉编码器学习导航相关结构,并通过解耦表征学习与策略优化以及跨阶段域不匹配来提升策略级场景迁移能力。

Comments 8 pages, Accepted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14243 2026-08-07 cs.CV 版本更新 81%

Multi-Representation Geometric Hierarchy Fusion: An Implicit-Submap Driven Framework for Resilient 3D Place Recognition

多表示几何层次融合:一种用于鲁棒三维地点识别的隐式子图驱动框架

Xiaohui Jiang, Haijiang Zhu, Chade Li, Ning An

机构 * College of Information and Technology, Beijing University of Chemical Technology(信息与技术学院,北京化工大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Research Institute of Mine Artificial Intelligence, China Coal Research Institute(矿山人工智能研究院,中国煤炭科研院)

专题命中 激光雷达 :LiDAR(abstract,abstract_cn);autonomous driving(abstract);occupancy(abstract);分类 cs.CV

AI总结 针对激光雷达地点识别中描述子不稳定与表示脆弱性问题,本文提出隐式神经点驱动的多表示几何层次融合框架,在多数据集上实现鲁棒性能,平衡了精度、效率与内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06307 2026-08-07 cs.CV 新提交 79%

UQ-Loc: Uncertainty-Aware LiDAR Scene Coordinate Regression

UQ-Loc:感知不确定性的激光雷达场景坐标回归

Jacek Komorowski

机构 * Warsaw University of Technology(华沙理工大学)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 UQ-Loc扩展LightLoc架构,添加各向同性高斯协方差头,采用NLL损失结合kNN正则化训练,改进SC2-PCR求解器推理,提升6自由度定位精度并校准不确定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05647 2026-08-07 cs.RO 新提交 79%

KILVO: Kinematic-Inertial-LiDAR-Visual Odometry with Robust Multimodal Adaptation for Humanoid Robots

KILVO:面向人形机器人的具备鲁棒多模态自适应的运动学-惯性-激光雷达-视觉里程计

Jixin Gao, Fucheng Liu, Teng Zhang, Fusheng Zha

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.RO

AI总结 本文提出面向人形机器人的KILVO里程计,基于ESIKF整合多传感器并设计多模态自适应与接触估计模块,实验显示其精度、效率及鲁棒性优于现有方法,代码与数据集已开源。

Comments This article has been accepted for publication in IEEE/ASME Transactions on Mechatronics. Personal use is permitted. All other uses require IEEE permission

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05586 2026-08-07 cs.RO 新提交 77%

PathCover: A Fast Convex Decomposition along a Path via Randomized Iterative Space Partitioning (RISP) on Point Clouds

PathCover:基于点云的随机迭代空间划分(RISP)沿路径的快速凸分解

Kunal S. Narkhede, Abhijeet M. Kulkarni, Guoquan Huang, Ioannis Poulakakis

机构 * University of Delaware(特拉华大学) Athena Research Center(雅典娜研究中心) National Technical University of Athens(雅典国家技术大学) HERON–Center of Excellence in Robotics(赫伦机器人卓越中心)

专题命中 激光雷达 :LiDAR(abstract,abstract_cn);trajectory planning(abstract);分类 cs.RO

AI总结 PathCover是基于点云的快速凸分解框架,采用RISP算法,可高效生成无障碍物多面体,速度较现有方法提升一个数量级,经仿真与实机验证适用于机器人导航。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05482 2026-08-07 cs.CV 新提交 70%

CDSeg: A Renderable Gaussian Carrier for Image-to-3D Label Transfer

CDSeg:用于图像到3D标签迁移的可渲染高斯载体

Wentao Sun, Yiping Chen, Zhengsen Xu, Jonathan Li, John S. Zelek

机构 * University of Waterloo(滑铁卢大学) Sun Yat-sen University(中山大学) University of Calgary(卡尔加里大学)

专题命中 激光雷达 :LiDAR(abstract,abstract_cn);分类 cs.CV

AI总结 CDSeg是基于高斯溅射的跨域分割接口,无需特定任务3D分割训练,可复用2D掩码实现多视图标签迁移,在多个数据集上取得高mIoU,能快速处理大规模场景。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05704 2026-08-07 cs.CV 新提交 57%

G$^2$ARD-GS: Geometry-Guided Anchor-Regularized Gaussian Splatting Distillation

G$^2$ARD-GS:几何引导的锚点正则化高斯溅射蒸馏

Puyuan Zhang, Jianming Huang, Wenkai Ye, Wei Dong

机构 * Shanghai Jiao Tong University(上海交通大学) Jishu Technology Co., Ltd.(集度科技有限公司)

专题命中 激光雷达 :LiDAR(abstract);分类 cs.CV

AI总结 针对3D高斯溅射模型基元过多导致成本高的问题,提出G$^2$ARD-GS几何引导蒸馏方法,在MatrixCity数据集上实现最优压缩性能,提升了外观适配与配准精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05932 2026-08-07 physics.optics 新提交 50%

Harnessing thermo-optic dynamics for frequency-agile soliton microcombs

利用热光动力学实现频率捷变的孤子微梳

Yang Liu, Suwan Sun, Yueguang Zhou, Yanjing Zhao, Chaochao Ye, Xinda Lu, Yi Zheng, Leif Kastuo Oxenløwe, Kresten Yvind, Hairun Guo, Minhao Pu

专题命中 激光雷达 :LiDAR(abstract)

AI总结 该研究通过强模式耦合重塑孤子形成的有效失谐轨迹,将热光效应从限制因素转为主动资源,在AlGaAs多模微谐振器中实现了32 mW泵浦下近100 GHz调谐范围的稳定孤子微梳,支持无需辅助稳定的频率捷变运行。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2606.16278 2026-08-07 cs.CV cs.AI 版本更新 62%

RealityBridge: Bridging Editable 3D Gaussian Splatting Driving Simulations and Real-World Videos

RealityBridge: 连接可编辑3D高斯泼溅驾驶模拟与现实世界视频

Zhenhua Wu, Yun Pang, Mingkun Chang, Yuwei Ning, Liangzhi Wang, Yi Xiao, Guanbin Li

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室) Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education(教育部机器智能与先进计算重点实验室)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 提出RealityBridge框架,利用多模态控制和轻量级GateNet,结合自回归长视频训练与奖励引导后训练,缩小编辑后3DGS驾驶视频的Sim-to-Real差距,提升视觉真实感和时间一致性。

Comments Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏