arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-06-11 至 2026-06-11 共收录 23 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 8 篇

2606.11989 2026-06-11 cs.CV 新提交 83%

From Nominal Intensity to Equivalent Rainfall: A Path-Based Credibility Evaluation Framework for Simulated Rainfall in Autonomous-Driving Perception Tests

从名义强度到等效降雨:自动驾驶感知测试中模拟降雨的基于路径的可信度评估框架

Tian Xia, Xin Zhao, Shaolingfeng Ye, Junyi Chen

机构 * College of Automotive and Energy Engineering, Tongji University(同济大学汽车与能源工程学院) Tsinghua University(清华大学)

专题命中 感知 :driving perception(title,abstract);LiDAR(abstract);分类 cs.CV

AI总结 提出基于路径的可信度评估方法,通过路径等效降雨强度、不确定性带和雨滴分布真实度评分,结合激光雷达点云计数和平均反射率进行感知一致性校正,实现模拟降雨与真实降雨的对齐及测试结果映射。

Comments 17 pages, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11889 2026-06-11 cs.CV cs.AI cs.RO 新提交 82%

Task-Aligned Stability Analysis of Vision-Language Models for Autonomous Driving Hazard Detection

面向自动驾驶危险检测的视觉-语言模型任务对齐稳定性分析

Everett Richards

机构 * Everett Richards(埃弗里特·里奇ards)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 研究视觉-语言模型在自动驾驶危险检测中,嵌入漂移与任务对齐危险分数变化的关系,发现不同腐败类型导致不同的失效模式,建议基准测试包含任务对齐稳定性指标。

Comments 8 pages (5 main body + 3 references / appendices). ICML 2026 Workshop on Combining Theory and Benchmarks (CTB)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11573 2026-06-11 cs.CV 新提交 81%

Understanding Cross-Sensor Feature Variations for Generalizable 3D Perception

理解跨传感器特征变化以实现可泛化的3D感知

Xin Qiu, Wenjie Liu, Fuyuan Ai, YuChen Tan, Zhiwei Xu, Chunyi Song

机构 * Zhejiang University(浙江大学)

专题命中 感知 :BEV(summary_cn,abstract);分类 cs.CV

AI总结 针对雷达-相机BEV感知跨数据集性能下降问题,提出频域场景变化建模框架,通过合成多样源域视图并正则化融合表示,提升3D检测器鲁棒性,无需目标域样本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19463 2026-06-11 cs.RO 版本更新 81%

CU-Multi: A Dataset for Multi-Robot Collaborative Perception

CU-Multi:多机器人协同感知数据集

Doncey Albin, Daniel McGann, Miles Mena, Annika Thomas, Harel Biggie, Xuefei Sun, Steve McGuire, Jonathan P. How, Christoffer Heckman

机构 * Autonomous Robotics and Perception Group at the University of Colorado Boulder(科罗拉多大学波尔得分校自主机器人与感知组) Robot Perception Lab at Carnegie Mellon University(卡内基梅隆大学机器人感知实验室) Aerospace Controls Laboratory at Massachusetts Institute of Technology(麻省理工学院航空航天控制实验室) Computer Science and Artificial Intelligence Laboratory at Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室) Human-Aware Robotic Exploration Lab at University of California Santa Cruz(加州大学圣克ruz分校人感知机器人探索实验室)

专题命中 感知 :LiDAR(summary_cn,abstract);分类 cs.RO

AI总结 针对多机器人协同感知基准测试缺乏专用数据集的问题,提出CU-Multi数据集,包含多天采集的同步多机器人轨迹、RGB-D、RTK GPS、语义LiDAR及精确里程计,支持可重复评估。

Comments 8 pages, 11 figures. arXiv admin note: text overlap with arXiv:2505.17576

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11563 2026-06-11 cs.CV cs.RO 新提交 62%

Cross-Modal Benchmarking for Robotic Perception in Natural Environments

自然环境中机器人感知的跨模态基准测试

David Hall, Joshua Knights, Mark Cox, Peyman Moghadam

机构 * CSIRO Robotics, CSIRO, Australia(CSIRO机器人研究所,CSIRO,澳大利亚) University of Sydney (USyd), Australia(悉尼大学(USyd),澳大利亚) Queensland University of Technology (QUT), Australia(昆士兰理工大学(QUT),澳大利亚)

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 针对自然环境中机器人感知的挑战,提出WildCross跨模态基准,用于大规模自然场景下的地点识别和度量深度估计,并扩展了度量深度估计实验。

Comments Accepted to the IEEE ICRA Workshop on Open Challenges for Rigorous Robot Perception 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12066 2026-06-11 cs.CV 新提交 57%

Performance Analysis of YOLOv11 and YOLOv8 for Mixed Traffic Object Detection under Adverse Weather Conditions in Developing Countries

YOLOv11与YOLOv8在发展中国家恶劣天气下混合交通目标检测的性能分析

Quoc Thuan Nguyen, Ha Anh Vu, Ngo Dang Thanh Ngan, Minh Phuc Hoang Ngoc

机构 * FPT University(FPT大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 针对发展中国家恶劣天气下的混合交通场景,评估YOLOv11n与YOLOv8n在融合数据集上的性能,YOLOv11n在精度提升3.2%的同时计算量减少22%,实现精度与效率的优化平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11419 2026-06-11 cs.RO 新提交 57%

A Modular Dual-Camera Pipeline for Micro-Inspection Using Aerial Robots

一种用于空中机器人微检测的模块化双相机流水线

S. H. Mirtajadini, N. Rublein, R. M. Ramakrishnan, G. ter Maat, M. Aldibaja, A. Y. Mersha

机构 * Netherlands Organization for Scientific Research (NWO)(荷兰科学研究组织) Saxion University of Applied Sciences(萨克逊应用科学大学)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 提出一种模块化双相机空中微检测流水线,通过变焦云台相机和广角立体导航相机协同工作,结合视觉反馈回路,实现对树木和温室粘虫板等非结构目标的鲁棒微检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24119 2026-06-11 cs.CV 版本更新 57%

TopoHR: Hierarchical Centerline Representation for Cyclic Topology Reasoning in Driving Scenes with Point-to-Instance Relations

TopoHR: 面向驾驶场景中循环拓扑推理的层次化中心线表示与点到实例关系

Yifeng Bai, Zhirong Chen, Bo Song, Erkang Cheng, Haibin Ling

机构 * Institute of Intelligent Machines, HFIPS, Chinese Academy of Sciences(智能机器研究所,HFIPS,中国科学院) University of Science and Technology of China(中国科学技术大学) NullMax Westlake University(西湖大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 提出TopoHR框架,通过层次化中心线表示和统一架构中的点到实例与实例到实例关系,实现中心线检测与拓扑推理的循环交互,在OpenLane-V2上取得显著性能提升。

Comments Accepted at CVPR 2026 (camera ready version)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 2 篇

2606.12019 2026-06-11 cs.RO 新提交 74%

MPPI-based Informative Trajectory Planning for Search and Capture of Drifting Targets with ASVs

基于MPPI的自主水面艇搜索与捕获漂移目标的信息轨迹规划

Sanjeev Ramkumar Sudha, Marija Popović, Erlend M. Coates

机构 * Norwegian University of Science and Technology (NTNU)(挪威科技大学) TU Delft(代尔夫特理工大学)

专题命中 规划控制 :trajectory planning(title);分类 cs.RO

AI总结 针对自主水面艇在动态环境中搜索并捕获多个漂移目标的问题,提出一种基于模型预测路径积分(MPPI)控制的混合规划框架,通过优化长时域连续轨迹平衡搜索与跟踪,并在拦截阶段切换至纯追踪制导,实验验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11569 2026-06-11 cs.RO cs.AI 新提交 62%

ConsistencyPlanner: Real-time Planning with Fast-Sampling Consistency Models

ConsistencyPlanner: 基于快速采样一致性模型的实时规划

Qichao Zhang, Xing Fang, Jiaqi Fang, Zhenwen Cai, Jie Ling, Qiankun Yu, Dongbin Zhao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Guangzhou Zaofu Intelligent Technology Co., Ltd.(广州造父智能科技有限公司)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 提出Consistency Planner框架,利用快速采样一致性模型实现高效多模态采样,并结合注意力增强解码器融合异构特征,在Waymax模拟器中显著提升安全性和实时性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. BEV与占用 4 篇

2606.11507 2026-06-11 cs.CV 新提交 85%

SceneMiner: Identity-Preserving Multi-Task Fine-Tuning for Unified BEV Scene Mining

SceneMiner: 保持身份的多任务微调用于统一BEV场景挖掘

Abdalmalek Aburaddaha, Venkatraman Narayanan, Keval Thaker, Samir A. Rawashdeh

机构 * University of Michigan-Dearborn(密歇根大学迪尔伯恩分校)

专题命中 BEV与占用 :BEV(title,title_cn);LiDAR(abstract);分类 cs.CV

AI总结 提出SceneMiner,一种统一的仅相机鸟瞰图管道,通过冻结视觉语言骨干网络在单次前向传播中发出互补的挖掘信号,并发现跨任务干扰问题,通过零初始化新子模块和冻结共享流参数的身份保持多任务微调解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16819 2026-06-11 cond-mat.mtrl-sci physics.comp-ph 75%

Thermodynamical study of N$_2$ clathrate hydrate from DFT calculations

N₂笼合水合物的热力学研究:基于DFT计算

L. Martin-Gondre, V. Meko Fotso, C. Métais, A. Patt, J. Ollivier, A. Desmedt

专题命中 BEV与占用 :occupancy(summary_cn,abstract)

AI总结 通过DFT计算研究N₂在sI和sII结构中的热力学稳定性,发现revPBE-D3(0)能准确预测晶格参数和体积模量,单 occupancy的sI在0.8 GPa压力下仍稳定,而双 occupancy的sII在更高压力下更稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12208 2026-06-11 cond-mat.quant-gas 新提交 50%

Weakly interacting Bose gases in the canonical ensemble

正则系综中的弱相互作用玻色气体

Jonata S. Soares, Axel Pelster, Arnaldo Gammal

专题命中 BEV与占用 :occupancy(abstract)

AI总结 基于无相互作用玻色气体的正则描述,研究弱两体相互作用对热力学和统计性质的微扰修正,得到正则配分函数的递归公式,并应用于盒陷阱中接触相互作用的稀薄玻色气体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11978 2026-06-11 cond-mat.str-el 新提交 50%

The Kondo effect in ferromagnetic quantum critical CeRh$_6$Ge$_4$

铁磁量子临界CeRh$_6$Ge$_4$中的近藤效应

Martin Sundermann, Joe D. Thompson, Eric D. Bauer, Chun Fu Chang, Sheng-Huai Chen, Chang-Yang Kuo, Liu Hao Tjeng, Getrud Zwicknagl, Andrea Severing

专题命中 BEV与占用 :occupancy(abstract)

AI总结 利用光电子和X射线吸收谱研究CeRh$_6$Ge$_4$中4f电子与导带的杂化,发现近藤效应混合晶场态形成多轨道基态,为理解压力诱导量子临界点提供关键信息。

Comments 9 pages, 7 Figures, accepted in Phys. Rev. B

Journal ref Phys. Rev. B 113, 245149 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 激光雷达 6 篇

2606.08744 2026-06-11 cs.CV 版本更新 92%

MB-Loc: Multi-planar Bird's-eye-view Localization in outdoor LiDAR scenes

MB-Loc:室外LiDAR场景中的多平面鸟瞰图定位

Ayaan Choudhury, Preet Savalia, Anirudh Pydah, Avinash Sharma

机构 * Indian Institute of Technology Jodhpur(印度理工学院焦特布尔分校)

专题命中 激光雷达 :LiDAR(title,title_cn);BEV(abstract,abstract_cn);分类 cs.CV

AI总结 提出MB-Loc框架,通过将LiDAR扫描投影为2.5D多平面鸟瞰图表示,结合KL正则化隐瓶颈和3D空间增强,实现轻量级、视角鲁棒的场景坐标回归定位,在NCLT数据集上达到实时推理并超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22926 2026-06-11 cs.RO 版本更新 90%

SR-LIO++: LiDAR-Inertial Odometry and Quantized Mapping with Caching-Aware Sweep Reconstruction

SR-LIO++: 基于缓存感知扫描重建的LiDAR-惯性里程计与量化建图

Zikang Yuan, Ruiye Ming, Chengwei Zhao, Yonghao Tan, Pingcheng Dong, Yuan Ren, Yuzhong Jiao, Xin Yang, Kwang-Ting Cheng

机构 * ACCESS-AI Chip Center for Emerging Smart Systems, InnoHK Centers, Hong Kong Science Park, Hong Kong, China(新兴智能系统 ACCESS-AI 芯片中心,InnoHK 中心,香港科学公园,香港,中国) HongKong University of Science and Technology, HongKong, China(香港理工大学,香港,中国) Huazhong University of Science and Technology, Wuhan, China(华中科技大学,武汉,中国) Hangzhou Qisheng Intelligent Techology Co. Ltd., Hangzhou, China(杭州启盛智能科技有限公司,杭州,中国) Southeast University, Nanjing, China(东南大学,南京,中国)

专题命中 激光雷达 :LiDAR(title,title_cn);分类 cs.RO

AI总结 提出SR-LIO++系统,通过扫描重建提高输出频率,并采用缓存机制和量化地图点管理,在资源受限平台上实现高精度、高效率的LiDAR-惯性里程计。

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11739 2026-06-11 cs.CV cs.AI 新提交 82%

Multi-View In-Cabin Monitoring System for Public Transport Vehicles

公共交通车辆的多视角座舱内监控系统

Evgeny Gorelik, Kenny Dean Karrow, Fikret Sivrikaya, Sahin Albayrak, Christian Baumann

机构 * Technische Universität Berlin(柏林工业大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)

专题命中 激光雷达 :LiDAR(summary_cn,abstract);分类 cs.CV、cs.AI

AI总结 提出一个多视角座舱内监控数据集,包含同步RGB-D图像和LiDAR数据,并提供3D人体姿态和边界框标注,支持多视角3D检测模型评估。

Comments Submitted to ICDM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12042 2026-06-11 cs.RO 新提交 77%

KinematicRL: A Sim-to-Real Reinforcement Learning Framework For Social Navigation With Kinodynamic Feasibility

KinematicRL: 一种面向社交导航的具有运动学可行性的仿真到现实强化学习框架

Zhiming Xu, Haodong Yang, Chengju Liu, Qijun Chen, Chenpeng Yao

机构 * School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Department of Electronics and Information Engineering, Tongji University(同济大学电子与信息工程学院) Shanghai Institute of Intelligent Science and Technology, Tongji University(同济大学上海智能科学与技术研究院)

专题命中 激光雷达 :LiDAR(summary_cn,abstract);分类 cs.RO

AI总结 提出KinematicRL框架,通过二阶控制动作空间、基于2D LiDAR的聚类人体追踪和无偏残差门控模块,解决社交导航中仿真到现实的动态可行性问题。

Comments Accepted by IEEE Transactions on Automation Science and Engineering (T-ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11708 2026-06-11 cs.RO 新提交 70%

Explore From Sketch: Accelerating UAV Exploration in Large-scale Environments with Prior Maps

从草图探索:利用先验地图加速无人机在大规模环境中的探索

Tiancheng Lai, Yuman Gao, Xiangyu Li, Ruitian Pang, Xingpeng Wang, Siqi Shen, Mengke Zhang, Yin He, Fei Gao, Chao Xu, Yanjun Cao

机构 * Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院工业控制技术研究所) Huzhou Institute, Zhejiang University, and Huzhou Key Laboratory of Autonomous System(浙江大学湖州研究院,湖州市自主系统重点实验室) Zhejiang Zhongyan Industry Co., Ltd(浙江中烟工业有限责任公司) Differential Robotics Technology Company(微分机器人技术有限公司)

专题命中 激光雷达 :LiDAR(abstract,abstract_cn);分类 cs.RO

AI总结 提出利用稀疏、未对齐甚至不一致的2D先验地图加速无人机大规模环境探索的框架,通过鲁棒的2D-3D点云配准和层次化视点规划,实现效率提升34.2%。

Comments 25 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11578 2026-06-11 cs.CV 新提交 57%

Contactless 3D Human Body Measurement Using Depth Cameras for Smart Health Monitoring

基于深度相机的非接触式3D人体测量用于智能健康监测

Martha Asare, Xuan Wang, Juan Lopez Alvarenga, Lois Akosua Serwaa, Jinghao Yang

机构 * Department of Computer(计算机系) Department of Information(信息系) Department of Human Genetics(人类遗传学系) University of Texas Rio Grande Valley(德克萨斯大学里奥格兰德谷分校) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 激光雷达 :occupancy(abstract);分类 cs.CV

AI总结 提出一种基于深度相机和3D点云的非接触式人体测量框架,通过空间滤波、地标选择及体素/网格分析实现身高、臂展、体积和表面积等关键指标的准确估计。

Comments 6 pages, 4 figures. Depth camera-based framework for contactless anthropometric measurement and geometric analysis using 3D point clouds

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仿真评测 3 篇

2606.12396 2026-06-11 cs.CV cs.RO 新提交 84%

VLGA: Vision-Language-Geometry-Action Models for Autonomous Driving

VLGA:用于自动驾驶的视觉-语言-几何-动作模型

Jin Yao, Dhruva Dixith Kurra, Tom Lampo, Zezhou Cheng, Danhua Guo, Burhan Yaman

机构 * Uber AV Labs(Uber自动驾驶实验室) University of Virginia(弗吉尼亚大学)

专题命中 仿真评测 :autonomous driving(title);LiDAR(abstract,abstract_cn);分类 cs.RO、cs.CV

AI总结 提出VLGA模型,通过引入几何作为第四模态,利用逐像素点图回归损失监督,实现密集3D世界重建,在nuScenes和Bench2Drive上达到SOTA。

Comments Project page: https://yaojin17.github.io/VLGA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12207 2026-06-11 cs.RO cs.AI 新提交 62%

Intelligent Automation for Embodied Benchmark Construction: Pipelines, Embodiments, Simulators, and Trends

具身基准构建的智能自动化:流程、具身、模拟器与趋势

Jinshan Lai, Jianwei Hu, Baoyang Jiang, Fengchun Zhang, Leyuan Wang, Haotian Li, Yida Wang, Tingxuan Huang, Xi Ren, Qiang Ma

机构 * University of Electronic Science and Technology of China(电子科技大学) Qiyuan Lab(启元实验室) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) Beihang University(北京航空航天大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 本文综述具身智能基准构建的五阶段流程,分析从人工到自动化再到智能体闭环的转变,指出自动化将成本转向验证与治理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00461 2026-06-11 cs.CV 版本更新 57%

ReMoT: Reinforcement Learning with Motion Contrast Triplets

ReMoT: 基于运动对比三元组的强化学习

Cong Wan, Zeyu Guo, Jiangyang Li, SongLin Dong, Yifan Bai, Lin Peng, Zhiheng Ma, Yihong Gong

机构 * Xi’an Jiaotong University(西安交通大学) Shenzhen University of Advanced Technology(深圳先进技术大学) DAMO Academy, Alibaba Group(阿里巴巴集团 DAMO 院)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出ReMoT统一训练范式,通过规则生成大规模运动对比数据集和组相对策略优化,解决VLM时空一致性问题,在时空推理任务上提升25.1%。

Comments CVPR 2026 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏