arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-08-04 至 2026-08-04 共收录 44 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. BEV与占用 7 篇

2608.01210 2026-08-04 cond-mat.mtrl-sci 新提交 50%

EBSD and Subtle Crystallographic Differences - A Study of Resolving Interlayer Spacings in Nb-Ni and Nb-Co mu-phases

EBSD与细微晶体学差异——Nb-Ni和Nb-Co μ相中间层间距的分辨研究

Lukas Berners, Nisa Ulumuddin, Annika Baum, Silvia Richter, Khalil Rejiba, Joshua Spille, Siyuan Zhang, Christina Scheu, Joachim Mayer, Benjamin Berkels, T. Ben Britton, Sandra Korte-Kerzel

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本研究评估EBSD分辨金属间化合物细微晶体学特征的能力,结合模式匹配与动力学模拟,成功预测Nb-Co和Nb-Ni μ相的中间层间距变化,与XRD和HR-TEM结果吻合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29016 2026-08-04 cs.DS math.PR 交叉投稿 50%

Nonlinear Exchange Dynamics for Independent Sets

独立集的非线性交换动力学

Mehrad Abbaszadeh Minab, Pietro Caputo, Zongchen Chen, Mario Morellini, Alistair Sinclair

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文针对硬核模型开发非线性动力学分析的基础理论工具,证明两类非线性动力学在低密度下的收敛性,设计了基于粒子系统动力学的简单采样算法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 激光雷达 7 篇

2608.02309 2026-08-04 cs.CV 新提交 91%

CalibBEV: LiDAR-Camera Calibration via BEV Alignment

CalibBEV:基于鸟瞰图对齐的激光雷达-相机标定方法

Filippo D'Addeo, Lorenzo Cipelli, Adriano Cardace, Emanuele Ghelfi, Andrea Zinelli, Massimo Bertozzi

机构 * University of Bologna(博洛尼亚大学) University of Parma(帕尔马大学) Stanford University(斯坦福大学) VisLab srl(VisLab有限公司) Ambarella Inc.(安霸公司)

专题命中 激光雷达 :BEV(title,summary_cn);LiDAR(title,abstract);分类 cs.CV

AI总结 CalibBEV是一种激光雷达-相机标定方法,通过两步BEV对齐结合CLIP对比损失实现跨模态统一,在KITTI、nuScenes基准上大幅降低了标定误差,达到最优性能。

Journal ref Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision. 2026. p. 4345-4354

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02320 2026-08-04 cs.RO cs.CV 新提交 82%

TravKAN: Fast and Interpretable Nonlinear Traversability Analysis with Kolmogorov-Arnold Networks

TravKAN:基于Kolmogorov-Arnold网络的快速可解释非线性可通行性分析

Daniel Fusaro, Simone Mosco, Wanmeng Li, Alberto Pretto

专题命中 激光雷达 :LiDAR(summary_cn,abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于Kolmogorov-Arnold网络的TravKAN框架,结合LiDAR反射率手工特征,在公开数据集上性能优于传统深度模型,兼具可解释性与高效性,适用于安全关键的机器人可通行性分析。

Comments This paper has been accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02285 2026-08-04 cs.CV 新提交 79%

Sen-Cap: Sensor-Flexible and Noise-Resilient Human Motion Capture via LiDAR-Camera Integration

Sen-Cap:基于激光雷达-相机融合的传感器灵活且抗噪的人体运动捕捉框架

Aoru Xue, Yujing Sun, Yiming Ren, Kwok-Yan Lam, Mao Ye, Yuexin Ma

机构 * ShanghaiTech University(上海科技大学) Digital Trust Centre, Nanyang Technological University(南洋理工大学数字信托中心)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 Sen-Cap是一种无需传感器间校准的激光雷达-相机融合人体运动捕捉框架,通过跨传感器运动估计器与抗噪轨迹跟踪器实现灵活部署与强鲁棒性,在多数据集上达最优性能,适用于真实场景。

Comments 16 pages, 8 figures, 4 tables. Accepted at ECCV 2026. Aoru Xue and Yujing Sun contributed equally. Yuexin Ma is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00687 2026-08-04 cs.CV 新提交 79%

Proteus: A Truncation-Robust Entropy Model for Progressive LiDAR Compression

Proteus:适用于渐进式激光雷达压缩的抗截断熵模型

Yihan Qiu, Xiaodong Lin, Baoquan Zhao, Hailong Jiao, Ge Li

机构 * Peking University(北京大学) Sun Yat-sen University(中山大学)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 提出名为Proteus的激光雷达压缩编解码器,通过解耦编码实现抗70%比特流截断,在理想信道下优于G-PCC、Draco等标准及Unicorn,可用于安全关键感知场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18819 2026-08-04 cs.CV 版本更新 70%

Parameter-Efficient CLIP Adaptation for 3D Understanding via Unified Tokenization

用于3D理解的参数高效CLIP适配:通过统一分词实现

Guofeng Mei, Qinfeng Xiao, Bin Ren, Luigi Riz, Juan Liu, Xiaoshui Huang, Xu Zheng, Nicu Sebe, Ming-Hsuan Yang, Fabio Poiesi

机构 * Fondazione Bruno Kessler(布鲁诺·科塞拉基金会) University of Trento(特伦托大学) University of Pisa(比萨大学) Beijing Forestry University(北京林业大学) Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology (GZ)(香港科技大学) Shandong University(山东大学) University of California, Merced(加州大学默塞德分校)

专题命中 激光雷达 :LiDAR(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出参数高效框架UTok3D,通过学习尺度归一化3D分词器,实现冻结CLIP视觉主干在无标注情况下对不同尺度点云的复用,完成3D分割任务。

Comments 14 pages, tokenizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08071 2026-08-04 cs.IT math.IT 版本更新 67%

Integrated Localization, Mapping, and Communication through VCSEL-Based Light-emitting RIS (LeRIS)

基于垂直腔面发射激光器(VCSEL)的发光可重构智能表面(LeRIS)实现定位、建图与通信的集成

Rashid Iqbal, Dimitrios Bozanis, Dimitrios Tyrovolas, Sotiris Ioannidis, Christos K. Liaskos, Muhammad Ali Imran, George K. Karagiannidis, Hanaa Abumarshoud

专题命中 激光雷达 :LiDAR(abstract,abstract_cn)

AI总结 本文提出基于VCSEL的LeRIS框架,可联合实现用户定位、避障建图与毫米波通信,通过仿真验证其能达到厘米级定位精度、可靠障碍物检测及频谱效率与用户速率增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00286 2026-08-04 physics.optics cond-mat.mtrl-sci 新提交 50%

Hybrid BaTiO3/TiO2 Metasurface for Efficient Gigahertz-Speed Free-Space Electro-Optic Modulation

用于高效千兆赫兹速自由空间电光调制的混合BaTiO3/TiO2超表面

Zhongpeng Sun, Kerolos M. A. Yousef, Michael Domm, Agham Posadas, Xudong Li, Marcus Ossiander, Maryna L. Meretska, Yiwei Ju, Isabel Barth, Jason Tischler, Theodore P. Letsou, Moaz Waqar, Amirhassan Shams-Ansari, Xiaoqing Pan, Alexander A. Demkov, Federico Capasso

专题命中 激光雷达 :LiDAR(abstract)

AI总结 该研究开发混合BaTiO3/TiO2超表面,结合可扩展薄膜生长与纳米加工技术,实现高效千兆赫兹速自由空间电光调制,为激光雷达等领域提供高性能调制器的可扩展方案。

Comments 21 pages, 4 figures, 1 table. Supplementary Information: 27 pages, 11 figures, 7 supplementary notes

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多传感器融合 2 篇

2608.01535 2026-08-04 cs.CV cs.RO 新提交 79%

STAR-VLM: Spatiotemporal Grounding Vision-Language Models for Motion and Velocity Estimation via Automotive Radar Supervision

STAR-VLM:基于汽车雷达监督的时空视觉语言模型,用于运动与速度估计

Pou-Chun Kung, Aryaman Rao, Utkrisht Sahai, Hemanth Murali, Yi Liu, Rui-Yu Lin, Katherine A. Skinner

机构 * University of Michigan(密歇根大学)

专题命中 多传感器融合 :LiDAR(abstract,abstract_cn);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出STAR-VLM框架,利用汽车雷达监督提升时空视觉语言模型的运动推理与度量速度估计能力,在驾驶场景相关任务上实现了优于特定任务方法的最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02191 2026-08-04 cs.CV 新提交 57%

DerainSplat: Feed-Forward Clean 3D Gaussian Splatting from Sparse Rainy Views

DerainSplat:基于稀疏雨天视图的前馈式干净3D高斯溅射重建

Fuzhen Jiang, Changyue Shi, Chuxiao Yang, Xinyuan Hu, Wenjie Ye, Minghao Chen

专题命中 多传感器融合 :autonomous driving(abstract);分类 cs.CV

AI总结 DerainSplat是一种前馈框架,可从少量雨天视图重建干净3D场景,通过四阶段合成数据集与天气网络等设计,在多类数据集上优于现有方法且泛化性强。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仿真评测 3 篇

2608.01998 2026-08-04 cs.DC cs.AI cs.NI 新提交 79%

TALSC: Timeliness-Aware Large-Small VLM Collaboration for Infrastructure-Assisted Autonomous Driving

TALSC:面向基础设施辅助自动驾驶的时效性感知大小视觉语言模型协作

Mengmeng Zhu, Yuxuan Sun, Wei Chen, Bo Ai

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.AI

AI总结 针对基础设施辅助自动驾驶中VLM协作的时效性问题,提出TALSC框架,通过李雅普诺夫漂移加估计惩罚算法优化调度,在nuScenes仿真中较最优基线实现Micro-F1最高12.6%的归一化提升。

Comments This paper has been accepted by IEEE GLOBECOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00298 2026-08-04 cs.AI 新提交 79%

WM-Cov: Test Adequacy for Interactive World-Model-Style Autonomous Driving Simulation

WM-Cov:交互式世界模型式自动驾驶仿真的测试充分性

Jianxun Cui, Ping Wu, Stanisa Peric, Marko Milojkovic, Vladan Devedzic

机构 * School of Transportation Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学交通科学与工程学院) Chongqing Research Institute of HIT(哈尔滨工业大学重庆研究院) Chongqing Changan Automobile Co., Ltd.(重庆长安汽车股份有限公司) University of Nis(尼什大学) University of Belgrade(贝尔格莱德大学)

专题命中 仿真评测 :autonomous driving(title,abstract);分类 cs.AI

AI总结 本文针对交互式世界模型式自动驾驶仿真测试的充分性问题,提出与提供方无关的 WM-Cov 评估层,经多组实验验证其可通过有效交互式证据收敛性更科学地评估测试效果。

Comments 11 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00878 2026-08-04 cs.IT math.IT 新提交 78%

Goal-Oriented Logic-based Semantic Communication for Neuro-Symbolic Reasoning with Applications onto Autonomous Driving

面向目标的基于逻辑的语义通信及用于自动驾驶的神经符号推理

Ahmet Faruk Saz, Duo Xu, Faramarz Fekri

专题命中 仿真评测 :autonomous driving(title,abstract)

AI总结 本文针对自动驾驶场景,提出基于一阶逻辑的目标导向语义通信方法,通过选择关键证据传输实现安全决策,在相同通信预算下优于均匀证据选择。

详情

展开后加载摘要…

URL PDF HTML 收藏