arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-05-12 至 2026-05-12 共收录 15 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 规划控制 15 篇

2506.11419 2026-05-12 cs.AI cs.RO 82%

FocalAD: Local Motion Planning for End-to-End Autonomous Driving

FocalAD:端到端自动驾驶中的局部运动规划

Bin Sun, Boao Zhang, Jiayi Lu, Xinjie Feng, Jiachen Shang, Rui Cao, Mengchao Zheng, Chuanye Wang, Shichun Yang, Yaoguang Cao, Ziying Song

机构 * School of Transportation Science and Engineering(交通科学与工程学院) State Key Lab of Intelligent Transportation System(智能交通运输系统国家重点实验室) Hangzhou International Innovation Institute(杭州国际创新研究院) School of Computer Science and Technolog(计算机科学与技术学院) Beijing Jiaotong University(北京交通大学)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出FocalAD框架,通过增强局部运动表示和关注关键局部邻居,提升自动驾驶的规划可靠性与鲁棒性,在nuScenes和Bench2Drive等数据集上表现优异。

Journal ref FocalAD: Local Motion Planning for End-to-End Autonomous Driving. Automot. Innov. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10744 2026-05-12 cs.CV cs.RO 81%

C-CoT: Counterfactual Chain-of-Thought with Vision-Language Models for Safe Autonomous Driving

C-CoT:基于视觉-语言模型的反事实链式推理用于安全自动驾驶

Kefei Tian, Yuansheng Lian, Kai Yang, Xiangdong Chen, Shen Li

机构 * College of Transportation, Tongji University(同济大学交通运输学院) Department of Civil Engineering, Tsinghua University(清华大学土木工程系) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院) Department of Civil and Environmental Engineering, National University of Singapore(新加坡国立大学土木与环境工程系)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出C-CoT框架,利用视觉-语言模型将驾驶决策分解为五个阶段,通过反事实推理提升自动驾驶在复杂环境中的安全性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02450 2026-05-12 cs.RO cs.AI cs.LG 81%

CHARMS: A Cognitive Hierarchical Agent for Reasoning and Motion Stylization in Autonomous Driving

CHARMS:用于自动驾驶中的推理与运动风格化的认知层次代理

Jingyi Wang, Duanfeng Chu, Zejian Deng, Liping Lu, Jinxiang Wang, Chen Sun

机构 * School of Mechanical and Electronic Engineering, Wuhan University of Technology(武汉理工大学机械与电子工程学院) Intelligent Transportation Systems Research Center, Wuhan University of Technology(武汉理工大学智能交通系统研究所) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系) School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) School of Mechanical Engineering, Southeast University(东南大学机械工程学院)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 CHARMS通过强化学习预训练和监督微调pipeline,实现人类般的决策行为和交互真实性,同时利用泊松认知层次理论生成多样化驾驶场景。

Journal ref ITSC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08536 2026-05-12 eess.SP 78%

Online UAV Trajectory Planning Under QoS Constraints to Mobile Users in Urban Environments

面向城市环境中移动用户的QoS约束下的无人机轨迹规划

Chenrui Qiu, Loizos Kanaris, Yongxu Zhu, Tasos Dagiuklas

专题命中 规划控制 :trajectory planning(title,abstract)

AI总结 本文研究了单架无人机在城市环境中为多个移动地面用户实时规划轨迹和无线资源分配,考虑异构用户移动性和QoS约束,采用在线强化学习方法优化轨迹以平衡吞吐量和用户公平性。

Comments Accepted to the IEEE 15th International Symposium on Communication Systems, Networks and Digital Signal Processing (CSNDSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09939 2026-05-12 cs.RO 70%

Neural Distance-Guided Path Integral Control for Tractor-Trailer Navigation

神经距离引导的路径积分控制用于拖拉机-挂车导航

Peng Wei, Chen Peng, Stavros Vougioukas

机构 * Department of Biological and Agricultural Engineering, University of California Davis(加州大学戴维斯分校生物与农业工程系) ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州全球科技创新中心)

专题命中 规划控制 :LiDAR(abstract,abstract_cn);分类 cs.RO

AI总结 本文提出基于几何神经编码器的路径积分控制器,用于实现拖拉机-挂车在复杂农业环境中的安全导航,通过实时距离估计提升动态可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03895 2026-05-12 cs.RO cs.CV 62%

NoTVLA: Semantics-Preserving Robot Adaptation via Narrative Action Interfaces

NoTVLA:通过叙事动作接口实现语义保留的机器人适应

Zheng Huang, Mingyu Liu, Xiaoyi Lin, Muzhi Zhu, Canyu Zhao, Zongze Du, Ye Lin, Xiaoman Li, Yiduo Jia, Hao Zhong, Hao Chen, Chunhua Shen

机构 * Zhejiang University(浙江大学)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO、cs.CV

AI总结 NoTVLA通过稀疏轨迹规划减少灾难性遗忘,提升多任务性能,以更低计算成本和无需腕部摄像头实现高精度与语言能力保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18486 2026-05-12 cs.CV cs.CL cs.RO 62%

Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation

小米OneVL:基于视觉-语言解释的一步潜在推理与规划

Jinghui Lu, Jiayi Guan, Zhijian Huang, Jinlong Li, Guang Li, Lingdong Kong, Yingyan Li, Han Wang, Shaoqing Xu, Yuechen Luo, Fang Li, Chenxu Dang, Junli Wang, Tao Xu, Jing Wu, Jianhua Wu, Xiaoshuai Hao, Wen Zhang, Tianyi Jiang, Lingfeng Zhang, Lei Zhou, Yingbo Tang, Jie Wang, Yinfeng Gao, Xizhou Bu, Haochen Tian, Yihang Qiu, Feiyang Jia, Lin Liu, Yigu Ge, Hanbing Li, Yuannan Shen, Jianwei Cui, Hongwei Xie, Bing Wang, Haiyang Sun, Jingwei Zhao, Jiahui Huang, Pei Liu, Zeyu Zhu, Yuncheng Jiang, Zibin Guo, Chuhong Gong, Hanchao Leng, Kun Ma, Naiyan Wang, Guang Chen, Kuiyuan Yang, Hangjun Ye, Long Chen

机构 * Xiaomi Embodied Intelligence Team(小米具身智能团队)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 OneVL通过双重辅助解码器监督的紧凑潜在标记,实现了视觉-语言解释的一步潜在推理与规划,首次在延迟条件下超越了显式推理方法。

Comments Technical Report; 49 pages, 22 figures, 10 tables; Project Page at https://xiaomi-embodied-intelligence.github.io/OneVL GitHub at https://github.com/xiaomi-research/onevl

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10624 2026-05-12 cs.AI cs.LG 57%

Hierarchical Causal Abduction: A Foundation Framework for Explainable Model Predictive Control

层次因果反推:可解释模型预测控制的基础框架

Ramesh Arvind Naagarajan, Zühal Wagner, Stefan Streif

机构 * System Dynamics, Chemnitz University of Technology, Chemnitz, Germany(化学特伦茨大学系统动力学系) Department of Bioresources, Fraunhofer Institute for Molecular Biology and Applied Ecology(弗劳恩霍夫分子生物学与应用生态学研究所生物资源系)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.AI

AI总结 本文提出层次因果反推框架,结合领域知识图、KKT乘子证据和PCMCI算法,提升非线性MPC控制动作的可解释性,实验显示在温室气候、建筑HVAC和化工过程应用中,解释准确率比LIME高53%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07910 2026-05-12 cs.CV 57%

One World, Dual Timeline: Decoupled Spatio-Temporal Gaussian Scene Graph for 4D Cooperative Driving Reconstruction

一个世界,双时间线:解耦的空间-时间高斯场景图用于4D协同驾驶重建

Yulong Chen, Xiaoyun Dong, Haoyu Zhang, Zongxian Yang, Lewei Xie, Xinke Li, Yifan Zhang, Kai Wang, Jianping Wang

机构 * City University of Hong Kong (Dongguan)(香港城市大学(东莞)) City University of Hong Kong(香港城市大学) SLAI

专题命中 规划控制 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出DUST解耦空间-时间高斯场景图,解决车辆与基础设施相机时间不同步导致的动态场景重建问题,通过解耦姿态轨迹和静态锚点校正提升重建精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08975 2026-05-12 cs.AI 57%

Latency Analysis and Optimization of Alpamayo 1 via Efficient Trajectory Generation

通过高效轨迹生成分析和优化Alpamayo 1的延迟

Yunseong Jeon, Namcheol Lee, Yoonsu Lee, Jangwoon Park, Sol Ahn, Jong-Chan Kim, Seongsoo Hong

机构 * Graduate School of Automobile and Mobility(汽车与移动研究生院) Kookmin University(韩国釜山大学) Department of Electrical and Computer Engineering(电子与计算机工程系) Seoul National University(首尔国立大学)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.AI

AI总结 本文通过将Alpamayo 1从多推理改为单推理系统,减少推理延迟并保持轨迹多样性,同时通过消除不必要的复制操作和低效内核执行提升扩散动作生成效率,实现了69.23%的延迟降低。

Comments Submitted to IEEE RTCSA on March 26, 2026 (KST) Accepted on May 4, 2026 (KST)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09317 2026-05-12 cs.LG cs.AI stat.ML 57%

SnareNet: Flexible Repair Layers for Neural Networks with Hard Constraints

SnareNet:带有硬约束的神经网络灵活修复层

Ya-Chi Chu, Alkiviades Boukas, Madeleine Udell

机构 * Department of Mathematics, Stanford University(斯坦福大学数学系) Institute for Computational and Mathematical Engineering, Stanford University(斯坦福大学计算与数学工程研究所) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.AI

AI总结 SnareNet通过引入可微修复层和自适应放松机制,实现神经网络输出满足输入依赖约束,提升了约束满足的精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10562 2026-05-12 math.NA cs.NA 50%

Data-driven moving-window Bayesian inference for transient CO2-temperature network models of buildings

数据驱动的滑动窗口贝叶斯推断用于建筑 transient CO2-温度网络模型

Zhijian Wang, Stein K. F. Stoter, Clemens V. Verhoosel, Idoia Cortes Garcia

专题命中 规划控制 :occupancy(abstract)

AI总结 本文提出一种将多区质量传输与热动力学通过共享潜在驱动因素、空气流动和占用情况联系起来的 CO2-温度网络模型,通过滑动窗口贝叶斯推断联合估计热参数、空气流动和占用轨迹,提供房间特定的传感器噪声水平,实现后验预测预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10018 2026-05-12 cs.LG 50%

The Value of Mechanistic Priors in Sequential Decision Making

在序列决策中机制先验的价值

Itai Shufaro, Gal Benor, Shie Mannor

机构 * Technion(技术学院) NVIDIA Research(NVIDIA研究)

专题命中 规划控制 :occupancy(abstract)

AI总结 本文研究了机制先验在序列决策中的价值,通过渐近和预热阶段的分析,提出机制信息度量并展示其在5-FU给药模拟中的高效性,对比LLM先验发现其在机械信息上存在严重损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19447 2026-05-12 eess.SY cs.SY 50%

A Gauss-Newton-Induced Structure-Exploiting Algorithm for Differentiable Optimal Control

一种基于Gauss-Newton诱导的结构利用算法用于可微最优控制

Yuankun Chen, Zifei Nie, Xun Gong, Yunfeng Hu, Hong Chen

专题命中 规划控制 :autonomous driving(abstract)

AI总结 本文提出FastDOC算法,利用Gauss-Newton近似和矩阵结构特性,提升可微最优控制的计算效率,实验证明在自动驾驶任务中具有显著优势。

Comments Accepted for publication at 2026 IFAC World Congress, Busan

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08946 2026-05-12 cs.LG 50%

A Single Deep Preference-Conditioned Policy for Learning Pareto Coverage Sets

一种单个深度偏好条件政策用于学习帕累托覆盖集

Akihiro Kubo, Kosuke Nakanishi, Shin Ishii

机构 * International Research Center for Neurointelligence, The University of Tokyo(国际神经智能研究中心,东京大学) ATR Neural Information Analysis Laboratories(ATR神经信息分析实验室) Department of Information Science, Kyoto University(京都大学信息科学系)

专题命中 规划控制 :occupancy(abstract)

AI总结 本文研究了基于偏好条件的多目标强化学习,通过平滑Tchebycheff标量化方法证明了偏好与帕累托最优回报向量的唯一性和连续性,并提出CMDPI算法实现O(1/k)的收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏