arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-09 至 2026-04-09 共收录 14 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14 篇

2309.08780 2026-04-09 cs.RO 83%

STERN: Simultaneous Trajectory Estimation and Relative Navigation for Autonomous Underwater Proximity Operations

STERN: 自主水下近距操作中的轨迹估计与相对导航

Aldo Terán Espinoza, Antonio Terán Espinoza, John Folkesson, Clemens Deutsch, Niklas Rolleberg, Peter Sigray, Jakob Kuttenkeuler

机构 * Centre for Naval Architecture, KTH Royal Institute of Technology(KTH皇家理工学院海军建筑中心) Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(KTH皇家理工学院机器人、感知与学习系)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出STERN方法,通过因子图模型实现自主水下车辆的近距操作中的轨迹估计与相对导航,通过模拟和真实数据验证了方法的灵活性和动态假设的限制。

Comments v2 updated after revision. Article contains 24 pages and 18 figures. Published in the IEEE Journal of Oceanic Engineering, available at: https://doi.org/10.1109/JOE.2025.3624470

Journal ref IEEE Journal of Oceanic Engineering, vol. 51, no. 1, pp. 293-316, Jan. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07286 2026-04-09 cs.RO cs.AI cs.LG 82%

CADENCE: Context-Adaptive Depth Estimation for Navigation and Computational Efficiency

CADENCE:面向导航和计算效率的上下文自适应深度估计

Timothy K Johnsen, Marco Levorato

机构 * San Diego State University(圣地亚哥州立大学) University of California, Irvine(加州大学尔湾分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 CADENCE通过动态调整轻量级单目深度估计网络的计算复杂度,实现导航需求与环境上下文的闭环控制,降低能耗并提升导航精度。

Comments 7 pages, 7 figures, Accepted for publication at IEEE World AI IoT Congress (AIIoT) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05529 2026-04-09 cs.AI cs.RO 81%

Before We Trust Them: Decision-Making Failures in Navigation of Foundation Models

在我们信任之前:基础模型导航决策中的失败

Jua Han, Jaeyoon Seo, Jungbin Min, Sieun Choi, Huichan Seo, Jihie Kim, Jean Oh

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 研究发现基础模型在导航任务中存在显著决策失败,需更细致评估以理解其局限性。

Comments Corrected author order in metadata; manuscript changed

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18525 2026-04-09 cs.RO cs.CV 81%

Splatblox: Traversability-Aware Gaussian Splatting for Outdoor Robot Navigation

Splatblox:面向户外机器人导航的可通行性感知高斯点绘制

Samarth Chopra, Jing Liang, Gershom Seneviratne, Yonghan Lee, Jaehoon Choi, Jianyu An, Stephen Cheng, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学帕克分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 Splatblox通过融合RGB图像和LiDAR点云,构建了具有几何和语义信息的可通行性感知ESDF,实现户外复杂环境下的实时自主导航,实验表明其在可通行性判断和路径规划方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06972 2026-04-09 cs.RO cs.MA 79%

Differentiable Environment-Trajectory Co-Optimization for Safe Multi-Agent Navigation

可微环境-轨迹联合优化用于安全多智能体导航

Zhan Gao, Gabriele Fadini, Stelian Coros, Amanda Prorok

机构 * University of Cambridge(剑桥大学) Zurich University of Applied Sciences, ZHAW(苏黎世应用科技大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种可微环境-轨迹联合优化方法,通过双层优化问题提升多智能体导航的安全性和效率,实验验证了其在物流和交通场景中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05477 2026-04-09 cs.RO 79%

Trust Through Transparency: Explainable Social Navigation for Autonomous Mobile Robots via Vision-Language Models

通过透明实现信任:通过视觉语言模型实现自主移动机器人的可解释社交导航

Oluwadamilola Sotomi, Devika Kodi, Aliasghar Arab

机构 * New York University, Tandon School of Engineering(纽约大学坦登工程学院) General Autonomy Inc.(通用自主公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种多模态可解释模块,结合视觉语言模型和热图提升自主导航的透明度,通过自然语言总结使机器人感知、分析并表达观察结果,实验表明实时解释能提升用户信任和理解。

Comments Submitted to IEEE Conferences

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13200 2026-04-09 cs.HC 78%

Navig-AI-tion: Navigation by Contextual AI and Spatial Audio

导航-AI:通过上下文AI和空间音频进行导航

Mathias N. Lystbæk, Haley Adams, Ranjith Kagathi Ananda, Eric J Gonzalez, Luca Ballan, Qiuxuan Wu, Andrea Colaço, Peter Tan, Mar Gonzalez-Franco

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出结合视觉语言模型与空间音频的导航系统,通过环境地标锚定指令并提供方向性空间音频信号,提升导航准确性与用户体验。

Comments 5 pages, 2 figures, to be published in Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems (CHI EA '26), 6 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06621 2026-04-09 cs.GL cs.LG stat.ML 57%

The Theorems of Dr. David Blackwell and Their Contributions to Artificial Intelligence

大卫·布莱克韦尔定理及其对人工智能的贡献

Napoleon Paxton

机构 * School of Information, University of California, Berkeley(加州大学伯克利分校信息学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本文综述了布莱克韦尔的三个重要定理及其对现代人工智能和机器学习的影响,包括马尔可夫链蒙特卡罗推断、自主机器人导航、生成模型训练等领域的应用。

Comments Survey article, 19 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06392 2026-04-09 cs.AI cs.MA cs.SE 57%

Qualixar OS: A Universal Operating System for AI Agent Orchestration

Qualixar OS:面向AI代理编排的通用操作系统

Varun Pratap Bhardwaj

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 Qualixar OS是首个应用层操作系统,支持异构多代理系统,提供10个LLM供应商、8+代理框架和7种传输的完整运行时,包含12种多代理拓扑执行语义、LLM驱动的团队设计引擎、三层模型路由、共识判断管道、四层内容归属和通用兼容性等功能。

Comments 20 pages, 7 figures, 8 tables. Zenodo DOI: 10.5281/zenodo.19454219

URL PDF HTML 收藏
2601.07154 2026-04-09 cs.CV 57%

Motion Focus Recognition in Fast-Moving Egocentric Video

眼动视频中运动聚焦识别

Si-En Hong, James Tribble, Alexander Lake, Hao Wang, Chaoyi Zhou, Ashish Bastola, Siyu Huang, Eisa Chaudhary, Brian Canada, Ismahan Arslan-Ari, Abolfazl Razi

机构 * Clemson University(克莱姆森大学) University of South Carolina Beaufort(南卡罗来纳大学博福特分校) University of South Carolina(南卡罗来纳大学)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 本文提出一种实时运动聚焦识别方法,通过相机姿态估计基础模型和系统级优化,实现对眼动视频中主体运动意图的估计,适用于边缘部署的运动分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07279 2026-04-09 cs.CV 57%

Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training

Mem3R: 基于混合记忆的流式3D重建

Changkun Liu, Jiezhi Yang, Zeman Li, Yuan Deng, Jiancong Guo, Luca Ballan

机构 * Google(谷歌) The Hong Kong University of Science and Technology(香港科技大学) University of Southern California(南加州大学)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 Mem3R通过分离相机跟踪与几何映射,利用隐式快权记忆和显式token状态提升长序列的时序一致性,相比CUT3R显著提升性能并减小模型规模。

Comments Project page: https://lck666666.github.io/Mem3R/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09646 2026-04-09 cs.CV 57%

VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification

VHOI:通过运动稠密化从稀疏轨迹生成可控的人-物交互视频

Wanyue Zhang, Lin Geng Foo, Thabo Beeler, Rishabh Dabral, Christian Theobalt

机构 * MPI for Informatics, SIC(马克斯·普朗克信息学研究所,SIC) VIA Center(VIA中心) Google(谷歌)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 VHOI通过运动稠密化将稀疏轨迹转化为HOI掩码序列,再通过视频扩散模型生成可控的人-物交互视频,提出了一种新颖的HOI-aware运动表示,增强了模型对真实交互动态的理解与生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06175 2026-04-09 cs.HC 50%

User-Centric Design of UI for Mobile Banking Apps: Improving UI and Features for Better Customer Experience

以用户为中心的移动银行应用UI设计:通过改进UI和功能提升客户体验

Luniva Chitrakar, Ishan Panta, Biplov Paneru, Sangharsh Poudel, Lahana Kansakar

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过用户调研和测试,探讨移动银行应用UI设计改进,以提升用户体验,解决导航、术语不清等问题,并提出利用格式心理学优化布局。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16183 2026-04-09 eess.SP 50%

Xona Pulsar Compatibility with GNSS

Xona Pulsar 与 GNSS 的兼容性

Tyler G. R. Reid, Matteo Gala, Mathieu Favreau, Argyris Kriezis, Michael O'Meara, Andre Pant, Paul Tarantino, Christina Youn

专题命中 具身导航 :navigation(abstract)

AI总结 研究评估Xona Pulsar与GPS和伽利略系统的兼容性,通过分析C/N0退化验证其信号对现有GNSS的干扰影响,证明其在保持高精度的同时实现与现有系统的共存。

Comments 15 pages, 12 figures

Journal ref ION GNSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏