arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14018 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14018 篇

2603.22800 2026-03-25 cs.RO 79%

CATNAV: Cached Vision-Language Traversability for Efficient Zero-Shot Robot Navigation

CATNAV:基于缓存的视觉-语言可 traversability 用于高效零样本机器人导航

Aditya Potnis, Francisco Affonso, Shreya Gummadi, Naveen Kumar Uppalapati, Girish Chowdhary

机构 * Field Robotics Engineering and Science Hub (FRESH)(田纳西机器人工程与科学中心(FRESH))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 CATNAV通过多模态LLM生成零样本、体态感知的成本图,利用视觉语义缓存机制减少85.7%的在线VLM查询,结合基于VLM的轨迹选择模块,在五项导航任务中实现更高的目标到达率和更少的行为约束违规。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22502 2026-03-25 cs.RO 79%

MapForest: A Modular Field Robotics System for Forest Mapping and Invasive Species Localization

MapForest:一种用于森林制图和入侵物种定位的模块化野外机器人系统

Sandeep Zachariah, Francisco Yandun, Sachet Korada, Abhisesh Silwal

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 具身导航 :robotics(title,abstract);分类 cs.RO

AI总结 本文提出MapForest,一种模块化机器人系统,利用多模态传感器数据生成GIS-ready的入侵物种地图,通过LiDAR-惯性制图、图像识别和地理参考制图实现精准定位,实验显示其在GNSS间断环境下具有高精度和鲁棒性。

Comments 8 pages, 9 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22182 2026-03-24 cs.RO 79%

Cross-Modal Reinforcement Learning for Navigation with Degraded Depth Measurements

跨模态强化学习用于退化深度测量的导航

Omkar Sawant, Luca Zanatta, Grzegorz Malczyk, Kostas Alexis

机构 * Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(工程 cybernetics 部,挪威科学技术大学(NTNU))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出利用深度和灰度图像互补信息的跨模态学习框架,通过跨模态一致性学习共享潜在表示,实现深度退化下的鲁棒导航。

Comments Accepted to the 24th European Control Conference (ECC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10154 2026-03-24 cs.RO 79%

CompassNav: Steering From Path Imitation To Decision Understanding In Navigation

CompassNav: 从路径模仿到决策理解的导航导航

LinFeng Li, Jian Zhao, Yuan Xie, Xin Tan, Xuelong Li

机构 * East China Normal University(东华师范大学) The Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信) Northwestern Polytechnical University(西北工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出CompassNav方法,通过引入Compass-Data-22k数据集和gap-aware奖励函数,使导航代理能理解而非单纯模仿路径,实现更高效的导航性能。

Journal ref Proceedings of the 14th International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21269 2026-03-24 cs.RO 79%

DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation

DyGeoVLN: 将动态几何基础模型注入视觉-语言导航

Xiangchen Liu, Hanghan Zheng, Jeil Jeong, Minsung Yoon, Lin Zhao, Zhide Zhong, Haoang Li, Sung-Eui Yoon

机构 * KAIST(韩国科学技术院) HKUST(GZ)(香港科技大学(广州)) JD Explore Academy(JD探索学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出DyGeoVLN框架,通过跨分支特征融合将动态几何基础模型注入视觉-语言导航,实现显式3D空间表示和视觉-语义推理,并引入新的无姿态自适应分辨率令牌剪枝策略以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21142 2026-03-24 cs.RO 79%

Dynamic Control Barrier Function Regulation with Vision-Language Models for Safe, Adaptive, and Realtime Visual Navigation

动态控制屏障函数调节与视觉-语言模型用于安全、适应性和实时视觉导航

Jeffrey Chen, Rohan Chandra

机构 * Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出AlphaAdj框架,利用视觉-语言模型动态调整控制屏障函数参数,以实现在动态环境中安全、高效和实时的导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17340 2026-03-24 cs.RO cs.SY eess.SY 79%

AERO-MPPI: Anchor-Guided Ensemble Trajectory Optimization for Agile Mapless Drone Navigation

AERO-MPPI:基于锚点的轨迹优化用于无地图无人机敏捷导航

Xin Chen, Rui Huang, Longbin Tang, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出AERO-MPPI框架,通过GPU加速统一感知与规划,利用多分辨率LiDAR点云提取锚点,构建多项式轨迹引导,提升无人机在复杂环境中的敏捷导航能力。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01192 2026-03-24 cs.RO 79%

Unified Generation-Refinement Planning: Bridging Guided Flow Matching and Sampling-Based MPC for Social Navigation

统一的生成-细化规划:连接引导流匹配与基于模型的预测控制以实现社交导航

Kazuki Mizuta, Karen Leung

机构 * University of Washington(华盛顿大学) NVIDIA(英伟达)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种结合奖励引导条件流匹配与模型预测路径积分的统一生成-细化框架,以提升社交导航中安全、任务性能和计算时间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20366 2026-03-24 cs.IR cs.AI 79%

WebNavigator: Global Web Navigation via Interaction Graph Retrieval

WebNavigator: 通过交互图检索实现全局网络导航

Xuanwang Zhang, Yuteng Han, Jinnan Qi, Mulong Xie, Zhen Wu, Xinyu Dai

机构 * National Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) School of Artificial Intelligence(人工智能学院) Fellou AI

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 WebNavigator通过交互图检索和路径规划解决自主网络导航中的拓扑盲区问题,实现优于企业级代理的性能。

Comments 24 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20351 2026-03-24 cs.CR cs.AI 79%

MANA: Towards Efficient Mobile Ad Detection via Multimodal Agentic UI Navigation

MANA:通过多模态代理UI导航实现高效的移动广告检测

Yizhe Zhao, Yongjian Fu, Zihao Feng, Hao Pan, Yongheng Deng, Yaoxue Zhang, Ju Ren

机构 * Department of Computer Science and Technology(计算机科学与技术系) University of Southern California(南加州大学) Shanghai Jiao Tong University(上海交通大学) State Key Laboratory of Internet Architecture(互联网架构国家重点实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文提出MANA框架,通过整合多种信号实现高效移动广告检测,提升准确率和效率,有效识别隐蔽恶意广告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19782 2026-03-23 cs.AI 79%

Embodied Science: Closing the Discovery Loop with Agentic Embodied AI

具身科学:通过代理具身AI闭合发现循环

Xiang Zhuang, Chenyi Zhou, Kehua Feng, Zhihui Zhu, Yunfan Gao, Yijie Zhong, Yichi Zhang, Junjie Huang, Keyan Ding, Lei Bai, Haofen Wang, Qiang Zhang, Huajun Chen

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tongji University(同济大学)

专题命中 具身导航 :embodied AI(title);embodied agent(abstract);分类 cs.AI

AI总结 本文提出具身科学框架,将科学发现视为闭环过程,结合代理推理与物理执行,通过感知-语言-行动-发现框架实现自主发现系统。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19602 2026-03-23 cs.RO 79%

CeRLP: A Cross-embodiment Robot Local Planning Framework for Visual Navigation

CeRLP:一种面向视觉导航的跨体素机器人局部规划框架

Haoyu Xi, Mingao Tan, Xinming Zhang, Siwei Cheng, Shanze Wang, Yin Gu, Xiaoyu Shen, Wei Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University, Shanghai, P. R. China(上海交通大学计算机科学学院,上海,中华人民共和国) College of Information Science and Technology, Eastern Institute of Technology, Ningbo, P. R. China(信息科学与技术学院,东部技术研究所,宁波,中华人民共和国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出CeRLP框架,通过统一几何表征和异构机器人适应,解决跨体素机器人视觉导航中的尺度模糊和异构问题,实验证明其在障碍物避障和导航任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09111 2026-03-23 cs.CV 79%

Towards Open Environments and Instructions: General Vision-Language Navigation via Fast-Slow Interactive Reasoning

迈向开放环境和指令:通过快速-缓慢交互推理实现通用视觉-语言导航

Yang Li, Aming Wu, Zihao Zhang, Yahong Han

机构 * School of Artificial Intelligence, College of Intelligence and Computing, Tianjin University, China(人工智能学院,智能与计算学院,天津大学,中国) School of Computer Science and Information Engineering, Hefei University of Technology, China(计算机科学与信息工程学院,合肥工业大学,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出慢4快-VLN框架,通过快速-缓慢交互推理提升视觉语言导航的泛化能力,解决传统方法在开放环境中的适应难题。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18443 2026-03-20 cs.CV 79%

SR-Nav: Spatial Relationships Matter for Zero-shot Object Goal Navigation

SR-Nav:空间关系对于零样本物体目标导航至关重要

Leyuan Fang, Zan Mao, Zijing Wang, Yinlong Yan

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 SR-Nav通过建模观察和经验的空间关系,提升感知与规划能力,在HM3D实验中实现最先进的成功率和导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18210 2026-03-20 cs.RO 79%

GoalVLM: VLM-driven Object Goal Navigation for Multi-Agent System

GoalVLM: 多智能体系统中基于视觉语言模型的目标导航

MoniJesu James, Amir Atef Habel, Aleksey Fedoseev, Dzmitry Tsetserokou

机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) Center for Digital Engineering(数字工程中心) Skolkovo Institute of Science and Technology(斯克尔科夫科学与技术研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出GoalVLM,一种基于视觉语言模型的多智能体零样本开放词汇目标导航框架,通过整合SAM3和SpaceOM实现语义优先级探索,无需重新训练即可完成复杂目标导航任务。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01122 2026-03-20 cs.RO 79%

Fast Confidence-Aware Human Prediction via Hardware-accelerated Bayesian Inference for Safe Robot Navigation

通过硬件加速的贝叶斯推理实现快速置信度感知的人类预测以实现安全的机器人导航

Michael Lu, Minh Bui, Xubo Lyu, Mo Chen

机构 * School of Computing Science, Simon Fraser University(西蒙弗雷泽大学计算科学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种基于GPU加速的贝叶斯推理方法,实现高效安全的人类行为预测,支持更精细的轨迹预测,通过实验证明机器人在动态环境中与人类共存的潜力。

Comments Update the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24910 2026-03-19 cs.CV 79%

Learning Goal-Oriented Vision-and-Language Navigation with Self-Improving Demonstrations at Scale

基于大规模自改进演示的目标导向视觉-语言导航学习

Songze Li, Zun Wang, Gengze Zhou, Jialu Li, Xiangyu Zeng, Ziyang Gong, Limin Wang, Yu Qiao, Qi Wu, Mohit Bansal, Yi Wang

机构 * Shanghai AI Laboratory(上海人工智能实验室) UNC Chapel Hill(北卡罗来纳大学教堂山分校) Fudan University(复旦大学) The University of Adelaide(阿德莱德大学) Nanjing University(南京大学) Shanghai Jiaotong University(上海交通大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出SID方法,通过自改进演示提升导航能力,实现高效探索和泛化,显著提升导航性能,达到新状态的SOTA水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17459 2026-03-19 cs.RO 79%

P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation

P$^{3}$Nav: 端到端感知、预测与规划用于视觉-语言导航

Tianfu Li, Wenbo Chen, Haoxuan Xu, Xinhu Zheng, Haoang Li

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 P$^{3}$Nav提出端到端框架,整合感知、预测与规划,提升视觉-语言导航agent的场景理解与导航成功率,实验显示在REVERIE、R2R-CE和RxR-CE基准上取得新状态-of-the-art性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17437 2026-03-19 cs.RO 79%

FloorPlan-VLN: A New Paradigm for Floor Plan Guided Vision-Language Navigation

FloorPlan-VLN: 一种新的基于平面图引导的视觉-语言导航范式

Kehan Chen, Yan Huang, Dong An, Jiawei He, Yifei Su, Jing Liu, Nianfeng Liu, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences and School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院自动化研究所新型模式识别实验室,中国科学院人工智能学院) AMap, Alibaba Group(阿里巴巴集团高德地图) BAAI(北京人工智能研究院) Xiaomi Robotics Lab(小米机器人实验室) FiveAges

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出FloorPlan-VLN范式,利用结构化的语义平面图作为全局空间先验,通过FP-Nav方法实现仅需简洁指令的导航,实验表明其在导航成功率上优于现有方法,验证了平面图引导导航的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17351 2026-03-19 cs.RO 79%

OmniVLN: Omnidirectional 3D Perception and Token-Efficient LLM Reasoning for Visual-Language Navigation across Air and Ground Platforms

OmniVLN:面向空和地面平台的全方位3D感知与高效token LLM推理的视觉语言导航

Zhongyuang Liu, Min He, Shaonan Yu, Xinhang Xu, Muqing Cao, Jianping Li, Jianfei Yang, Lihua Xie

机构 * CertaintyX School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 OmniVLN结合全方位3D感知与高效token分层推理,提升空和地面机器人在复杂环境中的视觉语言导航能力,提升空间指认准确率并减少token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17232 2026-03-19 cs.RO 79%

Full Stack Navigation, Mapping, and Planning for the Lunar Autonomy Challenge

月球自主性挑战的全栈导航、制图与规划

Adam Dai, Asta Wu, Keidai Iiyama, Guillem Casadesus Vila, Kaila Coimbra, Thomas Deng, Grace Gao

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种模块化全栈自主系统,用于月球表面导航与制图,在GNSS拒止和视觉挑战环境下,结合语义分割、立体视觉里程计、位图SLAM与分层规划控制,实现了厘米级定位精度和高保真制图。

Comments Published in the Proceedings of the ION GNSS+ 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02976 2026-03-18 cs.RO 79%

DreamFlow: Local Navigation Beyond Observation via Conditional Flow Matching in the Latent Space

DreamFlow:通过条件流匹配在潜在空间中超越观测的局部导航

Jiwon Park, Dongkyu Lee, I Made Aswin Nahrendra, Jaeyoung Lim, Hyun Myung

机构 * Robotics Program, KAIST(韩国科学技术院机器人学系) School of Electrical Engineering, KAIST(韩国科学技术院电子工程学院) URobotics(URobotics公司) KRAFTON(KRAFTON公司) Dept. of Electrical Engineering and Computer Science, UC Berkeley(伯克利大学电子工程与计算机科学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出DreamFlow框架,通过条件流匹配扩展机器人感知范围,提升局部导航性能,实验显示其在仿真和现实环境中均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06698 2026-03-18 cs.RO 79%

Crowd-FM: Learned Optimal Selection of Conditional Flow Matching-generated Trajectories for Crowd Navigation

Crowd-FM: 基于学习的条件流匹配生成轨迹的最优选择用于人群导航

Antareep Singha, Laksh Nanwani, Mathai Mathew P., Samkit Jain, Phani Teja Singamaneni, Arun Kumar Singh, K. Madhava Krishna

机构 * Robotics Research Center, IIIT Hyderabad, India(IIIT海得拉巴机器人研究中心,印度) Nanyang Technological University, Singapore(新加坡南洋理工大学) University of Tartu, Estonia(爱沙尼亚塔尔图大学) Inria, Université de Lorraine, France(法国里尔大学Inria研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出Crowd-FM方法,通过条件流匹配学习碰撞自由的轨迹生成策略,提升机器人在人群中的安全性和人似性。

Comments Accepted at IEEE ICRA 2026. Authors Antareep Singha and Laksh Nanwani have equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12908 2026-03-17 cs.RO 79%

GoalSwarm: Multi-UAV Semantic Coordination for Open-Vocabulary Object Navigation

GoalSwarm:多无人机语义协调用于开放词汇物体导航

MoniJesu Wonders James, Amir Atef Habel, Aleksey Fedoseev, Dzmitry Tsetserokou

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出GoalSwarm框架,通过轻量语义地图构建、零样本目标检测和去中心化协调策略,实现多无人机在未知环境中的开放词汇物体导航。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14397 2026-03-17 cs.RO 79%

eNavi: Event-based Imitation Policies for Low-Light Indoor Mobile Robot Navigation

eNavi:基于事件的模仿策略用于低光室内移动机器人导航

Prithvi Jai Ramesh, Kaustav Chanda, Krishna Vinod, Joseph Raj Vishal, Yezhou Yang, Bharatesh Chakravarthi

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出eNavi,通过结合RGB和事件数据的多模态策略提升低光环境下机器人导航的鲁棒性,实验显示融合模型在未见低光条件下表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00275 2026-03-17 cs.RO 79%

Pure Inertial Navigation in Challenging Environments with Wheeled and Chassis Mounted Inertial Sensors

在复杂环境中使用轮式和车架安装的惯性传感器实现纯惯性导航

Dusan Nemec, Gal Versano, Itai Savin, Vojtech Simak, Juraj Kekelak, Itzik Klein

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出WiCHINS系统,结合轮式和车架惯性传感器,通过三阶段框架提升纯惯性导航精度,实验表明平均位置误差为11.4米,有效提升复杂环境导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13459 2026-03-17 cs.RO cs.MA 79%

Multi-Robot Navigation in Social Mini-Games: Definitions, Taxonomy, and Algorithms

多机器人在社交迷你游戏中的导航:定义、分类和算法

Rohan Chandra, Shubham Singh, Wenhao Luo, Katia Sycara

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文定义了社交迷你游戏导航问题,提出统一的分类方法,并探讨了现有方法的特性与挑战,为未来研究提供指导。

Comments Accepted for publication in Autonomous Robots 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16686 2026-03-17 cs.RO cs.MA 79%

SERN: Bandwidth-Adaptive Cross-Reality Synchronization for Simulation-Enhanced Robot Navigation

SERN:带宽自适应的跨现实同步用于模拟增强的机器人导航

Jumman Hossain, Emon Dey, Snehalraj Chugh, Masud Ahmed, MS Anwar, Abu-Zaher Faridee, Jason Hoppes, Theron Trout, Anjon Basak, Rafidh Chowdhury, Rishabh Mistry, Hyun Kim, Jade Freeman, Niranjan Suri, Adrienne Raglin, Carl Busart, Anuradha Ravi, Nirmalya Roy

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 SERN通过高保真虚拟双胞胎与物理机器人紧密耦合,实现跨现实同步,提升多机器人在对抗环境中的导航性能,减少延迟并提高可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13833 2026-03-17 cs.RO 79%

ImagiNav: Scalable Embodied Navigation via Generative Visual Prediction and Inverse Dynamics

ImagiNav:通过生成性视觉预测和逆动力学实现可扩展的具身导航

Jie Chen, Yuxin Cai, Yizhuo Wang, Ruofei Bai, Yuhong Cao, Jun Li, Yau Wei Yun, Guillaume Sartoretti

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出ImagiNav框架,通过解耦视觉规划与机器人动作,利用真实世界导航视频实现零样本迁移,无需机器人演示即可实现通用机器人自主导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13313 2026-03-17 cs.RO 79%

MRPoS: Mixed Reality-Based Robot Navigation Interface Using Spatial Pointing and Speech with Large Language Model

基于混合现实的机器人导航接口:结合空间指针与语音及大语言模型

Eduardo Iglesius, Masato Kobayashi, Yuki Uranishi

机构 * The University of Osaka(大阪大学) Kobe University(Kobe大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出MRPoS接口,利用空间指针和语音交互替代传统手势,提升机器人导航的直观性和效率,实验表明任务完成时间与工作负荷显著降低。

详情

展开后加载摘要…

URL PDF HTML 收藏