arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 13974 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 13974 篇

2606.09268 2026-06-09 cs.RO 新提交 83%

VGP-Nav: Metric-Aware Visual Geometric Perception for Robot Navigation

VGP-Nav:用于机器人导航的度量感知视觉几何感知

Hewei Pan, Weiye Zhu, Zekai Zhang, Zitong Huang, Rongtao Xu, Jinbao Wang, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) Shenzhen University(深圳大学) SpatialTemporal AI(时空人工智能)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出VGP-Nav,一种仅依赖单目RGB输入的框架,通过地面平面几何约束解决尺度模糊,实现度量定位与障碍物感知的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07496 2026-06-08 cs.RO 版本更新 83%

PathPainter: Transferring the Generalization Ability of Image Generation Models to Embodied Navigation

PathPainter:将图像生成模型的泛化能力迁移至具身导航

Yijin Wang, Yuru Tian, Xijie Huang, Weiqi Gai, Mo Zhu, Xin Zhou, Yuze Wu, Fei Gao

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出利用鸟瞰图作为全局先验的导航系统,通过图像生成模型理解自然语言意图并生成可通行掩码,结合跨视图定位消除里程计漂移,在无人机平台上完成160米室外长距离导航。

Comments Work in the progress. 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06147 2026-06-05 cs.AI 83%

WorldFly: A World-Model-Based Vision-Language-Action Model for UAV Navigation

WorldFly: 基于世界模型的视觉-语言-动作模型用于无人机导航

Shengtao Zheng, Kai Li, Weichen Zhang, Yu Meng, Chen Gao, Xinlei Chen, Yong Li, Xiao-Ping Zhang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) BNRist, Tsinghua University(清华大学北京研究院)

专题命中 具身导航 :navigation(title,abstract);world model(abstract);分类 cs.AI

AI总结 提出WorldFly框架,通过双分支耦合流匹配机制联合生成未来视频预测和导航动作,解决城市峡谷中严重遮挡和视角剧变下的无人机导航问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04534 2026-06-04 cs.RO 83%

MAD: Mapping-Aware World Models for Agile Quadrotor Flight

MAD: 面向敏捷四旋翼飞行的地图感知世界模型

Xinhong Zhang, Runqing Wang, Yunfan Ren, Ding Yu, Boyu Zhou, Jian Sun, Fang Deng, Jie Chen, Gang Wang

机构 * State Key Lab of Autonomous Intelligent Unmanned Systems, Beijing Institute of Technology, Beijing 100081, China(自主智能无人系统国家重点实验室,北京理工大学,北京100081,中国) Zhongguancun Academy, Beijing 100094, China(中关村学院,北京100094,中国) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Department of Mechanical and Energy Engineering, Southern University of Science and Technology(南方科技大学机械与能源工程系) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 具身导航 :world model(title,abstract);navigation(abstract);分类 cs.RO

AI总结 提出地图感知世界模型MAD,通过重构机器人中心占用和可见性网格地图学习几何感知的潜在动力学,在视觉导航和竞速任务中实现更高成功率、更快飞行速度和更好跨任务迁移。

Comments 12 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.02531 2026-06-04 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 83%

Combining Optimal Control and Learning for Visual Navigation in Novel Environments

将最优控制与学习相结合用于新环境中的视觉导航

Somil Bansal, Varun Tolani, Saurabh Gupta, Jitendra Malik, Claire Tomlin

机构 * University of California, Berkeley(加州大学伯克利分校) Facebook AI Research(脸书人工智能研究)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出了一种结合模型控制与学习感知的方法,用于在新环境中实现可靠的视觉导航,通过生成无碰撞路径的 waypoints,使机器人能够高效地到达目标位置,同时在低帧率和仿真到现实的迁移中表现良好。

Comments Project website: https://vtolani95.github.io/WayPtNav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03421 2026-06-03 cs.RO 83%

Reliability-Guided Depth Fusion for Glare-Resilient Navigation Costmaps

基于可靠性引导的深度融合用于抗眩光导航代价地图

Shang-En Tsai

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对反光地面、玻璃边界等表面导致的深度测量噪声,提出基于显式深度可靠性建模的代价地图构建方法,通过DRM-Net预测像素级可靠性并采用加权门控融合机制抑制错误占据更新,实验证明能有效减少虚假障碍并保持实时性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20623 2026-06-03 cs.RO 83%

Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation

潜在激活编辑:基于推理时策略精炼的安全多机器人导航

Satyajeet Das, Darren Chiu, Zhehui Huang, Lars Lindemann, Gaurav S. Sukhatme

机构 * Department of Computer Science, University of Southern California(南加州大学计算机科学系) Automatic Control Laboratory, ETH Zürich(苏黎世联邦理工学院自动控制实验室)

专题命中 具身导航 :navigation(title,abstract);world model(abstract);分类 cs.RO

AI总结 提出潜在激活编辑(LAE)框架,通过在推理时在线检测并编辑中间激活,在不修改权重或架构的情况下降低预训练策略的碰撞率,在四旋翼导航中实现近90%的碰撞减少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01848 2026-06-02 cs.CV 83%

RescueBench: Can Embodied Agents Save Lives in the Wild ?

RescueBench: 具身智能体能否在野外拯救生命?

Kui Wu, Beiyu Guo, Hao Chen, ShuHang Xu, Yuling Li, Yongdan Zeng, Zhoujun Li, Yizhou Wang, Fangwei Zhong

机构 * Beihang University(北京航空航天大学) Beijing Normal University(北京师范大学) Peking University(北京大学) City University of Macau(澳门城市大学) ATEC2025 Challenge Committee(ATEC2025挑战委员会)

专题命中 具身导航 :embodied agent(title,abstract);navigation(abstract);分类 cs.CV

AI总结 本文提出 RescueBench,一个四阶段流水线的逼真诊断基准,用于评估具身智能体在搜索与救援任务中的探索、记忆和交互能力,并揭示探索和记忆失败如何传播。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01788 2026-06-02 cs.CV 83%

PlatonicNav: Unveiling Semantic Correspondence in Navigation with Platonic Topological Maps

PlatonicNav: 在导航中揭示柏拉图式拓扑地图的语义对应

Junlin Long, Zeyu Zhang, Xu Deng, Yiran Wang, Yue Yang, Luke Borgnolo, Maxwell Twelftree, Yang Zhao

机构 * USYD(新南威尔士大学) Maincode UNSW(新南威尔士大学) La Trobe(拉特罗布大学)

专题命中 具身导航 :navigation(title,abstract);robotics(abstract);分类 cs.CV

AI总结 提出PlatonicNav框架,通过自监督视觉编码器构建柏拉图式拓扑地图,无需跨模态训练即可统一视觉目标导航、跨模态目标导航和视觉语言导航任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22965 2026-06-02 cs.RO 83%

Self-Imitated Diffusion Policy for Efficient and Robust Visual Navigation

自模仿扩散策略用于高效鲁棒的视觉导航

Runhua Zhang, Junyi Hou, Changxu Cheng, Qiyi Chen, Tao Wang, Wuyue Zhao

机构 * Uni-Ubi Technology Co., Ltd.(Uni-Ubi技术有限公司) College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出自模仿扩散策略(SIDP),通过奖励引导的自模仿机制和课程学习范式,减少对大量采样和后过滤的依赖,实现高效鲁棒的视觉导航。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31404 2026-06-01 cs.CL cs.AI 83%

The Sword, Shield, and Achilles' Heel: Characterizing the Linguistic Inductive Bias of Large Language Models for Spatial Reasoning in Navigation Planning

剑、盾与阿喀琉斯之踵:大型语言模型在导航规划中空间推理的语言归纳偏置特征化

Xudong Zhang, Jian Yang, Shengkai Wang, Jiangpeng Tian, Shaowen Chen, Xian Wei, Ke Li, Xiong You

机构 * East China Normal University(东华大学) Information Engineering University(信息工程大学) Zhengzhou University(郑州大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 提出双干预框架,通过表示干预和上下文干预分离语言结构与上下文线索,揭示LLM在导航规划中语言归纳偏置的规律:拓扑信息是稳健规划的支柱,语言格式是双刃剑,语义信息是致命弱点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25109 2026-05-26 cs.RO 83%

Soft Pneumatic Actuators for Soft Robotics: A Motion-Based Review of Actuation Mechanisms and Performance Trade-offs

软体机器人中的软体气动执行器:基于运动的驱动机制与性能权衡综述

Mohammed Abboodi

专题命中 具身导航 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文基于运动类型(直线、弯曲、扭转、全向)分类综述软体气动执行器的设计策略,分析结构特征对运动输出、力产生、空气需求等性能的影响,并讨论选择与比较时的关键条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24044 2026-05-26 cs.RO cs.SE cs.SY eess.SY 83%

RED: Adaptive Real-Time DAG Scheduling for Robotic Inference under Environmental Dynamics

RED:面向环境动态的自适应实时DAG调度用于机器人推理

Zexin Li, Tao Ren, Johnathan Liu, Xiaoxi He, Cong Liu

机构 * University of California, Riverside(加州大学河滨分校) University of Pittsburgh(匹兹堡大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校) University of Macau(澳门大学)

专题命中 具身导航 :robotic(title,abstract);navigation(abstract);分类 cs.RO

AI总结 提出RED框架,通过截止时间感知调度器和MIMONet结构对齐,在资源受限机器人平台上实现多任务深度神经网络工作负载的实时调度,适应环境动态并保证端到端时序约束。

Comments Extension version of RTSS'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20917 2026-05-21 cs.RO 83%

SubTGraph: Large-Scale Subterranean Environment Synthesis with Controllable Topological Variability for Robotic Autonomy Validation

SubTGraph: 大规模地下环境合成与可控拓扑变化用于机器人自主性验证

F. Labra Caso, A. Saradagi, S. Fredriksson, S. Nordström, A. Koval, G. Nikolakopoulos

机构 * Robotics & AI Luleå University of Technology(机器人与人工智能卢勒奥技术大学)

专题命中 具身导航 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出SubTGraph框架,用于快速合成具有高变异性的多层级地下环境,通过用户指定的拓扑、维度、纹理等参数生成不同类型的地下环境,用于验证机器人自主栈各层的严格验证。

Comments 16 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19600 2026-05-20 cs.RO 83%

FlyMirage: A Fully Automated Generation Pipeline for Diverse and Scalable UAV Flight Data via Generative World Model

FlyMirage: 一种用于生成多样化和可扩展的无人机飞行数据的完全自动化生成流程

Jinhan Li, Xijie Huang, Zhaoqi Wang, Yijin Wang, Weiqi Ge, Qiyi He, Mo Zhu, Fei Gao, Yuze Wu, Xin Zhou

机构 * State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室,杭州310027,中国) Differential Robotics, Hangzhou 311121, China(差分机器人,杭州311121,中国)

专题命中 具身导航 :world model(title,abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出FlyMirage,一种完全自动化的生成流程,通过生成世界模型生成大规模、多样化且逼真的无人机视觉-语言导航数据,支持下一代具身导航模型的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19206 2026-05-20 cs.RO 83%

CLUE: Adaptively Prioritized Contextual Cues by Leveraging a Unified Semantic Map for Effective Zero-Shot Object-Goal Navigation

CLUE: 通过利用统一语义地图实现适应性优先级上下文线索

Taeyun Kim, Alvin Jinsung Choi, Dasol Hong, Hyun Myung

机构 * School of Electrical Engineering, KAIST(韩国科学技术院电子工程学院)

专题命中 具身导航 :navigation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 CLUE通过利用统一语义地图,采用适应性优先级上下文线索的方法,有效解决零样本物体-目标导航问题,提高了导航的鲁棒性和效率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21363 2026-05-19 cs.RO 83%

A Deployable Embodied Vision-Language Navigation System with Hierarchical Cognition and Context-Aware Exploration

可部署的具身视觉-语言导航系统:具有层次认知和上下文感知探索

Kuan Xu, Ruimeng Liu, Yizhuo Yang, Denan Liang, Tongxing Jin, Shenghai Yuan, Chen Wang, Lihua Xie

机构 * Center for Advanced Robotics Technology Innovation (CARTIN), School of Electrical and Electronic Engineering, Nanyang Technological University(先进机器人技术与创新中心(CARTIN)、电子工程学院、南洋理工大学) Spatial AI & Robotics Lab, Department of Computer Science and Engineering(空间人工智能与机器人实验室、计算机科学与工程系)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种可部署的具身视觉-语言导航系统,通过分层认知和上下文感知探索,在真实机器人上实现高效导航与强推理能力。

Comments 10 pages, 5 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09423 2026-05-14 cs.AI 83%

SimWorld Studio: Automatic Environment Generation with Evolving Coding Agent for Embodied Agent Learning

SimWorld Studio:基于进化编码代理的自动环境生成用于具身学习

Haoqiang Kang, Xiaokang Ye, Yuhan Liu, Siddhant Hitesh Mantri, Lingjun Mao, James Fleming, Drishti Regmi, Lianhui Qin

机构 * UC San Diego(加州大学圣迭戈分校) New York University(纽约大学)

专题命中 具身导航 :embodied agent(title,abstract);navigation(abstract);分类 cs.AI

AI总结 本文提出SimWorld Studio平台,通过进化编码代理生成动态3D环境,提升具身学习性能。环境生成与学习相互促进,使代理在未见基准上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10118 2026-05-12 cs.RO 83%

Plan in Sandbox, Navigate in Open Worlds: Learning Physics-Grounded Abstracted Experience for Embodied Navigation

沙盒计划,开放世界导航:学习物理基础的抽象经验以实现具身导航

Zhixuan Shen, Jiawei Du, Ziyu Guo, Han Luo, Lilan Peng, Joey Tianyi Zhou, Haonan Luo, Tianrui Li

机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University, China(计算机与人工智能学院,西南交通大学,中国) Centre for Frontier AI Research A*STAR, Singapore(前沿人工智能研究A*STAR中心,新加坡) School of Computer Science, University of Leeds, UK(计算机科学学院,利兹大学,英国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出SAGE框架,通过物理基础的语义抽象学习,提升具身导航性能,在A-EQA任务中取得53.21%的成功率,且在物理室内机器人部署中表现良好。

Comments 28 pages, 15 figures, Extended Version of accepted ICML 2026 Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13451 2026-05-12 cs.RO 83%

MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation

MapNav: 一种通过标注语义地图的新型记忆表示方法用于视觉-语言导航

Lingfeng Zhang, Xiaoshuai Hao, Qinwen Xu, Qiang Zhang, Xinyao Zhang, Pengwei Wang, Jing Zhang, Zhongyuan Wang, Shanghang Zhang, Renjing Xu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tsinghua University(清华大学) Beijing Innovation Center of Humanoid Robotics Co., Ltd.(北京人形机器人创新中心有限公司) School of Computer Science, Wuhan University(武汉大学计算机学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室,计算机学院)

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO

AI总结 本文提出MapNav,通过标注语义地图替代传统历史帧,提升视觉-语言导航任务的性能,实验表明其在模拟和现实环境中均达到SOTA水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27620 2026-05-01 cs.CV 83%

SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation

SpaAct:基于课程适应的空间激活转换学习用于视觉语言导航

Pengna Li, Kangyi Wu, Shaoqing Xu, Fang Li, Hanbing Li, Lin Zhao, Kailin Lyu, Long Chen, Zhi-Xin Yang, Nanning Zheng

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) National Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) The State Key Laboratory of Internet of Things for Smart City(智能城市物联网国家重点实验室) Centre for Artificial Intelligence and Robotics(人工智能与机器人中心) University of Macau(澳门大学) Xiaomi EV(小i EV) School of Automation(自动化学院) Beijing Institute of Technology(北京理工大学) Institute of Automation(自动化研究所) Chinese Academy of Sciences(中国科学院)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.CV

AI总结 SpaAct通过引入空间激活任务和课程适应方法,提升视觉语言导航中动态空间感知能力,实现更高效的导航性能。

Comments Submmited to ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25161 2026-04-29 cs.MA cs.AI 83%

Where Did It Go Wrong? Capability-Oriented Failure Attribution for Vision-and-Language Navigation Agents

哪里出错了?面向视觉-语言导航代理的能力导向故障归因

Jianming Chen, Yawen Wang, Junjie Wang, Xiaofei Xie, Shoubin Li, Qing Wang, Fanjiang Xu

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Science & Technology on Integrated Information System Laboratory(信息集成信息系统实验室) State Key Laboratory of Complex System Modeling and Simulation Technology(复杂系统建模与仿真技术国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Singapore Management University(新加坡管理大学)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.AI

AI总结 本文提出一种能力导向的测试方法,通过自适应测试用例生成、能力 oracle 和反馈机制,准确归因视觉-语言导航代理的故障原因,提升系统可解释性和改进效果。

Journal ref ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22093 2026-04-27 cs.CV eess.IV 83%

FLARE-BO: Fused Luminance and Adaptive Retinex Enhancement via Bayesian Optimisation for Low-Light Robotic Vision

FLARE-BO:通过贝叶斯优化融合亮度和自适应Retinex增强的低光照机器人视觉

Nathan Shankar, Pawel Ladosz, Hujun Yin

机构 * University of Manchester(曼彻斯特大学)

专题命中 具身导航 :robotic(title,abstract);navigation(abstract);分类 cs.CV

AI总结 本文提出FLARE-BO框架,通过贝叶斯优化联合优化八个参数,提升低光照条件下机器人视觉的图像质量与鲁棒性。

Comments 7 pages, 2 tables and 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19830 2026-04-21 cs.RO 83%

Real-Time Structural Detection for Indoor Navigation from 3D LiDAR Using Bird's-Eye-View Images

基于3D激光雷达的实时室内导航鸟瞰图像结构检测

Guanliang Li, Pedro Espinosa-Angulo, David Perez-Saura, Santiago Tapia-Fernandez

机构 * Universidad Politécnica de Madrid(马德里理工大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种轻量实时框架,通过将3D激光雷达数据投影到2D鸟瞰图像中,实现高效结构检测,采用几何方法和YOLO-OBB深度学习检测器,结合时空融合模块提升稳定性,实验证明YOLO-OBB在资源受限平台上的高效鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16384 2026-04-21 cs.RO cs.CY 83%

RHINO-AR: An Augmented Reality Exhibit for Teaching Mobile Robotics Concepts in Museums

RHINO-AR:一种用于博物馆中教学移动机器人概念的增强现实展览

Nils Dengler, Tim Graf, Leif Van Holland, Patrick Stotko, Reinhard Klein, Maren Bennewitz

机构 * Humanoid Robots Lab, University of Bonn, Germany(波恩大学人形机器人实验室,德国)

专题命中 具身导航 :robotics(title,abstract);navigation(abstract);分类 cs.RO

AI总结 RHINO-AR通过将虚拟重建的机器人置于真实博物馆空间,解决了VR展览与现实环境分离的问题,提升了非专业观众对移动机器人导航概念的理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16445 2026-04-16 cs.RO 83%

FiLM-Nav: Efficient and Generalizable Navigation via VLM Fine-tuning

FiLM-Nav:通过VLM微调实现高效且通用的导航

Naoki Yokoyama, Sehoon Ha

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出FiLM-Nav,通过微调预训练VLM作为导航策略,直接利用视觉轨迹历史和导航目标进行探索决策,实现复杂环境中的高效导航与物体定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12753 2026-04-15 cs.RO 83%

Reliability-Guided Depth Fusion for Glare-Resilient Navigation Costmaps

可靠性引导的深度融合用于抗眩光导航成本图

Shang-En Tsai, Wei-Cheng Sun

机构 * Intel(英特尔)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出基于显式深度可靠性建模的抗眩光成本图构建方法,通过轻量级深度可靠性地图估计器和可靠性引导融合机制,减少眩光导致的假障碍物插入,提升自由空间保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12486 2026-04-15 cs.RO 83%

DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation

DeCoNav:基于对话的长时程协作视觉语言导航

Sunyao Zhou, Yunzi Wu, Tianhang Wang, Xinhai Li, Guang Chen, Lizheng Liu, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI)(人工智能研究院(TeleAI)) China Telecom Fudan University(中国电信复旦大学) Tongji University(同济大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 DeCoNav通过事件触发对话与动态任务分配实现多机器人协作,提升了多机器人系统的长时程协作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11861 2026-04-15 cs.RO cs.MA 83%

BIND-USBL: Bounding IMU Navigation Drift using USBL in Heterogeneous ASV-AUV Teams

BIND-USBL: 利用USBL限制IMU导航漂移在异构ASV-AUV团队中

Pranav Kedia, Rajini Makam, Heiko Hamann, Suresh Sundaram

机构 * Dept of Computer and Information Science, University of Konstanz, Germany(计算机与信息科学系,康斯坦茨大学,德国) Centre for the Advanced Study of Collective Behaviour, University of Konstanz, Germany(集体行为高级研究中心,康斯坦茨大学,德国) Dept of Aerospace Engineering, Indian Institute of Science, Bangalore, India(航空航天工程系,印度科学研究院,班加罗尔,印度)

专题命中 具身导航 :navigation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出BIND-USBL框架,通过异构ASV-AUV团队的USBL定位系统限制AUV的IMU导航漂移,通过多ASV编队模型、冲突图基TDMA调度器和延迟融合技术提升定位性能。

Comments Accepted at OCEANS 2026, Sanya, China

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08780 2026-04-09 cs.RO 83%

STERN: Simultaneous Trajectory Estimation and Relative Navigation for Autonomous Underwater Proximity Operations

STERN: 自主水下近距操作中的轨迹估计与相对导航

Aldo Terán Espinoza, Antonio Terán Espinoza, John Folkesson, Clemens Deutsch, Niklas Rolleberg, Peter Sigray, Jakob Kuttenkeuler

机构 * Centre for Naval Architecture, KTH Royal Institute of Technology(KTH皇家理工学院海军建筑中心) Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(KTH皇家理工学院机器人、感知与学习系)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出STERN方法,通过因子图模型实现自主水下车辆的近距操作中的轨迹估计与相对导航,通过模拟和真实数据验证了方法的灵活性和动态假设的限制。

Comments v2 updated after revision. Article contains 24 pages and 18 figures. Published in the IEEE Journal of Oceanic Engineering, available at: https://doi.org/10.1109/JOE.2025.3624470

Journal ref IEEE Journal of Oceanic Engineering, vol. 51, no. 1, pp. 293-316, Jan. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏