arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-11 至 2026-03-11 共收录 16 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 16 篇

2603.09961 2026-03-11 cs.RO cs.AI cs.CV 82%

BEACON: Language-Conditioned Navigation Affordance Prediction under Occlusion

BEACON: 语言条件下的遮挡区域导航可行性预测

Xinyu Gao, Gang Chen, Javier Alonso-Mora

机构 * Department of Cognitive Robotics (CoR), Delft University of Technology(认知机器人学系(CoR),代尔夫特理工大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 BEACON通过融合视觉语言模型与深度信息,提升遮挡区域导航可行性预测的准确性。

Comments 8 pages. Project page: https://xin-yu-gao.github.io/beacon

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08173 2026-03-11 cs.RO cs.AI cs.CL cs.CV 82%

NavSpace: How Navigation Agents Follow Spatial Intelligence Instructions

NavSpace: 导航代理如何遵循空间智能指令

Haolin Yang, Yuxing Long, Zhuoyuan Yu, Zihan Yang, Minghan Wang, Jiapeng Xu, Yihan Wang, Ziyan Yu, Wenzhe Cai, Lei Kang, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 NavSpace基准测试通过评估导航代理的空间感知与推理能力,提出SNav模型在指令遵循任务中表现优异,为具身智能研究提供新基准。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09740 2026-03-11 cs.RO cs.CV 81%

Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments

逐步奖励:面向连续环境的视觉语言导航中的步骤感知对比对齐

Haoyuan Li, Rui Liu, Hehe Fan, Yi Yang

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院,杭州,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出SACA框架,通过步骤感知对比对齐提升连续环境中视觉语言导航的性能,解决传统方法在错误恢复和训练稳定性方面的不足。

Comments 28 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09259 2026-03-11 cs.CV cs.RO 81%

Implicit Geometry Representations for Vision-and-Language Navigation from Web Videos

从网络视频中隐式几何表示的视觉-语言导航

Mingfei Han, Haihong Hao, Liang Ma, Kamila Zhumakhanova, Ekaterina Radionova, Jingyi Zhang, Xiaojun Chang, Xiaodan Liang, Ivan Laptev

机构 * Department of Computer Vision, Mohamed Bin Zayed University of Artificial Intelligence(计算机视觉系,Mohamed Bin Zayed人工智能大学) School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) Shenzhen Campus of Sun Yat-Sen University(中山大学深圳校区)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本研究提出基于网络视频的隐式几何表示方法,用于视觉-语言导航,通过提升数据利用率和鲁棒性,实现更广泛的应用。

Comments Extension of CVPR 2025 RoomTour3D with implicit geometric representations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09113 2026-03-11 cs.RO cs.AI 81%

PM-Nav: Priori-Map Guided Embodied Navigation in Functional Buildings

PM-Nav:基于先验图的功能性建筑中具身导航

Jiang Gao, Xiangyu Dong, Haozhou Li, Haoran Zhao, Yaoming Zhou, Xiaoguang Ma

机构 * Faculty of Robot Science and Engineering at Northeastern University(东北大学机器人科学与工程学院) Foshan Graduate School of Innovation at Northeastern University(东北大学佛山创新研究生学院) School of Aeronautic Science and Engineering at Beihang University(北航航空科学与工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 PM-Nav通过构建先验图和多模型协作机制,提升了功能性建筑中的导航精度和效率。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09460 2026-03-11 cs.RO 79%

SEA-Nav: Efficient Policy Learning for Safe and Agile Quadruped Navigation in Cluttered Environments

SEA-Nav: 高效安全敏捷四足机器人在密集环境中导航的策略学习

Shiyi Chen, Mingye Yang, Haiyan Mao, Jiaqi Zhang, Haiyi Liu, Shuheng He, Debing Zhang, Zihao Qiu, Chun Zhang

机构 * Tsinghua University(清华大学) Imperial College London(伦敦帝国理工学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 SEA-Nav通过安全、高效和敏捷的强化学习框架,实现了在密集环境中四足机器人导航的高效训练,仅需分钟级训练时间。

Comments Project website: https://11chens.github.io/sea-nav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09163 2026-03-11 cs.RO 79%

SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation

SPAN-Nav: 通用空间感知用于多功能视觉-语言导航

Jiahang Liu, Tianyu Xu, Jiawei Chen, Lu Yue, Jiazhao Zhang, Zhiyong Wang, Minghan Li, Qisheng Zhao, Anqi Li, Qi Su, Zhizheng Zhang, He Wang

机构 * Peking University(北京大学) Galbot BAAI(北京人工智能研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 SPAN-Nav通过端到端模型和空间感知机制,在复杂环境中实现高效的视觉-语言导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09031 2026-03-11 cs.RO 79%

ImpedanceDiffusion: Diffusion-Based Global Path Planning for UAV Swarm Navigation with Generative Impedance Control

阻抗扩散:基于扩散的全局路径规划用于无人机群导航的生成阻抗控制

Faryal Batool, Yasheerah Yaqoot, Muhammad Ahsan Mustafa, Roohan Ahmed Khan, Aleksey Fedoseev, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(智能空间机器人实验室,数字工程中心,斯克尔科夫科学与技术研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 ImpedanceDiffusion通过结合扩散模型和人工势场跟踪,实现无人机群在复杂环境中的可靠路径规划与自适应阻抗控制。

Comments This is paper is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08905 2026-03-11 cs.RO 79%

Proprioceptive Safe Active Navigation and Exploration for Planetary Environments

本体感知安全主动导航与探索用于行星环境

Matthew Y. Jiang, Feifei Qian, Shipeng Liu

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 PSANE通过本体感知技术在未知变形环境中实现安全导航与探索,利用腿部与地形的交互信息提升地形可通行性评估与导航性能。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08837 2026-03-11 cs.HC 78%

NaviNote: Enabling In-situ Spatial Annotation Authoring to Support Exploration and Navigation for Blind and Low Vision People

NaviNote: 使现场空间标注创作成为支持盲人和低视力人群探索与导航的手段

Ruijia Chen, Yuheng Wu, Charlie Houseago, Filipe Gaspar, Filippo Aleotti, Dorian Gálvez-López, Oliver Johnston, Diego Mazala, Guillermo Garcia-Hernando, Maryam Bandukda, Gabriel Brostow, Jessica Van Brummelen

专题命中 具身导航 :navigation(title,abstract)

AI总结 NaviNote通过结合高精度视觉定位与代理架构,为盲人和低视力人群提供语音驱动的注释创作与导航支持,显著提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13338 2026-03-11 cs.RO cs.CV cs.LG 76%

CuriousBot: Interactive Mobile Exploration via Actionable 3D Relational Object Graph

CuriousBot: 通过可操作的3D关系物体图进行交互式移动探索

Yixuan Wang, Leonor Fermoselle, Tarik Kelestemur, Jiuguang Wang, Yunzhu Li

机构 * School of Engineering and Applied Science, Columbia University(工程与应用科学学院,哥伦比亚大学) Robotics and AI Institute(机器人与人工智能研究所)

专题命中 具身导航 :robotics(abstract,comments);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 CuriousBot通过可操作的3D关系物体图实现交互式移动探索,优于仅依赖视觉-语言模型的方法。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L). Project Page: https://curiousbot.theaiinstitute.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10778 2026-03-11 cs.RO 70%

Asset-Centric Metric-Semantic Maps of Indoor Environments

以资产为中心的度量-语义地图:室内环境

Christopher D. Hsu, Pratik Chaudhari

机构 * Department of Electrical & Systems Engineering and General Robotics, Automation, Sensing and Perception (GRASP) Laboratory at the University of Pennsylvania(宾夕法尼亚大学电气与系统工程系及通用机器人、自动化、传感与感知(GRASP)实验室) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出了一种以资产为中心的度量-语义地图方法,利用四足机器人和RGB-D数据构建室内环境的高精度表示,结合自然语言和网格信息,提升机器人场景理解和导航能力。

Comments 9 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09745 2026-03-11 cs.RO 57%

Caterpillar-Inspired Spring-Based Compressive Continuum Robot for Bristle-based Exploration

基于 caterpillar 的弹簧式压缩连续机器人用于 bristle 基探索

Zhixian Hu, Yu She, Juan Wachs

机构 * Edwardson School of Industrial Engineering, Purdue University(工业工程学院,普渡大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于 caterpillar 的弹簧式压缩连续机器人,用于受限空间探索,结合腱驱动和接触传感器实现高效表面感知与检查。

Comments Accepted by RoboSoft 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09147 2026-03-11 cs.RO 57%

Walking on Rough Terrain with Any Number of Legs

在粗糙地形上使用任意数量的腿行走

Zhuoyang Chen, Xinyuan Wang, Shai Revzen

机构 * University of Michigan(密歇根大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种适用于多腿机器人在粗糙地形上行走的控制架构,结合了事件级联控制器与CPG控制器的特点,适用于多腿机器人。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09918 2026-03-11 eess.SY cs.SY 50%

Emergency Locator Transmitters in the Era of More Electric Aircraft: A Comprehensive Review of Energy, Integration and Safety Challenges

在更多电动飞机时代的紧急定位发射机:能量、集成与安全挑战的全面综述

Juana M. Martínez-Heredia, Adrián Portos, Marcel Štěpánek, Francisco Colodro

专题命中 具身导航 :navigation(abstract)

AI总结 本文综述了在更多电动飞机时代,紧急定位发射机在能量、集成和安全挑战方面的全面研究,探讨了其技术发展、关键里程碑及未来发展方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24427 2026-03-11 cs.CL 50%

SynthWorlds: Controlled Parallel Worlds for Disentangling Reasoning and Knowledge in Language Models

SynthWorlds: 用于语言模型中推理与知识分离的受控并行世界

Ken Gu, Advait Bhat, Mike A Merrill, Robert West, Xin Liu, Daniel McDuff, Tim Althoff

机构 * University of Washington(华盛顿大学) Stanford University(斯坦福大学) EPFL(苏黎世联邦理工学院) Google Research(谷歌研究)

专题命中 具身导航 :navigation(abstract)

AI总结 SynthWorlds通过构建两个结构相同的并行世界,分离语言模型的推理与知识能力,揭示了模型在仅依赖参数化知识和知识增强设置下的性能差异。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏