arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-30 至 2026-03-30 共收录 7 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 7 篇

2603.25981 2026-03-30 cs.RO cs.AI cs.CL 90%

Policy-Guided World Model Planning for Language-Conditioned Visual Navigation

基于策略引导的世界模型规划用于语言条件的视觉导航

Amirhosein Chahe, Lifeng Zhou

机构 * Drexel University(德雷塞尔大学)

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);embodied AI(abstract);分类 cs.RO、cs.AI

AI总结 本文提出PiJEPA框架,结合学习导航策略与潜在世界模型规划,通过微调Octo策略和冻结预训练视觉编码器,提升语言指导下的视觉导航准确性与指令遵循性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21723 2026-03-30 cs.RO cs.MA 84%

Can a Robot Walk the Robotic Dog: Triple-Zero Collaborative Navigation for Heterogeneous Multi-Agent Systems

机器人能否行走:异构多智能体系统的三零协同导航

Yaxuan Wang, Yifan Xiang, Ke Li, Xun Zhang, BoWen Ye, Zhuochen Fan, Fei Wei, Tong Yang

机构 * Yuanpei College, Peking University(北京大学元培学院) School of Computer Science, Peking University(北京大学计算机学院) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) Pengcheng Laboratory(鹏城实验室) Beijing Jinruyi Large Model Technology Co., Ltd.(北京金如意大模型科技有限公司)

专题命中 具身导航 :navigation(title);robotic(title);分类 cs.RO

AI总结 本文提出三零路径规划框架,通过协调者-探索者架构实现无需训练、无需先验知识和无需模拟的异构多机器人系统协作导航,实验显示其在复杂环境中具有鲁棒性和适应性。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26441 2026-03-30 cs.RO 84%

120 Minutes and a Laptop: Minimalist Image-goal Navigation via Unsupervised Exploration and Offline RL

120分钟与一台笔记本:通过无监督探索和离线强化学习实现极简图像目标导航

Xiaoming Liu, Borong Zhang, Qingbiao Li, Steven Morad

机构 * Faculty of Science and Technology, University of Macau(澳门大学科技学院)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出MINav方法,通过无监督数据收集与 hindsight 目标重标记,实现高效图像目标导航,在120分钟内使用消费级笔记本完成训练与部署,无需人工干预。

Comments 8 pages, 8 figures, submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26314 2026-03-30 cs.RO 80%

Line-of-Sight-Constrained Multi-Robot Mapless Navigation via Polygonal Visible Regions

视距约束下的多机器人无图导航:基于多边形可见区域

Ruofei Bai, Shenghai Yuan, Xinhang Xu, Xingyu Ji, Xiaowei Li, Hongliang Guo, Wei-Yun Yau, Lihua Xie

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种基于多边形可见区域的多机器人无图导航方法,通过分布式通信建立视距约束,提升在障碍物密集环境下的连接稳定性与导航效率。

Comments 10 pages, 7 figures. See videos and code: https://github.com/bairuofei/LoS_constrained_navigation

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22498 2026-03-30 cs.RO 70%

HELIOS: Hierarchical Exploration for Language-Grounded Interaction in Open Scenes

HELIOS:面向开放场景的语言引导交互的分层探索

Katrina Ashton, Chahyon Ku, Shrey Shah, Saumit Vedula, Tingrui Zhang, Wen Jiang, Kostas Daniilidis, Bernadette Bucher

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Michigan(密歇根大学)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 HELIOS通过分层场景表示和搜索目标,解决开放环境中语言指令与部分观测场景的语义关联及动态更新问题,实现高仿真实验和现实场景中的语言引导抓取放置任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06909 2026-03-30 cs.CV 57%

Gaussian Mapping for Evolving Scenes

高斯映射用于动态场景

Vladimir Yugay, Thies Kersten, Luca Carlone, Theo Gevers, Martin R. Oswald, Lukas Schmid

机构 * University of Amsterdam(阿姆斯特丹大学) University of Technology Nuremberg(纽伦堡工业大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 本文提出GaME方法,通过动态场景适应机制持续更新3DGS,结合新颖的关键帧管理机制,提升动态场景重建性能,在PSNR和L1深度误差上分别提升29.7%和3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20432 2026-03-30 cond-mat.mtrl-sci 50%

Autonomous epitaxial atomic-layer synthesis via real-time computer vision of electron diffraction

通过实时电子衍射计算机视觉实现自主自组装原子层合成

Haotong Liang, Yunlong Sun, Ryan Paxson, Chih-Yu Lee, Alex T. Hall, Zoey Warecki, John Cumings, Hideomi Koinuma, Aaron Gilad Kusne, Mikk Lippmaa, Ichiro Takeuchi

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过实时计算机视觉实现电子衍射的多维合成参数空间自主导航,显著减少实验次数,用于制备稳定的非稳态功能氧化物相的单相 epitaxial 薄膜。

Comments 30 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏