arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-18 至 2026-03-18 共收录 17 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 17 篇

2511.10376 2026-03-18 cs.CV cs.RO 84%

MSGNav: Unleashing the Power of Multi-modal 3D Scene Graph for Zero-Shot Embodied Navigation

MSGNav: 释放多模态3D场景图在零样本具身导航中的潜力

Xun Huang, Shijia Zhao, Yunxiang Wang, Xin Lu, Wanfa Zhang, Rongsheng Qu, Weixin Li, Yunhong Wang, Chenglu Wen

机构 * Fujian Key Laboratory of Urban Intelligent Sensing and Computing(福建智能感知与计算重点实验室) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China(多媒体可信感知与高效计算重点实验室) Beihang University(北航) Nanyang Technological University(南洋理工大学) University of Chinese Academy of Sciences(中国科学院大学) Zhongguancun Academy(中关村学院)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 MSGNav通过多模态3D场景图实现零样本具身导航,引入关键子图选择模块、自适应词汇更新模块和闭环推理模块,解决开放词汇和视觉证据保留问题,实验表明其在GOAT-Bench和HM3D-ObjNav基准上表现优异。

Comments 18 pages, Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18546 2026-03-18 cs.RO cs.AI 84%

EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval

EfficientNav: 面向设备端目标物体导航的导航地图缓存与检索

Zebin Yang, Sunjian Zheng, Tong Xie, Tianshi Xu, Bo Yu, Fan Wang, Jie Tang, Shaoshan Liu, Meng Li

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Integrated Circuits, Peking University(北京大学集成电路学院) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人研究院) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进制造创新中心)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.RO、cs.AI

AI总结 本文提出EfficientNav,通过语义感知记忆检索和离散记忆缓存技术,在设备端实现零样本目标物体导航,提升成功率并降低规划延迟。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15624 2026-03-18 cs.CV cs.AI cs.RO 82%

Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision

探索视觉语言模型在帮助视障和低视力人士导航中的应用

Yu Li, Yuchen Zheng, Giles Hamilton-Fletcher, Marco Mezzavilla, Yao Wang, Sundeep Rangan, Maurizio Porfiri, Zhou Yu, John-Ross Rizzo

机构 * Columbia University(哥伦比亚大学) New York University(纽约大学) Politecnico di Milano(米兰理工大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文评估了多种VLMs在基础视觉技能和导航任务中的表现,发现GPT-4o在空间推理和场景理解上表现最佳,而开源模型在复杂环境中存在不足,需进一步改进以提升实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16166 2026-03-18 cs.RO cs.CV 81%

SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments

SignNav:利用标识信息在大规模室内环境中实现语义视觉导航

Jian Sun, Yuming Huang, He Li, Shuqi Xiao, Shenyan Guo, Maani Ghaffari, Qingbiao Li, Chengzhong Xu, Hui Kong

机构 * Faculty of Science and Technology, University of Macau(澳门大学科技学院) Department of Robotics, University of Michigan(密歇根大学机器人系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出SignNav任务,通过解读标识信息进行语义导航,构建LSI-Dataset并提出START模型,实现端到端决策,达到80%的成功率和0.74 NDTW。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02976 2026-03-18 cs.RO 79%

DreamFlow: Local Navigation Beyond Observation via Conditional Flow Matching in the Latent Space

DreamFlow:通过条件流匹配在潜在空间中超越观测的局部导航

Jiwon Park, Dongkyu Lee, I Made Aswin Nahrendra, Jaeyoung Lim, Hyun Myung

机构 * Robotics Program, KAIST(韩国科学技术院机器人学系) School of Electrical Engineering, KAIST(韩国科学技术院电子工程学院) URobotics(URobotics公司) KRAFTON(KRAFTON公司) Dept. of Electrical Engineering and Computer Science, UC Berkeley(伯克利大学电子工程与计算机科学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出DreamFlow框架,通过条件流匹配扩展机器人感知范围,提升局部导航性能,实验显示其在仿真和现实环境中均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06698 2026-03-18 cs.RO 79%

Crowd-FM: Learned Optimal Selection of Conditional Flow Matching-generated Trajectories for Crowd Navigation

Crowd-FM: 基于学习的条件流匹配生成轨迹的最优选择用于人群导航

Antareep Singha, Laksh Nanwani, Mathai Mathew P., Samkit Jain, Phani Teja Singamaneni, Arun Kumar Singh, K. Madhava Krishna

机构 * Robotics Research Center, IIIT Hyderabad, India(IIIT海得拉巴机器人研究中心,印度) Nanyang Technological University, Singapore(新加坡南洋理工大学) University of Tartu, Estonia(爱沙尼亚塔尔图大学) Inria, Université de Lorraine, France(法国里尔大学Inria研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出Crowd-FM方法,通过条件流匹配学习碰撞自由的轨迹生成策略,提升机器人在人群中的安全性和人似性。

Comments Accepted at IEEE ICRA 2026. Authors Antareep Singha and Laksh Nanwani have equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16685 2026-03-18 cs.RO cs.CV 73%

vAccSOL: Efficient and Transparent AI Vision Offloading for Mobile Robots

vAccSOL:面向移动机器人高效且透明的AI视觉卸载

Adam Zahir, Michele Gucciardom Falk Selker, Anastasios Nanos, Kostis Papazafeiropoulos, Carlos J. Bernardos, Nicolas Weber, Roberto Gonzalez

机构 * University Carlos III of Madrid(卡洛斯三世大学) Nubificus Ltd(Nubificus有限公司)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出vAccSOL框架,通过SOL神经网络编译器和vAccel执行框架实现AI视觉任务的高效透明执行,减少能耗并提升执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16050 2026-03-18 cs.RO cs.CV eess.IV 73%

The Era of End-to-End Autonomy: Transitioning from Rule-Based Driving to Large Driving Models

端到端自主时代:从基于规则的驾驶转向大型驾驶模型

Eduardo Nebot, Julie Stephany Berrio Perez

机构 * The Australian Centre for Robotics, School of Aeronautical, Mechanical and Mechatronic Engineering, The University of Sydney(澳大利亚机器人中心,航空航天、机械及机电工程学院,悉尼大学)

专题命中 具身导航 :robotics(abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文探讨自动驾驶从模块化规则系统向端到端学习系统过渡,分析大型驾驶模型在复杂环境中的表现及行业影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16871 2026-03-18 cs.CV 70%

WorldCam: Interactive Autoregressive 3D Gaming Worlds with Camera Pose as a Unifying Geometric Representation

WorldCam: 交互式自回归3D游戏世界与相机姿态作为统一的几何表示

Jisu Nam, Yicong Hong, Chun-Hao Paul Huang, Feng Liu, JoungBin Lee, Jiyoung Kim, Siyoon Jin, Yunsung Lee, Jaeyoon Jung, Suhwan Choi, Seungryong Kim, Yang Zhou

机构 * Adobe Research(Adobe研究院)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.CV

AI总结 本文提出WorldCam,通过将相机姿态作为统一的几何表示,解决交互式游戏世界中动作控制与长时序3D一致性问题,结合物理连续动作空间和全局相机姿态索引提升导航与视觉质量。

Comments Project page is available at https://cvlab-kaist.github.io/WorldCam/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16471 2026-03-18 cs.RO 57%

Coverage First Next Best View for Inspection of Cluttered Pipe Networks Using Mobile Manipulators

优先覆盖的下一步最佳视角用于 cluttered 管道网络的机器人检查

Joshua Raymond Bettles, Jiaxu Wu, Bruno Vilhena Adorno, Joaquin Carrasco, Atsushi Yamashita

机构 * Manchester Centre for Robotics and AI, The University of Manchester(曼彻斯特机器人与人工智能中心,曼彻斯特大学) The University of Tokyo(东京大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于下一步最佳视角的规划方法,用于在受限环境中同时进行探索和利用,通过信息增益重新表述覆盖路径规划问题,实现了对管道网络的自主覆盖检查。

Comments 8 pages, 9 figures, 1 table. Submitted to IEEE/RSJ International Conference on Intelligent Robots and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16264 2026-03-18 cs.AI 57%

Adaptive Theory of Mind for LLM-based Multi-Agent Coordination

自适应理论 of mind 用于基于大语言模型的多智能体协调

Chunjiang Mu, Ya Zeng, Qiaosheng Zhang, Kun Shao, Chen Chu, Hao Guo, Danyang Jia, Zhen Wang, Shuyue Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文提出自适应理论 of mind 机制,通过估计伙伴的理论 of mind 深度以提升多智能体协作效率,实验验证了该机制在多个任务中的有效性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15826 2026-03-18 cs.RO 57%

Robust Dynamic Object Detection in Cluttered Indoor Scenes via Learned Spatiotemporal Cues

通过学习的时空线索在拥挤室内场景中实现鲁棒的动态物体检测

Juan Rached, Yixuan Jia, Kota Kondo, Jonathan P. How

机构 * Faculty of Electrical Engineering, Mathematics and Computer Science, University of Twente(代尔夫特理工大学电子工程、数学与计算机科学学院) Department of Electrical Engineering, Wright State University(怀特塞德大学电子工程系) Massachusetts Institute of Technology(麻省理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种仅依赖LiDAR的框架,结合时间占用网格运动分割与学习的鸟瞰图动态先验,提升动态物体检测的鲁棒性,在拥挤环境中实现更高的召回率和F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16420 2026-03-18 eess.SP 56%

Improved GNSS Positioning in Urban Environments Using a Logistic Error Model

利用逻辑误差模型改进城市环境中GNSS的定位

Zhengdao Li, Penggao Yan, Baoshan Song, Li-Ta Hsu

专题命中 具身导航 :navigation(abstract,comments)

AI总结 本文提出基于逻辑分布的最大似然估计器LQLC,有效提升了城市环境中GNSS定位精度,减少RMSE和STD,且计算成本适配实时定位需求。

Comments Submitted to NAVIGATION: Journal of the Institute of Navigation

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16486 2026-03-18 math.OC 50%

Mapping Austria's Natural Gas and Hydrogen Infrastructure Plans

将奥地利天然气和氢能基础设施计划进行映射

Marco Quantschnig, Yannick Werner, Thomas Klatzer, Sonja Wogrin

专题命中 具身导航 :manipulation(abstract)

AI总结 本文构建了奥地利至2040年的天然气和氢能基础设施空间离散数据集,整合了传输和分配网络及氢能扩展计划,通过QGas工具实现基础设施修改,并支持面向未来的能源系统分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15908 2026-03-18 eess.SP 50%

Experimental Demonstration of Snapshot Differential Positioning with LEO Satellites

基于低轨卫星的快照差分定位实验

Soham Desai, Dave Cade

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种基于快照的差分定位框架,利用低轨卫星信号实现间歇观测下的高精度定位,实验表明在仅三个卫星可见时,定位误差可减少约47%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18310 2026-03-18 physics.optics physics.app-ph 50%

Programmable electro-optic frequency comb empowers integrated parallel convolution processing

可编程电光频率梳赋能集成式并行卷积处理

Jinze He, Junzhe Qiang, Yiying Dong, Jingyi Wang, Tian Dong, Gongcheng Yue, Rongjin Zhuang, Mingze Lv, Siyuan Yu, Zhongjin Lin, Xinlun Cai, Yuanmu Yang, Guanhao Wu, Yang Li

专题命中 具身导航 :robotics(abstract)

AI总结 本文提出一种集成光子处理单元,实现1.62万亿次/秒的并行卷积计算速度和超过38GHz的权重重建速度,首次通过单一可编程电光频率梳实现多波长生成和权重映射,具有前所未有的紧凑性和高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15778 2026-03-18 physics.bio-ph cond-mat.soft 50%

Biomedical active matter: Emergence and breakdown of collective functionalities

生物医学活性物质:集体功能的涌现与崩溃

Arnold Mathijssen, Hamed Almohammadi, Lauren Altman, Talia Calazans, M. J. Ferencz, Michelle Fung, Ian J. Lee, Maciej Lisicki, Ivy Liu, Maggie Liu, Tianyi Liu, Ernest Park, Ran Tao, Albane Thery, Zeyuan Wang, Margot Young

专题命中 具身导航 :navigation(abstract)

AI总结 本文探讨生物医学活性物质中集体功能的涌现与崩溃,分析了自组织、运动、感知、适应等核心机制,并提出通过微机器人群、生物启发材料等技术治疗相关疾病的方法。

Comments Review paper, 33 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏