arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14009 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14009 篇

2003.06082 2020-11-12 cs.RO cs.AI cs.CV cs.LG 81%

An Adversarial Objective for Scalable Exploration

Bernadette Bucher, Karl Schmeckpeper, Nikolai Matni, Kostas Daniilidis

专题命中 具身导航 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

Comments Additional visualizations of our results are available on our website at https://sites.google.com/view/action-for-better-prediction . Bernadette Bucher and Karl Schmeckpeper contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.03214 2020-03-09 cs.RO 81%

Streaming Scene Maps for Co-Robotic Exploration in Bandwidth Limited Environments

Yogesh Girdhar, Levi Cai, Stewart Jamieson, Nathan McGuire, Genevieve Flaspohler, Stefano Suman, Brian Claus

专题命中 具身导航 :robotic(title,abstract);robotics(comments,journal_ref);分类 cs.RO

Comments 8 pages, 6 figures, accepted for presentation in IEEE Int. Conf. on Robotics and Automation, ICRA '19, Montreal, Canada, May 2019

Journal ref 2019 IEEE International Conference on Robotics and Automation (ICRA), Montreal, QC, Canada, 2019, pp. 7940-7946

详情

展开后加载摘要…

URL PDF HTML 收藏
1808.07707 2020-01-01 cs.RO 81%

Qualitative vision-based navigation based on sloped funnel lane concept

Mohamad Mahdi Kassir, Maziar Palhang, Mohammad Reza Ahmadzadeh

专题命中 具身导航 :navigation(title,abstract);robotics(comments,journal_ref);分类 cs.RO

Comments This is a pre-print of an article published in Intelligent Service Robotics. The final authenticated version is available online at: https://doi.org/10.1007/s11370-019-00308-4

Journal ref Intelligent Service Robotics, 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.07347 2019-11-19 cs.CV 81%

Fast 3D Pose Refinement with RGB Images

Abhinav Jain, Frank Dellaert

专题命中 具身导航 :robotics(abstract);manipulation(abstract);navigation(abstract);robotic(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.04179 2018-12-11 cs.RO cs.AI cs.CL cs.CV cs.LG 81%

Mapping Navigation Instructions to Continuous Control Actions with Position-Visitation Prediction

Valts Blukis, Dipendra Misra, Ross A. Knepper, Yoav Artzi

专题命中 具身导航 :navigation(title);robot learning(comments,journal_ref);分类 cs.RO、cs.AI、cs.CV

Comments Appeared in Conference on Robot Learning 2018

Journal ref In Conference on Robot Learning (pp. 505-518) (2018)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17703 2026-08-19 cs.RO cs.AI math.OC 新提交 81%

Dijkstra as an Oracle for Online Stochastic Shortest Path Navigation with Provable Guarantees

作为具有可证保证的在线随机最短路径导航的神谕的Dijkstra算法

Mansur M. Arief, Ali Akarma, Ahmad Alfan Alfian Irfan

机构 * King Fahd University of Petroleum and Minerals (KFUPM)(法赫德国王石油与矿产大学) Islamic University of Madinah(麦地那伊斯兰大学) Universitas Muhammadiyah Yogyakarta(日惹穆罕默迪亚大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本研究提出DORA算法,基于Dijkstra算法的可证保证特性,实现高效安全的在线随机最短路径导航,性能与最优值迭代相当且规划工作量显著减少,接触率满足预算要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13923 2026-08-17 cs.CV cs.RO 新提交 81%

OpenBelief-Nav: Evidence-Preserving Object Memory for Open-Vocabulary Language-Guided Navigation

OpenBelief-Nav:面向开放词汇语言引导导航的证据保留型对象记忆

Dinh Tuan Nguyen, Anh Dao, Phuong Nam Dang, Quan-Dung Pham, Tuyen P. Le, Truong Nguyen, Quan Nguyen

机构 * VinMotion, Inc.(VinMotion公司) University of Southern California(南加利福尼亚大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 该研究针对开放词汇语言引导导航的对象记忆缺陷,提出OpenBelief-Nav模型,保留多源证据并支持灵活读出,在多数据集导航任务中优于基线方法,修正策略可提升目标确认成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14466 2026-08-17 cs.RO cs.IT cs.LG math.IT 新提交 81%

Expected Free Energy-based Informative Path Planning for Robotic Mars Exploration

基于期望自由能的火星探测机器人信息路径规划

Ajith Anil Meera, Pablo Lanillos, Wouter Kouw

机构 * TU Eindhoven(埃因霍温理工大学) Cajal Centre for Neuroscience, Spanish National Research Council(西班牙国家研究委员会卡哈尔神经科学中心)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO、cs.LG

AI总结 该研究提出将主动推理的期望自由能作为统一准则,用于预算约束下的机器人信息路径规划,其规划方法在火星探测场景中可同时实现精准地图构建与高价值区域定位,性能优于信息论基准方法。

Comments accepted for IWAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16509 2026-08-17 cs.RO cs.LG 版本更新 81%

Learning-Guided Sparsification of Dynamic Graphs in Robotic Exploration

基于学习的动态图稀疏化在机器人探索算法中的应用

Adithya V. Sastry, Bibek Poudel, Weizi Li

机构 * Independent Researcher(独立研究者) University of Tennessee, Knoxville(田纳西大学,基洛尼尔) University of California, Riverside(加州大学河滨分校)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出基于Transformer的框架,利用PPO算法在机器人探索中稀疏化动态图,减少冗余信息,提升性能,实验表明该方法能有效降低图规模并提高探索一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11597 2026-08-13 cs.RO cs.LG 新提交 81%

IoT-Enabled Autonomous Maritime Navigation in Smart Ports: A Curriculum-Guided Shared Policy Learning Framework

智能港口中基于物联网的自主海上航行:课程引导的共享策略学习框架

Yuqing Lin, Rangya Zhang, Kum Fai Yuen

机构 * Nanyang Technological University(南洋理工大学) School of Civil and Environmental Engineering(土木与环境工程学院) School of Mechanical and Aerospace Engineering(机械与航空航天工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 针对智能港口IoT自主海上设备的导航挑战,提出课程引导共享策略学习框架,经模拟验证其可靠性、避碰性等优于基线方法,可有效泛化到高密度场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09564 2026-08-11 cs.CV cs.AI 新提交 81%

From Semantic Grounding to Decision Optimization: A Unified Framework for Long-Horizon UAV Vision-Language Navigation

从语义接地到决策优化:面向长 horizon 无人机视觉语言导航的统一框架

Zeyuan Ma, Jiaxin Chen, Di Huang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 本文针对无人机视觉语言导航的现有问题,提出统一语义到决策框架,经实验在AerialVLN和OpenFly基准上达到SOTA性能。

Comments 10 pages, 5 figures. Accepted at ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08545 2026-08-11 cs.RO cs.LG 新提交 81%

Curriculum Generation under Structured Parametric Environments for Robust Navigation Policies

结构化参数环境下用于鲁棒导航策略的课程生成

Prishita Ray

机构 * Cornell University(康奈尔大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文针对结构化参数环境提出重参数化课程生成框架,结合分布偏移正则化,在OpenAI Gym的两类连续控制环境中,显著优于多种基线方法,提升了导航策略的鲁棒性。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07797 2026-08-11 cs.RO cs.CV 新提交 81%

Drone-Assisted UAV-UGV Collaboration for Autonomous Navigation in Snow-Covered Terrain

无人机辅助的无人机-无人车协同积雪覆盖地形自主导航

Shreyam Gupta, P. Agrawal, Priyam Gupta, R. Gautam

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 针对积雪覆盖地形传统导航方法失效的问题,提出无人机-无人车协同导航框架,采用定制U-Net、EKF、YOLOv5等技术实现高分割精度与低定位误差,可在遮挡环境中完成自主导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07751 2026-08-11 cs.RO cs.LG 新提交 81%

CoCoNav: Conformal Control for Safe Robot Navigation in Crowds

CoCoNav:面向人群环境中安全机器人导航的保形控制

Cheng Guo, Mingzhe Ni, Zheng Liang, Yihu Ling, Yuan Hu, Michele Caprio, Daniele Pucci, Wei Pan

机构 * The University of Manchester(曼彻斯特大学) Italian Institute of Technology(意大利技术研究院) Genisom AI University of Warwick(华威大学) Newcastle University(纽卡斯尔大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出CoCoNav框架,结合在线保形校准与“先松弛再验证”规划器,在人群环境机器人导航中实现了避碰、任务成功与效率的良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07566 2026-08-11 cs.AI cs.RO 新提交 81%

The Field Knows: Cross-Dimensional Geometry from Navigation to Black Holes

场域知晓:从导航到黑洞的跨维度几何

Chenghao Xu

机构 * National Engineering Research Center of Robot Visual Perception and Control Technology(机器人视觉感知与控制技术国家工程研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究提出了由单个因果对比损失训练的连续度量场框架,可跨维度发现几何结构,在机器人导航和黑洞场景中均表现出良好性能,具备零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14357 2026-08-11 cs.RO cs.AI 版本更新 81%

SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation

SUM-AgriVLN:面向农业视觉语言导航的空间理解记忆

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 针对现有农业视觉语言导航方法忽视重复指令的空间记忆潜力的局限,提出SUM模块并集成至AgriVLN构建SUM-AgriVLN,在A2A基准上将SR从0.47提至0.54,NE仅微增,达领域顶尖性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07079 2026-08-10 cs.RO cs.AI 新提交 81%

LifelongCrossNav: Persistent 3D Semantic Memory for Cross-Floor Multi-Object Navigation

LifelongCrossNav:用于跨楼层多目标导航的持久3D语义记忆

Zehui Li, Zihao Sun, Jiawei Xu, Zheqi He, Xiaoqiang Zhang, Jing-Shu Zheng, Lu Liu, Dahui Gao, Xiuwan Chen

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出LifelongCrossNav框架,结合持久3D语义记忆与跨楼层可通行性建模,在自研HM3D-MFMON基准上实现更优的多层顺序多目标导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19880 2026-08-07 cs.RO cs.CV 版本更新 81%

EA-Nav: Learning Safe Visual Navigation Policies with Embodiment Awareness

EA-Nav:通过具身感知学习安全的视觉导航策略

Jialu Zhang, Yong Du, Xianda Guo, Shunwang Sun, Xinqi Liu, Yue Sun, Guodong Lu, Wei Sui, Jituo Li

机构 * Zhejiang University(浙江大学) Wuhan University(武汉大学) Hunan University(湖南大学) D-Robotics(D机器人公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 针对跨具身导航挑战,提出基于模仿学习的具身感知导航框架,通过模块化多阶段设计,预训练构建数据集并引入具身几何,微调设计多模态信息注入机制,有效提高不同具身设置下的导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03143 2026-08-05 cs.CV cs.RO 新提交 81%

From Routes to Steps: Separating Semantic Progress from Local Execution in Vision-and-Language Navigation

从路线到步骤:在视觉语言导航中分离语义进展与局部执行

Xiangyun Huang, Xiangchen Wang, Runfeng Lin, Yihao Xu, Kangyu Huang, Jiang Hengchen, Xiwang Dong, Lin Jiarong

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本研究针对视觉语言导航中进展与执行错误难区分的问题,提出Route2Step框架,通过步骤级接口分离语义进展跟踪与动作生成,在R2R-CE数据集上显著提升了导航性能,且在真实环境中具备实用性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01802 2026-08-04 cs.AI cs.RO 新提交 81%

CoNav-UAV: Cooperative Dual-Altitude Aerial Navigation via Stackelberg Learning

CoNav-UAV:基于Stackelberg学习的协同双高度无人机导航

Junru Song, Wenhao Zhang, Yang Yang, Xuekai Qiu, Feifei Wang, Weien Zhou, Tingsong Jiang, Ying Wen, Yang Li, Wen Yao

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 针对双高度无人机协同导航的合作问题,本文提出CoNav-UAV,通过迭代Stackelberg学习优化高空领导者与低空跟随者,在AerialVLN基准上显著提升导航成功率且适配数据需求更少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00527 2026-08-04 cs.RO cs.AI 新提交 81%

SSTG-Nav: Metric-Grounded Spatial-Semantic Topological Graphs for Reusable Object Navigation

SSTG-Nav:用于可重复物体导航的度量空间语义拓扑图

Daojie Peng, Bingtao Wang, Jun Ma

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究提出SSTG-Nav,将一次性勘测转化为可执行物体目标,在HM3D-v2数据集实验中显著提升语义导航的成功率与SPL,验证了预探索在可靠重复语义导航中的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26914 2026-07-30 cs.RO cs.AI 新提交 81%

BioVLN: A Simulation Platform for Visual Language Navigation in Biomedical Laboratories

BioVLN:生物医学实验室视觉语言导航的仿真平台

Zhe Liu, Quan Lu, Zhaohui Du, Zhe Wang, Huanbo Jin, Jiaming Gu, Qi Wang, Ting Xiao, Minting Pan, Dongzhan Zhou

机构 * East China University of Science and Technology(华东理工大学) Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究针对现有导航平台不适用于实验室仪器的问题,提出BioVLN仿真平台,通过分区域建模仪器实现更精准导航,实验验证其提升成功率并降低安全风险。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06882 2026-07-28 cs.RO cs.AI 版本更新 81%

GemNav: Discrete-Token Visual Robot Navigation using a Multimodal Large Language Model

GemNav:使用多模态大语言模型的离散令牌视觉机器人导航

Peter Bohm, Saimunur Rahman, Abdelwahed Khamis, Sagun Man Singh Shrestha, Chris McCool, Peyman Moghadam

机构 * CSIRO Technology(联邦科学与工业研究组织)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 研究探索基于大型预训练模型的视觉机器人导航策略新方法,提出GemNav,仅对语言塔用LoRA适配冻结的多模态大语言模型用于中短程航点导航,无辅助视觉编码器等,在小语料库上零样本转移到未见环境,提供了数据高效、可部署的导航替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14807 2026-07-28 cs.CV cs.RO 版本更新 81%

HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System

HiMemVLN:通过分层记忆系统增强开源零样本视觉-语言导航的可靠性

Kailin Lyu, Kangyi Wu, Pengna Li, Xiuyu Hu, Qingyi Si, Cui Miao, Ning Yang, Zihang Wang, Long Xiao, Lianyu Hu, Jingyuan Sun, Ce Hao

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出HiMemVLN,通过分层记忆系统提升开源零样本视觉-语言导航的可靠性,解决导航遗忘问题,实现实验环境下的性能提升。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00288 2026-07-28 cs.RO cs.CV 版本更新 81%

UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents

UAV-ON:用于空中智能体的开放世界目标导航基准测试

Jianqiang Xiao, Yuexuan Sun, Yixin Shao, Boxi Gan, Rongqiang Liu, Yanjin Wu, Weili Guan, Xiang Deng

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 介绍用于空中智能体开放世界目标导航的UAV-ON基准测试,含14个环境及1270个目标对象,通过实例级指令编码。实现多种基线方法评估,结果凸显空中导航和语义目标基础的复合挑战,推动复杂环境下无人机可扩展自主性研究。

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21964 2026-07-27 cs.RO cs.AI 新提交 81%

ACME: A Multi-Cultural, Multi-Embodiment Social-Navigation Dataset

ACME:一个多文化、多实体的社会导航数据集

Shashank Rao Marpally, Allan Wang, Atharva Ghotavadekar, Renato Alexandre Ribeiro, Nhat Le, Pilar Bachiller-Burgos, Pranav Goyal, Subham Agrawal, Yasuhiro Nitta, Howard Ziyu Han, Daeun Song, Masaki Kuribayashi, Kohei Uehara, Xiyue Wang, Yangzhe Kong, Duc M. Nguyen, Amirreza Payandeh, Gerardo Pérez-González, Alejandro Torrejón-Harto, Jeeho Ahn, Tisha Jain, Andrew Stratton, Elvin Yang, Jorge de Heuvel, Nico Ostermann-Myrau, Sai Anudeep Sajja, Mithilya Raj, Daisuke Sato, Gaston Rouquette, Nikolas Martelaro, Maki Sugimoto, Hironobu Takagi, Chieko Asakawa, Maren Bennewitz, Aaron Steinfeld, Xuesu Xiao, Christoforos Mavrogiannis, Harold Soh

机构 * School of Computing, National University of Singapore(新加坡国立大学计算学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究针对现有社会导航数据集缺乏文化等多样性的问题,引入ACME数据集,通过多国多地多机器人实体大规模收集数据,提供多种数据便于学习与预测,经分析其能捕捉更具挑战场景及更广泛行人行为。

Comments 24 Pages, 19 Figures, Submitted to IJRR on June 29th 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14514 2026-07-27 cs.CV cs.AI 版本更新 81%

VTM-Nav: Harnessing Cross-Episode Experience for Object-Goal Navigation with Hierarchical Visual-Topological Memory

VTM-Nav:用于跨情节对象目标导航的分层视觉拓扑记忆

Xiaoran Xu, Yupeng Wu, Tianyu Xue, Yifan Xu, Xuanran Dong, Xiaoshan Yang, Changsheng Xu

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学交叉科学学院) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 研究跨情节对象目标导航问题,提出无训练的VLM导航框架\method,其带有分层视觉拓扑记忆,通过粗到细匹配检索经验,在三个基准测试中性能最佳,证明跨数据集结构化视觉拓扑经验复用有效且鲁棒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12291 2026-07-27 cs.RO cs.CV 版本更新 81%

OpenNavMap: Multi-Session Appearance-Based Topometric Mapping for Scalable Visual Navigation

OpenNavMap: 无需结构的拓扑制图通过大规模协作定位

Jianhao Jiao, Changkun Liu, Jingwen Yu, Boyi Liu, Qianyi Zhang, Yue Wang, Dimitrios Kanoulas

机构 * Robot Perception and Learning Lab, Intelligent Robotics, Department of Computer Science, University College London(机器人感知与学习实验室,智能机器人,计算机科学系,伦敦大学学院) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(计算机科学与工程系,香港科学与技术大学) Department of Electronic and Computer Engineering, Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学) Institute of Robotics and Automatic Information System, Nankai University(机器人与自动信息系统研究所,南开大学) College of control science and engineering, Zhejiang University(控制科学与工程学院,浙江大学) AI Centre, Department of Computer Science, University College London(人工智能中心,计算机科学系,伦敦大学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 OpenNavMap通过大规模协作定位实现无需结构的拓扑制图,利用3D几何模型进行按需重建,实现高精度的子图对齐和全局一致性。

Comments 21 pages, 20 figures, https://rpl-cs-ucl.github.io/OpenNavMap_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18042 2026-07-24 cs.CV cs.AI 版本更新 81%

Anticipate Before Acting: Future-State-Conditioned Vision-Language Navigation

行动前预测:基于未来状态条件的视觉语言导航

Lingfeng Zhang, Zhanguang Zhang, Liheng Ma, Tongtong Cao, Yingxue Zhang

机构 * Noah’s Ark Lab, 2012 Labs, Huawei(诺亚方舟实验室,2012实验室,华为)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 研究视觉语言导航中标准行为克隆问题,提出FSC-VLN方法,通过添加未来查询令牌并经训练后移除的目标分支将其隐藏状态与未来视觉嵌入对齐,实验表明该方法在R2R val-unseen上提升了相关指标。

Comments 9 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01043 2026-07-24 cs.RO cs.AI 版本更新 81%

DART-VLN: Test-Time Memory Decay and Anti-Loop Regularization for Discrete Vision-Language Navigation

DART-VLN:离散视觉语言导航的测试时记忆衰减与反循环正则化

Shaoheng Zhang, Zhichen Li, Jie Mei

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出无需训练的测试时控制框架DART-VLN,通过记忆衰减和反循环正则化改善离散视觉语言导航的局部回溯和历史证据过时问题,提升路径效率与导航性能。

Comments Accepted by the 2026 IEEE International Conference on Systems, Man, and Cybernetics (IEEE SMC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏