arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 534 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 534 篇

2608.10817 2026-08-12 cs.RO 新提交 79%

AECNav: Active Evidence Consolidation for Efficient Zero-Shot Open-Vocabulary Object Navigation

AECNav:用于高效零样本开放词汇对象导航的主动证据整合

Guanlin Liu, Shaobin Ling, Renyuan Liu, Zeying Gong, Junjie Hu

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 AECNav是一种无需训练的零样本开放词汇对象导航方法,通过证据门控感知、证据整合与主动证据获取三个组件,在多个基准数据集上达到最新性能,且在物理机器人上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09946 2026-08-12 cs.HC cs.AI 新提交 79%

HoosierHelp: Benchmarking LLM Agents for Social Service Navigation

HoosierHelp:面向社会服务导航的大语言模型智能体基准测试

Yiyang Li, Weixiang Sun, Tianyi Ma, Kaiwen Shi, Zheyuan Zhang, Yanfang Ye

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 该研究推出基于印第安纳州3971项公共社会服务资源的交互式基准HoosierHelp,测试发现现有LLM智能体在社会服务导航中对复杂非理想用户交互鲁棒性不足,需更可靠的智能体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09944 2026-08-12 cs.HC cs.AI 新提交 79%

Navigation Alone Is Not Enough: Evaluating Explanatory Assistive UI Agents

仅导航是不够的:评估解释性辅助UI智能体

Santosh Patapati

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 该研究推出辅助UI智能体基准NeXUI,评估其导航、解释及用户控制能力,实验发现Gemini-3.5-Flash在该基准中表现不佳,为相关研发提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09121 2026-08-11 cs.AI 新提交 79%

MELLON - Multimodal Enhanced LLM for Online Navigation

MELLON——面向在线导航的多模态增强型大语言模型

Ruiyu Li, Haoyang Cai, Zhitong Guo, Tong Hu

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 针对网页导航智能体现有模型的不足,本文以WebShop为基准,提出MELLON等三项多模态增强方案,训练1个epoch后MELLON任务完成准确率提升9.26%,验证了多模态方法的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05365 2026-08-07 cs.RO 新提交 79%

Unified Planning-Learning Framework for Robust UUV Navigation Under Partial Observability

部分可观测条件下用于自主水下航行器(UUV)鲁棒导航的统一规划-学习框架

Md Ether Deowan, Eleni Kelasidi

机构 * NTNU(挪威科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究提出统一规划-学习框架,结合占用地图构建、规划与控制,通过行为树蒸馏等技术提升UUV在部分可观测动态水下环境的导航鲁棒性与安全性,经仿真验证优于基线方法。

Comments 8 pages, 6 figures. Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026), Philadelphia, PA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05078 2026-08-06 cs.RO 新提交 79%

SpikingNav: Robust Embodied Navigation with Spiking Neural Policies

SpikingNav:基于脉冲神经网络策略的鲁棒具身导航

Jiahong Zhang, Sijun Shen, Dehua Wu, Yifan Lin, Xuechen Xia, Xu Chu, Youhui Zhang, GuoqiLi

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Beijing National Research Center for Information Science and Technology, Tsinghua University(北京信息科学与技术国家研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出SpikingNav脉冲导航框架,含SSE与SPN,在PointNav、ObjectNav任务中,其参数更少、计算量更低,鲁棒性优于匹配的ANN基线,且可部署于Thruster-V2芯片。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04825 2026-08-06 cs.RO 新提交 79%

Deliberate Before You Fly: Vision-Guided Spatial Deliberation for UAV See-and-Reach Navigation

飞行前深思熟虑:面向无人机“看见并到达”导航的视觉引导空间深思熟虑

Fanfu Xue, En Yu, Bohang Liu, Hongjun Wang, Yang Yang, Xindi Wang, Jiande Sun

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对无人机“看见并到达”导航中语义-控制失配问题,提出视觉-语言航路点预测框架DBFly,通过空间机动决策链、隐式飞行走廊和感知终端收敛的停止策略,使成功率较SOTA基线平均提升25.07个百分点。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02886 2026-08-05 cs.RO cs.SY eess.SY 新提交 79%

Control Barrier Functions via Minkowski Operations for Safe Navigation among Polytopes

基于闵可夫斯基运算的控制障碍函数用于多面体间的安全导航

Yi-Hsuan Chen, Shuo Liu, Wei Xiao, Calin Belta, Michael Otte

机构 * University of Maryland(马里兰大学) Boston University(波士顿大学) Nanyang Technological University(南洋理工大学)

专题命中 具身导航 :navigation(title);robotics(abstract);分类 cs.RO

AI总结 该研究针对多面体环境的机器人安全导航问题,提出结合非光滑控制障碍函数与闵可夫斯基运算的精确符号距离函数方法,可实现非保守机动与安全恢复。

Comments 16 pages, 13 figures. Expanded version of a paper published in IEEE CDC 2025. Demo video: https://youtu.be/D0zVswzyxaE

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02079 2026-08-04 cs.RO cs.SY eess.SY 新提交 79%

TANGO-VIO: Triangulation-Aware Navigation with Guaranteed Feature-Observability for Visual-Inertial Odometry

TANGO-VIO:面向视觉惯性里程计的、具备特征可观测性保证的三角化感知导航

Abdülbaki Şanlan, Ege C. Altunkaya, Hasan T. Bağci, Emre Koyuncu, İbrahim Özkol

机构 * Istanbul Technical University(伊斯坦布尔理工大学) Aviation Institute, Istanbul Technical University(伊斯坦布尔理工大学航空学院) Aerospace Research Center, Istanbul Technical University(伊斯坦布尔理工大学航空航天研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对视觉惯性里程计中特征可观测性主动维护不足的问题,提出TANGO-VIO框架,通过控制障碍函数保证特征几何可观测性,经仿真和真实实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00970 2026-08-04 cs.RO 新提交 79%

FreqNav: Stage-Wise Frequency Routing for Object-Oriented Aerial Vision-Language Navigation

FreqNav:面向面向对象空中视觉语言导航的分阶段频率路由

Yin Tang, Jiawei Ma, Jiahao Li, Hao Zhang, Zhemin Sun, Jianqiao Sun, Deyu Zhang

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对现有空中VLN方法的感知干扰问题,提出FreqNav框架,通过动态分配视觉令牌实现分阶段频率路由,提升性能并加快推理速度,验证了其实际应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29600 2026-08-03 cs.RO 新提交 79%

HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation

HAM-VLN:利用分层智能体记忆实现零样本视觉与语言导航

An Liu, Bingxi Liu, Hongyu Ding, Yixuan Jiang, Yaran Chen, Fulin Tang, Cong Leng, Hong Zhang, Jian Cheng

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本研究提出HAM-VLN零样本VLN方法,通过分层智能体记忆缓解长程导航的记忆与推理瓶颈,提升导航指标并缩短上下文长度,在多个基准数据集上取得优异零样本性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27922 2026-07-31 cs.RO 新提交 79%

Learning Social Robot Navigation By Sensing Human Legs

通过感知人腿实现社交机器人导航

Alberto Vaglio, Andrea Garulli, Antonio Giannitrapani, Renato Quartullo, Tommaso Van Der Meer

机构 * University of Siena(锡耶纳大学) Uninettuno University(意大利 uniNettuno 大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出CALF架构,结合卷积、注意力和MLP从激光雷达解读腿部运动,在LegNav模拟器中训练后,经TurtleBot 4零样本部署验证,实现了平滑合规的社交机器人导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25754 2026-07-29 cs.RO 新提交 79%

Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning

通过系统多智能体深度强化学习实现复杂环境下的多无人机协同导航

Yu Su, Nabil Aouf

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对复杂环境下多无人机协同导航面临的问题,提出多智能体深度强化学习框架,通过协同探索等方法解决,含感知、示范缓冲区和课程调度机制,能抽象特征实现跨场景转移,经仿真验证有良好性能。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25448 2026-07-29 cs.RO 新提交 79%

Room-Mediated Co-occurrence for Zero-Shot Object-Centric Semantic Navigation via Frontier Scoring

通过前沿评分实现基于零样本目标中心语义导航的房间介导共现

Adam Scicluna, Gavin Paul, Alen Alempijevic

机构 * Robotics Institute, Faculty of Engineering and Information Technology, University of Technology Sydney (UTS)(悉尼科技大学工程与信息技术学院机器人研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究零样本目标中心语义导航,提出通过房间词汇表介导对象关系的无需训练的管道,利用CLIP-derived的RPV计算共现,经洪水填充传播投影到值图排序前沿,相比基线提升了SR和SPL,保留可解释性与灵活性。

Comments 8 pages. Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24369 2026-07-28 cs.RO cs.SY eess.SY 新提交 79%

Model Predictive Planner for UAV Navigation in Non-Convex Air Corridors

非凸空中走廊中无人机导航的模型预测规划器

Henrique Silva, Marcelo A. Santos, Guilherme V. Raffo

机构 * Universidade Federal de Minas Gerais(米纳斯吉拉斯联邦大学) University of Bergamo(贝加莫大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究无人机在非凸空中走廊的导航规划,核心方法是基于混合整数跟踪模型预测控制公式,嵌入特定成本与约束,主要贡献是生成满足约束且收敛目标的动态有效轨迹,无需外部全局规划。

Comments Accepted for publication at the 23rd IFAC World Congress (Busan, Korea)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24292 2026-07-28 cs.RO 新提交 79%

Learning Adaptive Multi-Task Guidance, Navigation, and Control via Hypernetworks

通过超网络学习自适应多任务制导、导航与控制

Ricard Marsal I Castan, Aman Arora, Antoine Richard, Andrej Orsula, Cédric Pradalier, Miguel A. Olivares-Méndez

机构 * JAXA(日本宇宙航空研究开发机构)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究轨道环境中自主自由飞行机器人多任务控制问题,提出HYPER - GNC框架,通过超网络映射任务嵌入到共享策略权重,使单个控制器掌握多种任务,实验证明其样本效率高且能保持稳定,还弥合了模拟到现实的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23962 2026-07-28 cs.CV cs.CR 新提交 79%

Development of Vision-Language Model-based GNSS Spoofing Detection for Autonomous Vehicle Navigation

基于视觉语言模型的自动驾驶车辆导航GNSS欺骗检测技术发展

Mohammed Aldeen, Muhammad Sami Irfan, Sagar Dasgupta, Long Cheng, Mizanur Rahman, Mashrur Chowdhury

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 研究自动驾驶车辆GNSS欺骗检测问题,提出基于视觉语言模型的框架,融合多源数据,经三阶段微调及自适应推理策略,大幅提升检测准确率与效率,并生成数据集验证跨区域泛化能力,为自动驾驶提供实用道路防御层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23743 2026-07-28 cs.RO 新提交 79%

Learning Traversability-Aware Global Planners for Long Horizon Off-Road Navigation

学习用于长距离越野导航的可通行性感知全局规划器

Kasi Viswanath, Jason M. Gregory, Shaunak Kolhe, Srikanth Saripalli

机构 * J. Mike Walker ’66 Department of Mechanical Engineering, Texas A&M University(德克萨斯农工大学J. Mike Walker '66机械工程系) DEVCOM Army Research laboratory(陆军研究实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对大型越野环境自主导航难题,提出从高空数据学习连续可通行性地图的方法,由人类驾驶轨迹监督、激光雷达先验塑造,发布相关数据集,实地试验显示该方法能减少操作员干预,轨迹接近人类路径长度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23504 2026-07-28 cs.CV 新提交 79%

MemVLN: Episodic and Procedural Memory for Vision-and-Language Navigation

MemVLN:用于视觉与语言导航的情景记忆和程序记忆

Yuqi Liu, Shengju Qian, Tianyuan Qu, Mingxian Lin, Zixuan Wang, Xin Wang, Bei Yu, Jiaya Jia

机构 * The Chinese University of Hong Kong(香港中文大学) LIGHTSPEED(光速) The University of Hong Kong(香港大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 研究连续环境中视觉与语言导航问题,提出MemVLN框架,利用视觉编码器、大语言模型,通过情景记忆管理和程序记忆,实现实时推理,提升导航成功率并降低推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21025 2026-07-24 cs.RO 新提交 79%

ZONDA: Zero-shot Object Navigation with Dynamic Avoidance in Multi-floor Environments

ZONDA:多楼层环境中具有动态避障功能的零样本目标导航

Shaomin Liang, Xuanhong Liao, Shiyao Zhang

机构 * Southern University of Science and Technology(南方科技大学) Guangdong Direct Drive Technology Limited(广东直驱技术有限公司) South China University of Technology(华南理工大学) Great Bay University(大湾区大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对目标导航任务中现有方法局限,提出ZONDA框架,集成启发式多楼层规划、多视图目标验证、动态行人避障三个核心组件,通过真实机器人及模拟测试取得显著改进结果,在动态基准测试中表现优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20926 2026-07-24 cs.AI 新提交 79%

SciExplore: Evaluating Autonomous Agents from Scientific Navigation to Information Integration

SciExplore:评估从科学导航到信息整合的自主智能体

Yinhao Tang, Youqing Fang, Yanan Sun, Wenran Liu, Weiming Zhang, Bin Liu, Kuikun Liu, Wenwei Zhang, Kai Chen

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 介绍用于评估大语言模型和智能体科学信息检索与推理能力的基准SciExplore,包含四类任务,在其上评估多个先进模型和智能体,发现随着任务复杂度增加性能差距大,凸显当前模型在实际科学信息检索场景中的局限。

Comments 25 pages, 13 figures. Submitted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20772 2026-07-24 cs.RO 新提交 79%

Socially Consistent Multi-Robot Navigation Using Decoupled Planning and Trajectory Coordination

使用解耦规划和轨迹协调的社会一致多机器人导航

Matthew M. Sato, Kincho H. Law

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究多机器人在人类环境中的导航,通过解耦规划与轨迹协调,改进A*规划器嵌入社会规范构建社会图,转化轨迹协调为凸规划,实现可预测、符合社会规范的路径规划,简化多机器人协调。

Comments Submitted to Civil Engineering Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18794 2026-07-22 cs.RO 新提交 79%

Beyond Transformers: Linear Attention Policy for Open-Vocabulary Object Goal Navigation

超越Transformer:用于开放词汇对象目标导航的线性注意力策略

Jiahong Zhang, Yifan Lin, Yandong Zhang, Sijun Shen, Kexin Wang, Yuqi Pan, Hongjuan Pei, Wei Wang, Guoqi Li

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究开放词汇对象目标导航中智能体状态更新问题,提出基于线性注意力的导航策略LANav,采用线性注意力作主干,引入加权状态扩展线性注意力提升性能,在多方面优于基于Transformer基线,证明其可行性与跨场景鲁棒性。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16956 2026-07-21 cs.RO 新提交 79%

G2-Nav: Grounded and Guarded Vision-Language Costmaps for Robot Social Navigation

G2-Nav:用于机器人社交导航的基于视觉语言的地面与防护代价地图

Yuwen Liao, Yihang Lan, Yizhuo Yang, Ruimeng Liu, Xinhang Xu, Shenghai Yuan, Lihua Xie

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对机器人社交导航问题,提出G2-Nav框架,将VLM语义推理转化为视觉语言代价地图,经开放集感知评估区域和代理,结合语义验证与高频安全检查,实现非结构化环境下安全、高效且符合社会规范的自主导航。

Comments submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16806 2026-07-21 cs.RO 新提交 79%

Token-Wise Latent Streaming from Slow Reasoners to Fast Planners for Dynamic Vision Language Navigation

用于动态视觉语言导航的从慢速推理器到快速规划器的逐令牌潜在流

Tianshuai Hu, Yangyi Zhong, Zeying Gong, Lingdong Kong, Xiaodong Mei, Guoyang Zhao, Xiaolu Liu, Song Wang, Rong Li, Junwei Liang

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) National University of Singapore(新加坡国立大学) Zhejiang University(浙江大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对动态视觉语言导航中语言推理慢与规划需即时的矛盾,提出SPARK-VLN双系统框架,通过三个模块将慢速VLM推理器知识流到快速规划器,引入新基准套件,提高了导航成功率、社会合规性及推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16614 2026-07-21 cs.RO cs.SY eess.SY 新提交 79%

An Indoor Navigation System for the Visually Impaired based on UWB Positioning and D* Lite Path Planning Algorithm

基于超宽带定位和D* Lite路径规划算法的视障者室内导航系统

Thanh C. Vo, Dong LT. Tran, Huy HM. Le, Duyen N Ha, Tuan Anh Pham, Hai Thanh Dang, Hoang T. Tran

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对视障者室内导航问题,提出基于UWB定位技术和D* Lite路径规划算法的系统,利用UWB传感器定位,集成算法优化轨迹、应对动态障碍,实验表明系统可靠低延迟,为视障者提供安全灵活的室内导航。

Comments 6 pages, 7 figures, 3 tables

Journal ref Proceedings of the 8th Vietnam International Conference and Exhibition on Control and Automation (VCCA-2026), pp.1029-1034, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15758 2026-07-20 cs.RO 新提交 79%

SkillNav: Score-Level Skill Intervention for Zero-Shot Object Goal Navigation

SkillNav:用于零样本对象目标导航的分数级技能干预

Ruijie Sang, Yiqun Duan, Pinhan Fu, Ruilin Wang, Wei Sui, Xianda Guo

机构 * D-Robotics(D-机器人公司) HAI Center, University of Technology Sydney(悉尼科技大学HAI中心) School of Computer Science, Wuhan University(武汉大学计算机科学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对VLM智能体零样本对象目标导航存在的问题,提出SkillNav框架,通过分层技能设计及双表示设计,无需训练,在多个数据集上提升成功率,建立新最优成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15036 2026-07-17 cs.RO 新提交 79%

Learning Agile Navigation in Crowded Environments for Quadruped Robots

学习四足机器人在拥挤环境中的敏捷导航

Shuyu Wu, Zeyu Liu, Tianbao Zhang, Fanxing Li, Fangyu Sun, Mingkang Xiong, Wei Xi, Wenxian Yu, Danping Zou

机构 * Shanghai Jiao Tong University(上海交通大学) Midea Group(美的集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对四足机器人在拥挤环境中导航难题,提出结合VO几何安全与端到端学习敏捷性的VOP-Nav系统,利用LiDAR数据隐式编码约束并预测安全速度区,VO预测兼具推理输入与训练奖励双重作用,实验验证其高效性与稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14586 2026-07-17 cs.RO 新提交 79%

SoftNav: Injecting 3D Scene Tokens into VLMs for Embodied Navigation

SoftNav:将3D场景令牌注入视觉语言模型以进行具身导航

Yi Wu, Junjie An, Xiao Liu, Yiqun Zhou, Yuechen Wu, Xiaoqing Guan, Shuyang Yu, You Wang, Guang Li

机构 * Zhejiang University(浙江大学) Shandong University(山东大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对具身导航中3D场景理解与导航推理协同问题,提出SoftNav方法,通过轻量级投影仪将3D连续表示作为软令牌注入VLM隐藏空间,在HM3D-OVON上超越先前方法,且能零样本转移到其他场景,弥合表征差距实现可转移导航。

Comments 8 pages, 6 figures. Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13768 2026-07-16 cs.RO 新提交 79%

The Nonsmooth Impact Direction (NSID) of Robotic Systems

机器人系统的非光滑碰撞方向 (NSID)

Annika Kirner, Christian Ott

机构 * Automation and Control Institute, TU Wien(维也纳工业大学自动化与控制研究所) Institute of Robotics and Mechatronics, German Aerospace Center (DLR)(德国航空航天中心机器人与机电一体化研究所)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 研究机器人系统的非光滑碰撞方向 (NSID),通过系统分析碰撞前后速度,表明其为机器人碰撞特征方向且独立于接触特性,适用于多种机器人系统,理论分析与实验验证为相关规划和控制算法奠定基础。

Comments 18 pages, 17 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏