arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14015 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14015 篇

2603.08324 2026-03-10 cs.RO cs.AI 81%

EndoSERV: A Vision-based Endoluminal Robot Navigation System

EndoSERV:一种基于视觉的内镜机器人导航系统

Junyang Wu, Fangfang Xie, Minghui Zhang, Hanxiao Zhang, Jiayuan Sun, Yun Gu, Guang-Zhong Yang

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(医学机器人研究所,上海交通大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 EndoSERV提出了一种基于视觉的内镜机器人导航系统,通过SE段到结构和Real到虚拟映射技术,解决内镜路径复杂、狭窄和曲折带来的导航难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13965 2026-03-10 cs.RO cs.CV 81%

MetricNet: Recovering Metric Scale in Generative Navigation Policies

MetricNet: 恢复生成导航策略中的度量尺度

Abhijeet Nayak, Débora Oliveira Makowski, Samiran Gode, Cordelia Schmid, Wolfram Burgard

机构 * Artificial Intelligence and Robotics Lab, Department of Computer Science and Artificial Intelligence, University of Technology Nuremberg(技术大学纽伦堡计算机科学与人工智能系人工智能与机器人实验室) Inria, Ecole Normale Supérieure, CNRS, PSL Research University(法国国家信息与自动化技术研究院、巴黎高等师范学校、国家科学研究中心、巴黎-萨克勒研究大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 MetricNet通过预测航点之间的度量距离,解决生成导航策略中轨迹抽象和控制策略短视的问题,提升导航与探索性能。

Comments Accepted to ICRA'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08007 2026-03-10 cs.CV cs.AI 81%

ViSA-Enhanced Aerial VLN: A Visual-Spatial Reasoning Enhanced Framework for Aerial Vision-Language Navigation

ViSA增强的空中视觉语言导航:一种增强视觉空间推理能力的空中视觉语言导航框架

Haoyu Tong, Xiangyu Dong, Xiaoguang Ma, Haoran Zhao, Yaoming Zhou, Chenghao Lin

机构 * Tianmushan Laboratory, Beihang University(北航之梦实验室,北京航空航天大学) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北京航空航天大学) Foshan Graduate School of Innovation, Northeastern University(佛山创新研究生学院,东北大学) School of Aeronautic Science and Engineering, Beihang University(航空科学与工程学院,北京航空航天大学) Faculty of Robot Science and Engineering, Northeastern University(机器人科学与工程学院,东北大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 ViSA增强框架通过结构化视觉提示提升空中VLN的空间推理能力,显著提高成功率,为该领域提供有力支持。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07909 2026-03-10 cs.RO cs.AI 81%

Long-Short Term Agents for Pure-Vision Bronchoscopy Robotic Autonomy

长短期代理用于纯视觉支气管镜机器人自主性

Junyang Wu, Mingyi Luo, Fangfang Xie, Minghui Zhang, Hanxiao Zhang, Chunxi Zhang, Junhao Wang, Jiayuan Sun, Yun Gu, Guang-Zhong Yang

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) Shanghai Chest Hospital(上海胸科医院)

专题命中 具身导航 :robotic(title);navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出一种纯视觉的支气管镜机器人自主导航框架,通过长短期代理实现无外部跟踪的精准导航,验证了其在体内外实验中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24118 2026-03-10 cs.RO cs.AI 81%

LagMemo: Language 3D Gaussian Splatting Memory for Multi-modal Open-vocabulary Multi-goal Visual Navigation

LagMemo: 语言3D高斯点云记忆用于多模态开放词汇多目标视觉导航

Haotian Zhou, Xiaole Wang, He Li, Zhuo Qi, Jinrun Yin, Haiyu Kong, Jianghuan Xu, Huijing Zhao

机构 * Key Laboratory of Machine Perceptions (MOE), School of Intelligence Science and Technology, Peking University(机器感知重点实验室(教委)、智能科学与技术学院、北京大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 LagMemo通过语言3D高斯点云记忆实现多模态开放词汇多目标视觉导航,有效提升多目标定位性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09820 2026-03-10 cs.RO cs.AI 81%

ViLAM: Distilling Vision-Language Reasoning into Attention Maps for Social Robot Navigation

ViLAM:将视觉-语言推理转化为注意力图用于社交机器人导航

Mohamed Elnoor, Kasun Weerakoon, Gershom Seneviratne, Jing Liang, Vignesh Rajagopal, Dinesh Manocha

机构 * Dept. of Electrical and Computer Engineering, University of Maryland, College Park, MD, USA(电气与计算机工程系,马里兰大学,College Park, MD, USA) Dept. of Computer Science, University of Maryland, College Park, MD, USA(计算机科学系,马里兰大学,College Park, MD, USA) James Clark School of Engineering, University of Maryland, College Park, MD, USA(James Clark工程学院,马里兰大学,College Park, MD, USA)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 ViLAM通过蒸馏视觉-语言模型的注意力图,提升社交机器人导航的社会适应性与导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06073 2026-03-09 cs.RO cs.AI 81%

Lifelong Embodied Navigation Learning

持续性具身导航学习

Xudong Wang, Jiahua Dong, Baichen Liu, Qi Lyu, Lianqing Liu, Zhi Han

机构 * State Key Laboratory of Robotics and Intelligent Systems(机器人与智能系统国家重点实验室) Shenyang Institute of Automation(沈阳自动化研究所) Chinese Academy of Sciences(中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 Uni-Walker通过分解导航知识为共享和特定组件,解决持续性具身导航学习中的灾难性遗忘问题,提升导航代理的持续学习能力。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03745 2026-03-05 cs.AI cs.RO 81%

RAGNav: A Retrieval-Augmented Topological Reasoning Framework for Multi-Goal Visual-Language Navigation

RAGNav: 一种结合检索与拓扑推理的多目标视觉语言导航框架

Ling Luo, Qiangian Bai

机构 * Southwestern University of Finance(西南财经大学) Department of Informatics,Universitat Hamburg, Hamburg, Germany(汉堡大学信息学院) University of Electronic Science(电子科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 RAGNav通过双基记忆系统和拓扑邻居评分传播机制,提升多目标视觉语言导航任务中目标可达性推理和顺序规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03739 2026-03-05 cs.CV cs.AI 81%

PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation

PROSPECT:通过语义-空间融合和潜在预测表示实现统一的流式视觉-语言导航

Zehua Fan, Wenqi Lyu, Wenxuan Song, Linge Zhao, Yifei Yang, Xi Wang, Junjie He, Lida Huang, Haiyan Liu, Bingchuan Sun, Guangjun Bao, Xuanyao Mao, Liang Xu, Yan Wang, Feng Gao

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) University of Adelaide(阿德莱德大学) Wuhan University(武汉大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Jiaotong University(北京交通大学) AIR Wuxi Innovation Center, Tsinghua University(清华大学无锡创新中心) Lenovo(联想集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 PROSPECT通过语义-空间融合和潜在预测表示,实现统一的流式视觉-语言导航,提升环境动态和空间结构的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23937 2026-03-02 cs.RO cs.CV 81%

Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos

通过真实世界室内游览视频的多模态事件知识增强视觉语言导航

Haoxuan Xu, Tianfu Li, Wenbo Chen, Yi Liu, Xingxing Zuo, Yaoxian Song, Haoang Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学) Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(马尔代夫 bin Zayed 大学人工智能学院) Hangzhou City University(杭州城市学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于多模态事件知识的视觉语言导航增强方法,通过构建大规模时空知识图谱并结合层次检索机制,提升长视界推理和粗粒度指令处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23706 2026-03-02 cs.RO cs.CV 81%

A Reliable Indoor Navigation System for Humans Using AR-based Technique

基于AR技术的可靠室内导航系统

Vijay U. Rathod, Manav S. Sharma, Shambhavi Verma, Aadi Joshi, Sachin Aage, Sujal Shahane

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于AR技术的室内导航系统,利用Vuforia Area Target和A*算法提升导航精度与用户体验,适用于校园等有限空间,但需进一步优化NavMesh以适应大规模动态环境。

Comments 6 pages, 6 figures, 2 tables, Presented at 7th International Conference on Advances in Science and Technology (ICAST 2024-25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03472 2026-03-02 cs.RO cs.AI cs.MA 81%

Destination-to-Chutes Task Mapping Optimization for Multi-Robot Coordination in Robotic Sorting Systems

多机器人协同中的目的地到传送口任务映射优化

Yulun Zhang, Alexandre O. G. Barbosa, Federico Pecora, Jiaoyang Li

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于进化算法和混合整数线性规划的任务映射优化方法,用于提升多机器人分拣系统的吞吐量。

Comments Accepted to IEEE International Symposium on Multi-Robot and Multi-Agent Systems (MRS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11791 2026-02-26 cs.RO cs.LG 81%

Synthetic vs. Real Training Data for Visual Navigation

仿真与真实训练数据用于视觉导航

Lauri Suomela, Sasanka Kuruppu Arachchige, German F. Torres, Harry Edelman, Joni-Kristian Kämäräinen

机构 * Tampere University(塔尔基尔大学) Turku University of Applied Sciences(图尔库应用科学大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出了一种基于预训练视觉表示的导航策略,通过仿真训练提升了视觉导航性能,实验表明其在导航成功率上优于真实数据训练和现有方法。

Comments ICRA2026 Camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15836 2026-02-19 cs.RO cs.AI 81%

EdgeNav-QE: QLoRA Quantization and Dynamic Early Exit for LAM-based Navigation on Edge Devices

EdgeNav-QE: QLoRA量化与动态提前退出用于边缘设备上的基于LAM的导航

Mengyun Liu, Shanshan Huang, Jianan Jiang

机构 * Guangzhou University(广州大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 EdgeNav-QE通过QLoRA量化和动态提前退出机制优化LAMs在边缘设备上的实时导航性能,显著降低延迟和内存占用,同时保持高导航成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07101 2026-02-19 cs.CV cs.RO 81%

Zero-Shot UAV Navigation in Forests via Relightable 3D Gaussian Splatting

通过可重照明的3D高斯点散布实现森林中的零样本无人机导航

Zinan Lv, Yeqian Qian, Chen Sang, Hao Liu, Danping Zou, Ming Yang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种基于可重照明3D高斯点散布的端到端强化学习框架,实现无人机在复杂森林环境中的零样本导航,具备对光照变化的强鲁棒性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15724 2026-02-18 cs.CV cs.AI 81%

Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation

学习高效视觉-语言导航中的可导航候选检索

Shutian Gu, Chengkai Huang, Ruoyu Wang, Lina Yao

机构 * University of New South Wales, Sydney, Australia(新南威尔士大学) Macquarie University, Sydney, Australia(麦考瑞大学) Data61, CSIRO, Sydney, Australia(Data61, CSIRO) The School of Computer Science(计算机科学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 本文提出检索增强框架,通过指令级示例检索和候选剪枝提升LLM在视觉-语言导航中的效率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12159 2026-02-13 cs.RO cs.AI 81%

3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting

3DGSNav: 通过主动3D高斯散射增强视觉-语言模型的物体导航

Wancai Zheng, Hao Chen, Xianlong Lu, Linlin Ou, Xinyi Yu

机构 * Zhejiang University of Technology, Hangzhou, China(浙江工业大学,杭州,中国) Zhejiang University, Hangzhou, China(浙江大学,杭州,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 3DGSNav通过主动3D高斯散射提升视觉-语言模型的物体导航能力,结合结构化视觉提示和链式推理,实现高效且可靠的导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07555 2026-02-10 cs.CV cs.AI 81%

VISOR: VIsual Spatial Object Reasoning for Language-driven Object Navigation

VISOR:基于语言驱动的对象导航的视觉空间对象推理

Francesco Taioli, Shiping Yang, Sonia Raychaudhuri, Marco Cristani, Unnat Jain, Angel X Chang

机构 * Polytechnic of Turin(都灵理工大学) Simon Fraser University(Simon Fraser大学) University of Verona(威尼斯大学) University of Reykjavik(雷克雅未克大学) University of California, Irvine(加州大学尔湾分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 VISOR提出了一种紧凑的3B参数VLA智能体,通过显式图像基础推理实现人类般的具身推理,提升对象识别和动作选择的可解释性、泛化能力和导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06427 2026-02-09 cs.CV cs.RO 81%

Bridging the Indoor-Outdoor Gap: Vision-Centric Instruction-Guided Embodied Navigation for the Last Meters

弥合室内外差距:基于视觉的指令引导的具身导航用于最后几米

Yuxiang Zhao, Yirong Yang, Yanqing Zhu, Yanfen Shen, Chiyu Wang, Zhining Gu, Pei Shi, Wei Guo, Mu Xu

机构 * AMAP CV Lab, Alibaba Group(AMAP CV实验室,阿里巴巴集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种无先验的指令驱动具身导航方法,通过视觉引导实现室内外无缝过渡,提升最后一公里配送的导航能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05827 2026-02-06 cs.CV cs.RO 81%

Sparse Video Generation Propels Real-World Beyond-the-View Vision-Language Navigation

稀疏视频生成推动现实世界超越视界视觉语言导航

Hai Zhang, Siqi Liang, Li Chen, Yuxian Li, Yukuan Xu, Yichao Zhong, Fu Zhang, Hongyang Li

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出SparseVideoNav,通过稀疏视频生成实现现实世界超越视界导航,显著提升导航效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20831 2026-01-29 cs.AI cs.RO 81%

MemCtrl: Using MLLMs as Active Memory Controllers on Embodied Agents

MemCtrl: 使用 MLLMs 作为具身智能体的主动内存控制器

Vishnu Sashank Dorbala, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学 College Park分校)

专题命中 具身导航 :embodied agent(title,abstract);分类 cs.RO、cs.AI

AI总结 MemCtrl 通过使用 MLLMs 的可训练内存头 μ 实现在线内存修剪,提升具身智能体在复杂指令下的任务完成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16424 2026-01-26 cs.RO cs.AI 81%

RENEW: Risk- and Energy-Aware Navigation in Dynamic Waterways

RENEW: 动态水道中风险和能耗感知的导航

Mingi Jeong, Alberto Quattrini Li

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 RENEW通过结合风险和能耗感知策略,实现动态水道中自主水面车辆的稳健导航,首次解决自适应不可航行性和拓扑路径多样性问题。

Comments 9 pages, 10 figure, 4 tables, AAAI 2026 (main track; oral acceptance)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15802 2026-01-23 cs.RO cs.AI 81%

A Beacon Based Solution for Autonomous UUVs GNSS-Denied Stealthy Navigation

基于信标的一种自主水下无人航行器(UUV)在GNSS受限环境下的隐蔽导航方案

Alexandre Albore, Humbert Fiorino, Damien Pellier

机构 * French National Research Agency(法国国家研究署)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究提出了一种基于信标的自主UUV在GNSS受限环境下实现隐蔽导航的方案,通过分层规划器和合成地标网络实现精确路径导航。

Comments 8 pages. IEEE TechDefense 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12742 2026-01-21 cs.RO cs.AI 81%

AirHunt: Bridging VLM Semantics and Continuous Planning for Efficient Aerial Object Navigation

AirHunt: 通过融合视觉语言模型语义与连续规划实现高效空中物体导航

Xuecheng Chen, Zongzhuo Liu, Jianfa Ma, Bang Du, Tiantian Zhang, Xueqian Wang, Boyu Zhou

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Mechanical and Energy Engineering, Southern University of Science and Technology(南方科技大学机械与能源工程系) Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Department of Physics, Southern University of Science and Technology(南方科技大学物理系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 AirHunt通过融合视觉语言模型语义与连续规划,实现高效空中物体导航,提升开放集物体定位的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12538 2026-01-21 cs.RO cs.LG 81%

EmoBipedNav: Emotion-aware Social Navigation for Bipedal Robots with Deep Reinforcement Learning

EmoBipedNav:基于深度强化学习的具有情绪感知的双足机器人社交导航

Wei Zhu, Abirath Raju, Abdulaziz Shamsah, Anqi Wu, Seth Hutchinson, Ye Zhao

机构 * Laboratory for Intelligent Decision and Autonomous Robots, Woodruff School of Mechanical Engineering, Georgia Institute of Technology(智能决策与自主机器人实验室,伍德鲁夫机械工程学院,佐治亚理工学院) College of Engineering and Petroleum, Kuwait University(工程与石油学院,科威特大学) School of Computational Science and Engineering, Georgia Institute of Technology(计算科学与工程学院,佐治亚理工学院) Khoury College of Computer Sciences, Northeastern University(计算机科学学院,东北大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 EmoBipedNav通过深度强化学习实现双足机器人在社交环境中的情绪感知导航,结合运动约束与社交动态,提升安全性和交互效率。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08161 2026-01-14 cs.RO cs.CV 81%

Robust Subpixel Localization of Diagonal Markers in Large-Scale Navigation via Multi-Layer Screening and Adaptive Matching

通过多层筛选和自适应匹配实现大尺度导航中对角标记的鲁棒子像素定位

Jing Tao, Banglei Guan, Yang Shang, Shunkun Liang, Qifeng Yu

机构 * College of Aerospace Science and Engineering(航空航天科学与工程学院) National University of Defense Technology(国防科技大学) Hunan Provincial Key Laboratory of Image Measurement and Vision Navigation(湖南省图像测量与视觉导航重点实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种多层筛选与自适应匹配相结合的方法,用于大尺度导航中实现对角标记的鲁棒子像素定位。

Comments This paper has been accepted by Applied Optics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12203 2026-01-13 cs.RO cs.CV 81%

Navigation Around Unknown Space Objects Using Visible-Thermal Image Fusion

利用可见光与热红外图像融合进行未知空间物体的导航

Eric J. Elias, Michael Esswein, Jonathan P. How, David W. Miller

机构 * Draper Scholar, Department of Aeronautics and Astronautics, Massachusetts Institute of Technology(麻省理工学院航空航天系) Senior Member of Technical Staff, The Charles Stark Draper Laboratory Inc.(查尔斯·斯塔克·德拉珀实验室公司) Ford Professor of Engineering, Department of Aeronautics and Astronautics, Massachusetts Institute of Technology(麻省理工学院航空航天系) Professor Post Tenure, Department of Aeronautics and Astronautics, Massachusetts Institute of Technology(麻省理工学院航空航天系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出利用可见光与热红外图像融合技术,提升在复杂光照条件下对未知空间物体的导航精度。

Comments 18 pages, 11 figures. To be published in proceedings of AIAA SCITECH 2026 Forum

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04699 2026-01-09 cs.RO cs.AI 81%

SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning

SeqWalker: 基于分层规划的序列地平线视觉-语言导航

Zebin Han, Xudong Wang, Baichen Liu, Qi Lyu, Zhenduo Shang, Jiahua Dong, Lianqing Liu, Zhi Han

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 SeqWalker通过分层规划框架解决多任务视觉-语言导航中的信息过载问题,通过高层规划减少认知负荷,低层规划利用指令逻辑结构校正轨迹误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18539 2026-01-07 cs.CV cs.RO 81%

AdaVLN: Towards Visual Language Navigation in Continuous Indoor Environments with Moving Humans

AdaVLN: 向具有移动人类的连续室内环境中的视觉语言导航迈进

Dillon Loh, Tomasz Bednarz, Xinxing Xia, Frank Guan

机构 * Hiverlab Pte. Ltd.(Hiverlab公司) NVIDIA(NVIDIA公司) Shanghai University(上海大学) Singapore Institute of Technology(新加坡科技学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 AdaVLN通过引入动态人类障碍物和冻结时间机制,提升机器人在连续室内环境中的视觉语言导航能力,以缩小仿真与现实的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02125 2026-01-06 cs.RO cs.AI 81%

SingingBot: An Avatar-Driven System for Robotic Face Singing Performance

SingingBot: 一种由虚拟角色驱动的机器人面部歌唱表演系统

Zhuoxiong Xu, Xuanchen Li, Yuhao Cheng, Fei Xu, Yichao Yan, Xiaokang Yang

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 SingingBot通过虚拟角色驱动框架实现机器人面部歌唱的丰富情感表达,提出情感动态范围指标评估情感广度,实验表明其在情感表现和同步性方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏