arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-05 至 2026-03-05 共收录 72 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2603.03957 2026-03-05 cs.RO 80%

ArthroCut: Autonomous Policy Learning for Robotic Bone Resection in Knee Arthroplasty

ArthroCut:膝关节置换术中机器人骨切除的自主策略学习

Xu Lu, Yiling Zhang, Wenquan Cheng, Longfei Ma, Fang Chen, Hongen Liao

机构 * School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) Longwood Valley MedTech

专题命中 机器人学习 :robotic(title,abstract);分类 cs.RO;robotics(comments)

AI总结 ArthroCut通过结合术前和术中数据,实现膝关节置换术中骨切除的自主策略学习,提升机器人手术的自主性和可解释性。

Comments Accepted for publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 22 篇

2602.22056 2026-03-05 cs.RO cs.LG 88%

FlowCorrect: Efficient Interactive Correction of Generative Flow Policies for Robotic Manipulation

FlowCorrect: 高效的交互式生成流策略修正以提升机器人操作

Edgar Welte, Yitian Shi, Rosa Wolf, Maximillian Gilles, Rania Rayyes

机构 * Institute for Material Handling and Logistics (IFL), Karlsruhe Institute of Technology(物料处理与物流研究所,卡尔斯鲁厄技术大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);robotics(abstract);分类 cs.RO、cs.LG

AI总结 FlowCorrect通过交互式模仿学习在部署时高效修正生成流策略,提升机器人操作的成功率与效率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03798 2026-03-05 cs.RO 88%

Learning Surgical Robotic Manipulation with 3D Spatial Priors

利用3D空间先验学习手术机器人操作

Yu Sheng, Lidian Wang, Xiaomeng Chu, Jiajun Deng, Min Cheng, Yanyong Zhang, Bei Hua, Houqiang Li, Jianmin Ji

机构 * University of Science and Technology of China(中国科学技术大学) Tuodao Medical(图道医疗) Yale University(耶鲁大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出SST,一种端到端的视觉-运动策略,通过内窥镜图像中的3D空间线索提升手术机器人操作的3D空间意识,实现了复杂手术任务的高性能表现。

Comments CVPR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03960 2026-03-05 cs.RO cs.CV 84%

Structural Action Transformer for 3D Dexterous Manipulation

结构动作变换器用于3D灵巧操作

Xiaohan Lei, Min Wang, Bohong Weng, Wengang Zhou, Houqiang Li

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出结构动作变换器,通过结构化视角解决高自由度机械手的跨身体技能转移问题,实现更高效的灵巧操作。

Comments Accepted by CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04302 2026-03-05 cs.CV 79%

Motion Manipulation via Unsupervised Keypoint Positioning in Face Animation

通过无监督关键点定位实现面部动画中的运动操控

Hong Li, Boyu Liu, Xuhui Liu, Baochang Zhang

机构 * BUAA(北京航空航天大学) KAUST(卡塔尔大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出MMFA方法,通过无监督关键点定位解耦身份语义与运动信息,实现可控的面部动画生成与表达操控。

Comments 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04301 2026-03-05 cs.RO 79%

Compliant In-hand Rolling Manipulation Using Tactile Sensing

利用触觉感知的合规性手握滚动操作

Huan Weng, Yifei Chen, Kevin M. Lynch

机构 * Center for Robotics and Biosystems and the Department of Mechanical Engineering, Northwestern University(机器人与生物系统中心和机械工程系,西北大学) Northwestern Institute on Complex Systems (NICO)(复杂系统研究所(NICO))

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种基于触觉感知的多指机械手手握滚动操作方法,通过推导动力学方程和设计控制器实现对物体扭量的精确控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03836 2026-03-05 cs.RO 79%

SkillVLA: Tackling Combinatorial Diversity in Dual-Arm Manipulation via Skill Reuse

SkillVLA: 通过技能复用解决双臂操作中的组合多样性问题

Xuanran Zhai, Zekai Huang, Longyan Wu, Qianyou Zhao, Qiaojun Yu, Jieji Ren, Ce Hao, Harold Soh

机构 * National University of Singapore(国立新加坡大学) Beijing Zhongguancun Academy(北京中关村学院) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Smart Systems Institute, NUS(NUS智能系统研究所)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 SkillVLA通过技能复用解决双臂操作中的组合多样性问题,提升技能组合成功率至51%并在复杂任务中表现优异。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02468 2026-03-05 cs.RO 79%

A Novel Modular Cable-Driven Soft Robotic Arm with Multi-Segment Reconfigurability

一种具有多段重构能力的新型模块化电缆驱动软机器人臂

Moeen Ul Islam, Cheng Ouyang, Xinda Qi, Azlan Zahid, Xiaobo Tan, Dong Chen

机构 * Department of Agricultural and Biological Engineering, Mississippi State University(农业与生物工程系,密苏里州立大学) Department of Electrical and Computer Engineering, Michigan State University(电气与计算机工程系,密苏里州立大学) Texas A&M AgriLife Research and Extension Center in Dallas, Texas A&M University(德克萨斯A&M大学达拉斯分校农业与生命科学研究中心)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种具有多段重构能力的模块化电缆驱动软机器人臂,通过模块化堆叠显著扩展了工作空间,并探讨了硅胶刚度对性能的影响。

Comments 6 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08251 2026-03-05 cs.RO 79%

Aerial Manipulation with Contact-Aware Onboard Perception and Hybrid Control

具备接触感知的机载感知与混合控制的空中操作

Yuanzhu Zhan, Yufei Jiang, Muqing Cao, Junyi Geng

机构 * Department of Aerospace Engineering, Pennsylvania State University(宾夕法尼亚州立大学航空航天工程系) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种无需外部运动捕捉的机载感知与混合控制方法,实现了接触丰富任务的精准运动跟踪和稳定接触力控制。

Comments 8 pages, 7 figures. Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18979 2026-03-05 cs.RO cs.CV 79%

Category-Level Object Shape and Pose Estimation in Less Than a Millisecond

小于毫秒内的类别级物体形状和姿态估计

Lorenzo Shaikewitz, Tim Nguyen, Luca Carlone

机构 * Massachusetts Institute of Technology(麻省理工学院) Laboratory for Information and Decision Systems(信息与决策系统实验室) Boston University(波士顿大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种快速求解器,通过自一致场迭代在毫秒级时间内实现类别级物体形状和姿态估计,结合线性主动形状模型和最大后验优化,提供高效的全局最优性证书。

Comments Accepted to ICRA 2026. This version contains appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03605 2026-03-05 cs.HC 78%

Inline Visualization and Manipulation of Real-Time Hardware Log for Supporting Debugging of Embedded Programs

实时硬件日志的内联可视化与操作以支持嵌入式程序调试

Andrea Bianchi, Zhi Lin Yap, Punn Lertjaturaphat, Austin Z. Henley, Kongpyung Justin Moon, Yoonji Kim

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 Inline工具通过在代码中实时显示硬件日志,提供执行流程跟踪和日志操作语言,帮助提高嵌入式程序调试效率。

Comments 26 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17896 2026-03-05 cs.CV cs.AI 73%

EgoWorld: Translating Exocentric View to Egocentric View using Rich Exocentric Observations

EgoWorld:利用丰富的外参照观测将外参照视角转换为自身参照视角

Junho Park, Andrew Sangwoo Ye, Taein Kwon

机构 * AI Lab, LG Electronics(LG电子人工智能实验室) KAIST(韩国科学技术院) Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.AI、cs.CV

AI总结 EgoWorld通过重建丰富的外参照观测来实现外参照到自身参照视角的转换,展示了在增强现实、虚拟现实和机器人应用中的先进性能和鲁棒性。

Comments Accepted by ICLR 2026. Project Page: https://redorangeyellowy.github.io/EgoWorld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04338 2026-03-05 cs.CV 57%

ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors

ArtHOI: 通过视频先验进行4D重建的可变形人-物交互合成

Zihao Huang, Tianqi Liu, Zhaoxi Chen, Shaocong Xu, Saining Zhang, Lixing Xiao, Zhiguo Cao, Wei Li, Hao Zhao, Ziwei Liu

机构 * School of AIA, Huazhong University of Science and Technology(华中科技大学人工智能学院) the S-Lab, Nanyang Technological University (NTU)(南洋理工大学S实验室) the Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) Zhejiang University (ZJU)(浙江大学) the Institute for AI Industry Research (AIR), Tsinghua University (THU)(清华大学人工智能产业研究院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 ArtHOI通过4D重建从视频先验生成可变形人-物交互,提升接触精度和物理合理性。

Comments Project Page: https://arthoi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03099 2026-03-05 cs.RO 57%

Point2Act: Efficient 3D Distillation of Multimodal LLMs for Zero-Shot Context-Aware Grasping

Point2Act: 多模态大语言模型的高效3D蒸馏用于零样本情境感知抓取

Sang Min Kim, Hyeongjun Heo, Junho Kim, Yonghyeon Lee, Young Min Kim

机构 * Seoul National University(首尔国立大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 Point2Act通过多模态大语言模型高效蒸馏实现零样本情境感知抓取,生成空间定位响应以支持实际操作任务。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03587 2026-03-05 stat.ME cs.LG stat.ML 57%

Controllable Generative Sandbox for Causal Inference

可控制的生成沙盒用于因果推断

Qi Zhang, Harsh Parikh, Ashley Naimi, Razieh Nabi, Christopher Kim, Timothy Lash

机构 * Emory University(埃默里大学) Yale University(耶鲁大学) Amgen(安进公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 CausalMix是一种结合高斯潜在先验与数据类型特定解码器的变分生成框架,通过显式因果控制实现对因果机制的可控生成,适用于混合类型表格数据的高保真模拟及因果推断研究。

Comments 34 pages, 15 figures. Submitted to ICML 2026. Code available at https://github.com/zhangqiecho/causalmix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04267 2026-03-05 cs.CV 57%

UniLight: A Unified Representation for Lighting

UniLight: 一种统一的光照表示

Zitian Zhang, Iliyan Georgiev, Michael Fischer, Yannick Hold-Geoffroy, Jean-François Lalonde, Valentin Deschaintre

机构 * Université Laval(拉瓦尔大学) Adobe Research(Adobe研究)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 UniLight通过联合潜在空间统一多种光照表示,实现跨模态的光照特征提取与迁移,支持光照检索、环境映射生成和扩散模型中的光照控制。

Comments Project page: https://lvsn.github.io/UniLight

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03837 2026-03-05 physics.app-ph physics.optics 50%

Harnessing Selective State Space Models to Enhance Semianalytical Design of Fabrication-Ready Multilayered Huygens' Metasurfaces: Part I - Field-based Semianalytical Synthesis

利用选择性状态空间模型增强织物式设计的可制造多层海利格元表面:第一部分 - 基于场的半解析合成

Sherman W. Marcus, Natanel Nissan, Vinay K. Killamsetty, Ravi Yadav, Dan Raviv, Raja Giryes, Ariel Epstein

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种基于选择性状态空间模型的半解析方法,用于快速设计可制造的双极化透射海利格超材料表面,结合机器学习提升精度。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02931 2026-03-05 astro-ph.IM astro-ph.HE 50%

A signal dedispersion algorithm for imaging-based transient searches

一种用于基于成像的暂态搜索的信号去色散算法

Cristian Di Pietrantonio, Marcin Sokolowski, Christopher Harris, Danny C. Price, Randall Wayth

专题命中 机器人操作 :manipulation(abstract)

AI总结 STRIDE是一种新型去色散算法,通过流式处理方法减少内存需求,适用于低频成像暂态搜索。

Comments 16 pages, 7 figures, 2 tables. Submitting to Astronomy and Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22134 2026-03-05 cs.CR cs.SY eess.SY 50%

Secure Semantic Communications via AI Defenses: Fundamentals, Solutions, and Future Directions

通过AI防御实现安全语义通信:基础、解决方案与未来方向

Lan Zhang, Chengsi Liang, Zeming Zhuang, Yao Sun, Fang Fang, Xiaoyong Yuan, Dusit Niyato

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文综述了通过AI防御在语义通信中的安全问题,提出防御策略分类及安全效用权衡,探讨威胁模型与开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01664 2026-03-05 quant-ph 50%

Preparation of conditionally-squeezed states in qubit-oscillator systems

在量子谐振子系统中制备条件性压缩态

Marius K. Hope, Jonas Lidal, Francesco Massel

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出在量子谐振子系统中制备条件性压缩态的协议,并探讨其在量子纠错码中的应用及退相干下的鲁棒性。

Comments 7 pages, 4 figures

Journal ref Phys. Rev. Research 8, L012046 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05259 2026-03-05 cs.PL cs.CC cs.LO 50%

Reversible Computation with Stacks and "Reversible Management of Failures"

使用栈和“故障的可逆管理”进行可逆计算

Matteo Palazzo, Luca Roversi

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出SCORE语言,通过证明助手认证栈操作为全双射函数,实现可逆计算模型中项的全双射解释。

Comments In Proceedings LTT 2026, arXiv:2603.02912

Journal ref EPTCS 441, 2026, pp. 213-226

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05851 2026-03-05 cond-mat.mes-hall 50%

Gyroid ferromagnetic nanostructures in 3D magnonics

三维磁子学中gyroid铁磁纳米结构

Mateusz Gołębiewski, Maciej Krawczyk

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究探讨gyroid铁磁纳米结构在三维磁子学中的应用,揭示其在磁化纹理、自旋波模式局域化及可控传播方面的潜力。

Comments 47 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01870 2026-03-05 cs.MA cs.GT 50%

$\aleph$-IPOMDP: Mitigating Deception in a Cognitive Hierarchy with Off-Policy Counterfactual Anomaly Detection

$\aleph$-IPOMDP:通过非策略反事实异常检测缓解认知层级中的欺骗

Nitay Alon, Joseph M. Barnby, Stefan Sarkadi, Lion Schulz, Jeffrey S. Rosenschein, Peter Dayan

专题命中 机器人操作 :manipulation(abstract)

AI总结 $\aleph$-IPOMDP通过非策略反事实异常检测机制,缓解认知层级中的欺骗问题,提升博弈中的公平性和安全性。

Comments 28 pages, 12 figures

Journal ref Journal of Artificial Intelligence Research (JAIR), Volume 85, Article 14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 15 篇

2603.04225 2026-03-05 cs.RO 83%

AMP2026: A Multi-Platform Marine Robotics Dataset for Tracking and Mapping

AMP2026:多平台海洋机器人数据集用于跟踪与制图

Edwin Meriaux, Shuo Wen, David Widhalm, Zhizun Wang, Junming Shi, Mariana Sosa Guzmán, Kalvik Jakkala, Bennett Carley, Elias Sokolova, Yogesh Girdhar, Monika Roznere, Jason O'Kane, Junaed Sattar, Gregory Dudek

机构 * McGill University(麦吉尔大学) MILA - Quebec AI Institute(魁北克人工智能研究所) Université Paris-Saclay, CentraleSupélec(巴黎-萨克雷大学,中央超导学院) University of Minnesota(明尼苏达大学) Texas A&M University(德克萨斯阿姆斯特朗大学) Woods Hole Oceanographic Institution(伍兹霍尔海洋研究所) Binghamton University(宾厄姆顿大学)

专题命中 具身导航 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 AMP2026数据集通过多平台传感器采集,用于支持海洋环境中的多视角跟踪与制图研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03745 2026-03-05 cs.AI cs.RO 81%

RAGNav: A Retrieval-Augmented Topological Reasoning Framework for Multi-Goal Visual-Language Navigation

RAGNav: 一种结合检索与拓扑推理的多目标视觉语言导航框架

Ling Luo, Qiangian Bai

机构 * Southwestern University of Finance(西南财经大学) Department of Informatics,Universitat Hamburg, Hamburg, Germany(汉堡大学信息学院) University of Electronic Science(电子科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 RAGNav通过双基记忆系统和拓扑邻居评分传播机制,提升多目标视觉语言导航任务中目标可达性推理和顺序规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03739 2026-03-05 cs.CV cs.AI 81%

PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation

PROSPECT:通过语义-空间融合和潜在预测表示实现统一的流式视觉-语言导航

Zehua Fan, Wenqi Lyu, Wenxuan Song, Linge Zhao, Yifei Yang, Xi Wang, Junjie He, Lida Huang, Haiyan Liu, Bingchuan Sun, Guangjun Bao, Xuanyao Mao, Liang Xu, Yan Wang, Feng Gao

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) University of Adelaide(阿德莱德大学) Wuhan University(武汉大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Jiaotong University(北京交通大学) AIR Wuxi Innovation Center, Tsinghua University(清华大学无锡创新中心) Lenovo(联想集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 PROSPECT通过语义-空间融合和潜在预测表示,实现统一的流式视觉-语言导航,提升环境动态和空间结构的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03735 2026-03-05 cs.RO 80%

Characterization and Correlation of Robotic Snake Scale Friction and Locomotion Speed

机械蛇鳞摩擦特性及其运动速度的相关性

Umit Sen, Andri Mahegan, Gina Olson

机构 * Department of Mechanical and Industrial Engineering, University of Massachusetts(机械与工业工程系,马萨诸塞大学)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种新型伪皮肤设计,通过实验测量不同角度和表面下的摩擦特性,探讨摩擦比值与运动速度的关系,发现摩擦比值单独不足以预测蛇形机器人速度。

Comments Accepted for 9th IEEE-RAS International Conference on Soft Robotics (RoboSoft 2026), 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04329 2026-03-05 cs.RO 79%

Gaussian Mixture-Based Inverse Perception Contract for Uncertainty-Aware Robot Navigation

基于高斯混合的逆感知合同用于不确定性感知的机器人导航

Bingyao Du, Joonkyung Kim, Yiwei Lyu

机构 * Department of Computer Science, Columbia University(计算机科学系,哥伦比亚大学) Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出基于高斯混合的逆感知合同,通过联合椭球置信集表示不确定性,提升机器人导航的安全性和适应性。

Comments 8 pages, 5 figures. Accepted to ACC 2026 (American Control Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25191 2026-03-05 cs.RO 79%

SoraNav: Adaptive UAV Task-Centric Navigation via Zeroshot VLM Reasoning

SoraNav: 通过零样本VLM推理实现适应性无人机任务导向导航

Hongyu Song, Rishabh Dev Yadav, Cheng Guo, Wei Pan

机构 * Department of Computer Science, The University of Manchester(计算机科学系,曼彻斯特大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 SoraNav通过零样本VLM推理实现无人机任务导向导航,解决空间-语义差距问题,提升导航成功率与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19655 2026-03-05 cs.RO 79%

LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments

LaViRA: 语言-视觉-机器人动作翻译用于连续环境中的零样本视觉语言导航

Hongyu Ding, Ziming Xu, Yudong Fang, You Wu, Zixuan Chen, Jieqi Shi, Jing Huo, Yifan Zhang, Yang Gao

机构 * School of Computer Science, Nanjing University(南京大学计算机科学学院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 LaViRA通过分解动作层次结构,利用多模态大语言模型的优势,实现连续环境中零样本视觉语言导航的高效导航与泛化能力。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏