arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-22 至 2026-05-22 共收录 64 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 24 篇

2605.21811 2026-05-22 cs.RO 88%

Safe and Steerable Geometric Motion Policies for Robotic Dexterous Manipulation

安全且可操控的几何运动策略用于机器人灵巧操作

Albert Wu, Riccardo Bonalli, Thomas Lew, C. Karen Liu

机构 * Computer Science Department, Stanford University(斯坦福大学计算机科学系) Laboratory of Signals and Systems, University of Paris-Saclay, CNRS, CentraleSupélec(巴黎-萨克雷大学信号实验室,CNRS,CentraleSupélec) Toyota Research Institute(丰田研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本研究提出SafePBDS框架,通过几何一致的方法计算最优且可证明安全的配置流形加速度,以实现机器人灵巧操作中的目标和约束的持续协调,并在模拟和Franka Panda-Allegro手平台上验证了其在灵巧抓取和手部重定向中的高效规划和安全保障。

Comments 24 pages, 10 figures, 5 tables. Project page and demo video: https://tml.stanford.edu/safe-pbds

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24681 2026-05-22 cs.RO 88%

Learning Human-Intention Priors from Large-Scale Human Demonstrations for Robotic Manipulation

从大规模人类示范中学习人类意图先验以用于机器人操作

Yifan Xie, YuAn Wang, Guangyu Chen, Jinkun Liu, Yu Sun, Wenbo Ding

机构 * Tsinghua University(清华大学) ByteDance(字节跳动)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);robot learning(abstract);分类 cs.RO

AI总结 本文提出MoT-HRA框架,通过大规模人类示范学习人类意图先验,用于机器人操作,通过构建HA-2.2M数据集和三个耦合专家提升动作合理性和鲁棒性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22283 2026-05-22 cs.RO 79%

Spatial Memory for Out-of-Vision Manipulation in Vision-Language-Action

视觉-语言-动作中视界外操作的空间记忆

Pengteng Li, Weiyu Guo, He Zhang, Tiefu Cai, Xiao He, Yandong Guo, Hui Xiong

机构 * Thrust of Artificial Intelligence, The Hong Kong University of Science(人工智能推动部,香港科学大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出SOMA框架,用于解决视觉-语言-动作模型中视界外操作的问题,通过构建持久的空间记忆,使模型能够超越当前视觉范围进行推理,提升任务成功率和操作行为质量。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06556 2026-05-22 cs.CR cs.AI 79%

Semantic Attacks on Tool-Augmented LLMs: Securing the Model Context Protocol Against Descriptor-Level Manipulation

对增强工具的语义攻击:保护模型上下文协议免受描述级操纵

Saeid Jamshidi, Arghavan Moradi Dakhel, Kawser Wazed Nafi, Foutse Khomh

机构 * SWAT Laboratory, Polytechnique Montréal(SWAT实验室,蒙特利尔理工学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI

AI总结 本文研究了通过工具描述符与外部工具交互的模型上下文协议(MCP)中存在的语义攻击问题,提出了一种分层防御方案,通过描述符完整性验证、预上下文语义审查和轻量级运行时防护机制,有效降低描述级操纵导致的不安全工具调用风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21976 2026-05-22 cs.RO 79%

TacO: Benchmarking Tactile Sensors for Object Manipulation

TacO: 用于物体操作的触觉传感器基准测试

Anya Zorin, Zilin Si, Myungsun Park, Junsung Park, Alexiy Buynitsky, Sachin Bhadang, Taejun Park, Sohee John Yoon, Yong-Lae Park, Oliver Kroemer, Zeynep Temel, Michael T. Tolley, Sha Yi, Xiaolong Wang

机构 * UC San Diego(圣迭戈大学) CMU(卡内基梅隆大学) SNU(首尔国立大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种基于任务驱动的触觉传感器评估框架,通过训练不同模态的触觉传感器(视觉、声学、磁性和电阻性)在三个任务上的表现,探讨了触觉信息在不同材料和任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21948 2026-05-22 cs.LG 79%

SCI-Defense: Defending Manipulation Attacks from Generative Engine Optimization

SCI-Defense: 防御生成引擎优化的操纵攻击

Xucheng Yu, Haibo Jin, Huimin Zeng, Haohan Wang

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学与数据科学学院) School of Information Sciences, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校信息科学学院) Amazon topcited.ai(亚马逊topcited.ai)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.LG

AI总结 本文提出SCI-Defense框架,通过检测困惑度、语义完整性评分和跨候选检测三种组件,有效识别生成引擎优化攻击,实现了高精度和低误报率,同时揭示了现有防御方法的局限性及未来研究方向。

Comments 20 pages, NeurIPS 2026 submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06795 2026-05-22 cs.GR cs.HC 78%

Squidgets: Sketch-based Widget Design for Scene Manipulation

Squidgets: 基于草图的控件设计用于场景操控

Joonho Kim, Fanny Chevalier, Karan Singh

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文提出了一种基于草图的UI框架Squidgets,用于直接操控场景参数,通过用户绘制的草图自动执行场景变化,展示了在Maya 3D动画系统中的实现及实验结果。

Journal ref Proceedings of the 38th Annual ACM Symposium on User Interface Software and Technology 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21704 2026-05-22 cs.RO cs.SY eess.SY 70%

Motion Design for Grasp-Based Dynamic Locomotion in Microgravity

微重力环境下基于抓取的动态移动运动设计

Chaerim Moon, Joohyung Kim, Justin K. Yim

机构 * Department of Mechanical Science and Engineering at the University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校机械科学与工程系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文针对微重力环境下多肢体机器人系统基于抓取的动态移动问题,提出了一种可参数化的移动规划框架,通过调整步态模式、步长、移动速度和名义姿态等参数,评估其在稳定性和驱动需求方面的性能。研究结果表明,扩大可行接触力空间并抑制脉冲全身动力学可提升移动性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22597 2026-05-22 cs.LG cs.AI cs.GR cs.RO 67%

MoSA: Motion-constrained Stress Adaptation for Mitigating Real-to-Sim Gap in Continuum Dynamics via Learning Residual Anisotropy

MoSA: 通过学习残余各向异性来缓解连续动力学中现实到模拟差距的运动约束应力适应

Jiaxu Wang, Junhao He, Jingkai Sun, Yi Gu, Yunyang Mo, Jiahang Cao, Qiang Zhang, Renjing Xu

机构 * Hong Kong University of Science(香港科学大学) MMLab, Chinese University of Hong Kong, Hong Kong SAR(香港中文大学MMLab, 香港特别行政区) The University of Hong Kong, Hong Kong SAR(香港大学, 香港特别行政区)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出MoSA框架,通过运动约束应力适应来缓解连续动力学中现实到模拟差距,利用各向同性模型作为物理先验,并学习残余应力算子以捕捉轻微各向异性和非均匀性,最终在机器人操作中验证了其有效性。

Journal ref International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05307 2026-05-22 cs.CV cs.RO 62%

4D Radar Semantic Segmentation of People in Field Conditions Using Temporal Multi-View Networks

利用时序多视角网络进行野外条件下4D雷达的人体语义分割

Mikael Skog, Oleksandr Kotlyar, Vladimír Kubelka, Martin Magnusson

机构 * Center for Advanced Autonomous Sensor Systems (AASS)(先进自主传感器系统中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出TMVA4D网络,利用4D雷达数据进行人体语义分割,通过多视角投影区分背景与人体,在低能见度条件下实现75.9%的Dice系数和61.2%的IoU指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22021 2026-05-22 cs.RO 61%

Industrial Dual-Arm Box Handling via Online Inertial Estimation and Convex Wrench Optimization

工业双臂箱体搬运 via 在线惯性估计和凸 wrench 优化

Kenzhi Iskandar Wong, Lin Yang, Qian Ying Lee, Domenico Campolo

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种摩擦感知的双臂箱体搬运框架,用于处理具有未知惯性特性的物体。通过在线估计物体质量和质心,并利用二次锥规划在椭球摩擦限制表面约束下计算摩擦可行的接触力和扭距,从而实现稳定的搬运。

Comments 14 pages, submitted to Robotics and Computer-Integrated Manufacturing (RCIM) Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22438 2026-05-22 stat.ML cs.GT cs.LG 57%

Do Not Trust The Auctioneer: Learning to Bid in Feedback-Manipulated Auctions

不要相信拍卖师:在反馈操纵拍卖中学习出价

Luigi Foscari, Matilde Tullii, Vianney Perchet

机构 * Università degli Studi di Milano(米兰大学) Crest-Ensae(Ensae研究中心) IP Paris(巴黎研究所) CRITEO AI Team(CRITEO人工智能团队)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究在反馈操纵拍卖中学习出价的问题,提出一种结合鲁棒区间消除分支和乐观分支的算法,以应对反馈操纵带来的挑战,并在单活跃区域情况下提供匹配下界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16672 2026-05-22 cs.AI cs.CL cs.CY 57%

CritiSense: Critical Digital Literacy and Resilience Against Misinformation

CritiSense: 关键数字素养与对抗虚假信息的韧性

Firoj Alam, Fatema Ahmad, Ali Ezzat Shahroor, Mohamed Bayan Kmainasi, Elisa Sartori, Giovanni Da San Martino, Abul Hasnat, Raian Ali

机构 * Qatar Computing Research Institute(卡塔尔计算研究所) University of Padova(帕多瓦大学) Hamad Bin Khalifa University(哈马德·本·卡西姆大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究提出CritiSense,一个多功能的移动媒体素养应用,通过短而互动的挑战提升用户识别操纵手段的能力,为多语言的预警告平台和微学习效果评估提供测试环境。

Comments resilience, disinformation, misinformation, fake news, propaganda

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21710 2026-05-22 cs.RO 57%

PGDG: Physically Grounded Data Generation for Robust Bimanual Policy Learning from a Single Demonstration

PGDG: 为从单个示范中学习鲁棒双臂策略而设计的物理基础数据生成

Cunxi Dai, Haoran Chang, Aditya Nisal, Rahul Kumar, Guofei Chen, Tao Chen, Yuzhe Qin, Guanya Shi

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Dexmate

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出PGDG,一种基于物理的数据生成框架,通过零样本校准扩展单个示范为包含物理上合理、成功和多样恢复行为的紧凑数据集,从而提升双臂操作中接触丰富的行为克隆性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14598 2026-05-22 cs.RO 57%

DSSP: Diffusion State Space Policy with Full-History Encoding

DSSP:具有完整历史编码的扩散状态空间策略

Zhiyuan Guan, Jianshu Hu, Han Fang, Yunpeng Jiang, Yize Huang, Shujia Li, Xiao Li, Yutong Ban

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出DSSP,一种基于扩散模型的状态空间策略,通过完整历史编码提升机器人操作任务中长周期任务的历史依赖性处理能力,实现了更高效的模型压缩和更小的模型规模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17623 2026-05-22 cs.CV cs.GR 57%

ViPS: Video-informed Pose Spaces for Auto-Rigged Meshes

ViPS: 为自动绑定网格的视频感知姿态空间

Honglin Chen, Karran Pandey, Rundi Wu, Matheus Gadelha, Yannick Hold-Geoffroy, Ayush Tewari, Niloy J. Mitra, Changxi Zheng, Paul Guerrero

机构 * Columbia University(哥伦比亚大学) University of Toronto(多伦多大学) Adobe Research(Adobe研究) University of Cambridge(剑桥大学) University College London(伦敦大学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文提出ViPS,一种通过视频扩散模型提取运动先验来发现自动绑定网格有效姿态分布的前馈框架,实现了对多样形状变化、逆向运动学和动画的关键帧生成的支持。

Comments Project page: https://honglin-c.github.io/vips/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22452 2026-05-22 cond-mat.mes-hall 50%

Transport Enhancement and In Situ Control of Electronic Correlation via Photoinduced Modulation Doping of van der Waals Heterostructures

通过光诱导调制掺杂增强输运并原位控制范德瓦尔异质结中的电子关联

Collin R. Sanborn, Son T. Le, Thuc T. Mai, Maria F. Munoz, Riccardo Torsi, Angela R. Hight Walker, Curt A. Richter, Samuel W. LaGasse, Aubrey T. Hanbicki, Adam L. Friedman

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过光诱导调制掺杂技术,在BN-石墨烯-BN-SiO2异质结中实现对二维材料器件载流子浓度的精确调控,并展示了通过该技术对石墨烯通道材料进行掺杂和光退火,从而实现对电子掺杂和散射的控制,利用Drude和Landauer输运模型分析输运特性,展示了在石墨烯中可逆地调节载流子迁移率和平均散射长度的能力,从而在器件中实现从扩散到准弹性输运的切换,并利用该技术对局部杂质的精确控制实现量子霍尔同位素铁磁态,证明了在范德瓦尔异质结中对载流子密度和电荷杂质的精确操控,提供了一种高可及性的方法来制造高质量器件以实现关联电子态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22382 2026-05-22 cond-mat.mtrl-sci cond-mat.other 50%

Antiferromagnetic Ordering Enhanced Magnetic Damping in Mn2Au/CoFeB Bilayers

反铁磁序增强的Mn2Au/CoFeB双层磁阻尼

Donghang Xie, Haozhe Wang, Zhe Zhang, Zishuang Li, Jiahua Lu, Ronghua Liu, Jun Du, Bo Liu, Yu Yan, Liang He, Jing Wu, Rong Zhang, Bo Liu, Tiejun Zhou, Yongbing Xu, Xuezhong Ruan

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过铁磁共振探讨了反铁磁体Mn2Au/CoFeB双层的磁动力学,发现反铁磁序增强了CoFeB层的磁阻尼系数α,并揭示了反铁磁-铁磁交换耦合在其中的作用。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22246 2026-05-22 physics.optics 50%

Single-pump hybrid nonlinearities in transparent conductors

透明导体中的单泵混合非线性效应

Wallace Jaffray, Sven Stengel, Alexandra Boltasseva, Vladimir M. Shalaev, Carlo Rizza, Domenico de Ceglia, Maria Antonietta Vincenti, Michael Scalora, Matteo Clerici, Marcello Ferrera

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过单个强近红外泵浦光激发透明导体,实现了内在带和跨带非线性效应,揭示了谐波产生而非直接多光子吸收是跨带非线性效应的来源,为超快光子操控提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02102 2026-05-22 cond-mat.quant-gas cond-mat.mes-hall nlin.PS 50%

Nonreciprocity Induced Fractional Nonlinear Thouless Pumping

非互易性诱导的分数非线性托尔塞斯泵浦

Yanqi Zheng, Kun Pu, Ligging Ren, Chenxi Bai, Zhaoxin Liang

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了非厄米特和非线性里希-梅尔模型中的非线性托尔塞斯泵浦,揭示了非厄米特参数如何诱导分数拓扑相,即使在传统线性方法预测的量化拓扑不变量存在的情况下。

Comments 12 pages, 5 figures

Journal ref Phys. Rev. A 113, 052209 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18479 2026-05-22 cs.PL cs.FL 50%

Formally Verified Linear-Time Invertible Lexing

形式验证的线性时间可逆词法分析

Samuel Chassot, Viktor Kunčak

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出ZipLex,一种形式验证的线性时间可逆词法分析框架,支持最长匹配语义。该框架通过验证记忆化确保词法分析线性时间,同时保证词法分析与打印互为逆操作,适用于JSON处理等实际应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22053 2026-05-22 cs.IT math.IT 50%

Stacked Intelligent Metasurface-Assisted Fluid Antenna Systems: Outage Probability

堆叠智能超材料辅助流体天线系统: outage 概率

Anastasios Papazafeiropoulos

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种新颖的联合SIM-FAS通信模型,通过SIM和FAS分别进行传输和接收,并利用块对角矩阵近似方法推导出 outage 概率的闭式表达式,优化SIM相移以最小化 outage,数值结果验证了分析的准确性并展示了相对于传统基准方案的显著性能提升。

Comments 5 pages, 3 figures, accepted in IEEE Signal Processing Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19076 2026-05-22 cond-mat.mtrl-sci cond-mat.mes-hall 50%

Nonperturbative Magnetic Orbital Hall Effect in Altermagnets

非微扰磁轨道霍尔效应在交替磁体中

Xukun Feng, Jin Cao, Lay Kee Ang, Shengyuan A. Yang, Cong Xiao, X. C. Xie

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了交替磁体中非微扰磁轨道霍尔效应,揭示了其在传统反铁磁体中被禁止而在所有十种旋磁拉乌类反铁磁体中普遍允许的特性,并展示了其在交替磁体中可与非相对论性自旋霍尔效应相媲美甚至更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16993 2026-05-22 cond-mat.mtrl-sci cond-mat.other 50%

Coherent terahertz control of metastable magnetization in FePS3

相干太赫兹控制FePS3中的亚稳磁化

Batyr Ilyas, Tianchuang Luo, Honglie Ning, Emil Vinas Bostrom, Alexander von Hoegen, Jaena Park, Junghyun Kim, Je-Geun Park, Angel Rubio, Nuh Gedik

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究通过太赫兹脉冲相干控制FePS3中的亚稳磁化,揭示了声子相干对磁序参数的非易失放大和抑制作用,为超快量子相控提供了新方法。

Comments A version with the Supplementary Information included. 37 pages, 4 Main figures and 5 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 9 篇

2605.21935 2026-05-22 cs.RO 84%

Learning to Evolve: Multi-modal Interactive Fields for Robust Humanoid Navigation in Dynamic Environments

学习进化:多模态交互场用于动态环境中的稳健双足机器人导航

Peifeng Jiang, Hong Liu, Jin Jin, Wenshuai Wang, Xia Li

机构 * State Key Laboratory of General Artificial Intelligence, Peking University, Shenzhen Graduate School(一般人工智能国家重点实验室,北京大学深圳研究生院) Oxford Robotics Institute, University of Oxford(牛津大学机器人研究所) Institute for Machine Learning, Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系机器学习研究所)

专题命中 具身导航 :navigation(title,abstract);manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出多模态交互场(MIF)系统,通过结合置信度感知的语义3D高斯溅射、差异触发的空间记忆更新和任务驱动的几何重建,在闭环感知-适应管道中实现稳健的双足机器人导航,显著提高了非静态环境中的重定位成功率并减少了语义内存足迹。

Comments Accepted by Robotics: Science and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22816 2026-05-22 cs.RO cs.CV 81%

AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation

AwareVLN: 基于自感知的视觉语言导航推理

Wenxuan Guo, Xiuwei Xu, Yichen Liu, Xiangyu Li, Hang Yin, Huangxing Chen, Wenzhao Zheng, Jianjiang Feng, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出AwareVLN框架,通过自感知推理机制实现端到端的视觉语言导航,解决了传统方法在理解代理、指令和场景关系上的不足,并在多个数据集上实现了优于现有方法的性能。

Comments Accepted to CVPR 2026. Project page: https://gwxuan.github.io/AwareVLN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22036 2026-05-22 cs.CV cs.AI 81%

GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation

GA-VLN: 用于高效视觉-语言导航的几何感知鸟瞰图表示

Jiahao Yang, Zihan Wang, Xiangyang Li, Xing Zhu, Yujun Shen, Yinghao Xu, Shuqiang Jiang

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Robbyant School of Computing, National University of Singapore(新加坡国立大学计算机学院) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 本文提出GA-VLN框架,通过引入几何感知的鸟瞰图表示(GA-BEV),整合显式和隐式几何信息,提升视觉-语言导航的效率和性能,实验表明其在仅使用导航数据的情况下取得了最先进的结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22508 2026-05-22 cs.RO cs.SY eess.SY 79%

Parallel OctoMapping: A Scalable Framework for Enhanced Path Planning in Autonomous Navigation

并行八叉树映射:一种用于自主导航中路径规划增强的可扩展框架

Yihui Mao, Tian Tan, Xuehui Shen, Warren E. Dixon, Rushikesh Kamalapurkar

机构 * Department of Mechanical and Aerospace Engineering, University of Florida(佛罗里达大学机械与航空航天工程系) Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系)

专题命中 具身导航 :navigation(title);robotics(abstract);分类 cs.RO

AI总结 本文提出并行八叉树映射(POMP),一种高效的基于八叉树的映射技术,通过在固定占用网格分辨率下优化自由空间表示,提升路径规划效率和成功率,特别是在复杂环境中。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22693 2026-05-22 cs.RO cs.AI 62%

Scout-Assisted Planning for Heterogeneous Robot Teams under Partially Known Environments

Scout-Assisted Planning for Heterogeneous Robot Teams under Partially Known Environments

Hoang-Dung Bui, Abhish Khanal, Raihan Islam Arnob, Gregory J. Stein

机构 * George Mason University(乔治·马歇尔大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种Scout-Assisted Planning框架,通过无人机主动收集环境信息来改进地面车辆的导航,通过信息增益引导的行动剪枝减少回溯成本,实验表明其在不同环境中能显著降低地面机器人旅行成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22814 2026-05-22 cs.LG 57%

Remember to be Curious: Episodic Context and Persistent Worlds for 3D Exploration

记住保持好奇:用于3D探索的片段上下文和持久世界

Lily Goli, Justin Kerr, Daniele Reda, Alec Jacobson, Andrea Tagliasacchi, Angjoo Kanazawa

机构 * University of Toronto(多伦多大学) UC Berkeley(加州大学伯克利分校) Wayve Vector Institute(向量研究所) Simon Fraser University(西蒙 Fraser大学)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本研究提出了一种基于好奇心驱动强化学习的方法,通过引入持久世界模型和片段上下文来解决3D环境中稀疏奖励长周期任务中的探索问题,实验表明该方法在HM3D数据集上优于基于强化学习的主动映射基线,并能泛化到Gibson和AI生成的世界。

详情

展开后加载摘要…

URL PDF HTML 收藏