arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 304 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 304 篇

2407.09016 2026-07-10 cs.RO 版本更新 79%

Open-Vocabulary Object-Goal Navigation by Generalizing Semantic Mapping with Dense CLIP

通过用密集CLIP泛化语义映射实现开放词汇目标导航

Meng Wei, Chenyang Wan, Tai Wang, Yuqiang Yang, Wenzhe Cai, Yilun Chen, Hanqing Wang, Jiangmiao Pang, Xihui Liu

机构 * Shanghai AI Lab(上海人工智能实验室) The University of Hong Kong(香港大学) Zhejiang University(浙江大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究面向对象的实体导航任务,提出OVExp框架,利用密集CLIP模型展示基于语义地图的目标预测网络泛化能力,设计跨模态转移策略解决训练成本高问题,在ObjectNav基准上对未知目标有强大泛化能力。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18803 2026-07-03 cs.RO 版本更新 79%

Learning to Localize Reference Trajectories in Image-Space for Visual Navigation

学习在图像空间中定位参考轨迹用于视觉导航

Finn Lukas Busch, Matti Vahs, Quantao Yang, Jesús Gerardo Ortega Peimbert, Yixi Cai, Jana Tumova, Olov Andersson

机构 * Division of Robotics, Perception, and Learning(机器人、感知与学习 division) KTH Royal Institute of Technology(瑞典皇家理工学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出LoTIS模型,通过定位参考轨迹在机器人当前视图中的图像坐标,实现无需相机标定、位姿或机器人特定训练的跨实体视觉导航,在正向导航中成功率提升20-50个百分点,达到94-98%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06382 2026-07-01 cs.RO 版本更新 79%

Designing Privacy-Preserving Visual Perception for Robot Navigation Based on User Privacy Preferences

基于用户隐私偏好的机器人导航视觉感知设计

Xuying Huang, Sicong Pan, Delphine Reinhardt, Maren Bennewitz

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出以用户为中心的隐私保护视觉感知设计方法,通过用户研究发现用户偏好隐私保护的视觉抽象和低分辨率保存机制,并据此制定可配置的隐私政策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15614 2026-07-01 cs.RO 版本更新 79%

AION: Aerial Indoor Object-Goal Navigation Using Dual-Policy Reinforcement Learning

AION: 基于双策略强化学习的空中室内目标导航

Zichen Yan, Yuchen Hou, Shenao Wang, Yichao Gao, Rui Huang, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出AION,一种端到端双策略强化学习框架,解耦探索与目标到达行为,用于视觉空中目标导航,无需外部定位或全局地图,在AI2-THOR和IsaacSim中验证了优越性能。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16932 2026-06-26 cs.RO 版本更新 79%

BAT-Nav: Budget-Aware Arbitration and Termination for Long-Horizon Semantic Navigation

MORN: 为资源理性长周期导航的元认知目标-目标调节

Xi Lin, Kangyi Wu, Jiayi Li, Jiaqiao Tang, Qingrong He, Lin Zhao

机构 * LCSR Lab, Johns Hopkins University(约翰霍普金斯大学LCSR实验室) Xi’an Jiaotong University(西安交通大学) JD Explore Academy, Beijing, China(京东探索研究院,北京,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出MORN,一种基于双过程理论的元认知导航架构,通过引入资源理性机制,解决传统导航系统在长周期任务中因缺乏全局资源意识导致的资源浪费问题,提升了目标完成率和任务效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01461 2026-06-26 cs.CV 版本更新 79%

UltraStar: Semantic-Aware Star Graph Modeling for Echocardiography Navigation

UltraStar: 面向超声心动图导航的语义感知星图建模

Teng Wang, Haojun Jiang, Chenxi Li, Diwen Wang, Yihang Tang, Zhenguo Sun, Yujiao Deng, Shiji Song, Gao Huang

机构 * Department of Automation, BNRist, Tsinghua University, Beijing, China(自动化系、BNRist、清华大学、北京、中国) School of Automation, Beijing Institute of Technology, Beijing, China(自动化学院、北京理工大学、北京、中国) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院、北京、中国) Chinese PLA General Hospital, Beijing, China(中国人民解放军总医院、北京、中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 提出UltraStar方法,通过星图将探头导航从路径回归重构为基于锚点的全局定位,并采用语义感知采样策略选择代表性关键帧,有效处理噪声轨迹,在131万样本数据集上优于基线方法。

Comments Accepted to MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00990 2026-06-23 cs.RO 版本更新 79%

OSCAR: Obstacle Survival Curves for Adaptive Robot Navigation

OSCAR: 用于自适应机器人导航的障碍物生存曲线

Hshmat Sahak, Aoran Jiao, Nicholas Rhinehart, Tim Barfoot

机构 * University of Toronto(多伦多大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出OSCAR框架,利用生存模型学习障碍物清除时间分布,并通过图规划器动态调整等待与重路由的阈值,以减少导航时间。

Comments 8 pages main text, appendices included

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02878 2026-06-23 cs.RO cs.SY eess.SY 版本更新 79%

An Asynchronous Two-Speed Kalman Filter for Real-Time UUV Cooperative Navigation Under Acoustic Delays

一种用于声学延迟下实时UUV协同导航的异步双速卡尔曼滤波器

Shuyue Li, Miguel López-Benítez, Eng Gee Lim, Fei Ma, Qian Dong, Mengze Cao, Limin Yu, Xiaohui Qin

机构 * Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Suzhou Municipal Key Laboratory Broadband Wireless Access Technology(苏州市级宽带无线接入技术重点实验室) XJTLU-JITRI Academy(XJTLU-JITRI学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对水声通信延迟导致实时状态估计困难的问题,提出一种异步双速卡尔曼滤波器(TSKF),通过变分历史蒸馏(VHD)机制解耦估计过程,实现高频实时控制与延迟协同信息处理,在严重延迟下保持与批量优化方法相当的轨迹误差。

Comments 6 pages, 6 figures. Accepted for publication in the 2026 IEEE International Conference on Industrial Informatics (INDIN). \c{opyright} 2026 IEEE. Personal use of this material is permitted. See PDF for the full IEEE copyright notice

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12346 2026-06-23 cs.RO 版本更新 79%

Schur-MI: Fast Mutual Information for Robotic Information Gathering

Schur-MI:用于机器人信息收集的快速互信息

Kalvik Jakkala, Jason O'Kane, Srinivas Akella

机构 * Texas A&M University(德克萨斯农工大学) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 提出Schur-MI,利用迭代结构和Schur补分解将互信息计算复杂度从O(|V|^3)降至O(|A|^3),在真实测深数据集上实现最高12.7倍加速,并成功用于自主水面车辆的在线路径规划。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04907 2026-06-16 cs.RO 版本更新 79%

WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation

WAM-Nav:面向统一视觉导航的非对称潜在世界-动作建模

Ning Yang, Yan Huang, Kaiwen Peng, Ziheng He, Kai Wang, Cui Miao, Kailin Lyu, Guo Li, Xiaofeng Wang, Zheng Zhu, Jing Liu, Nianfeng Liu

机构 * Nanjing University(南京大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) FiveAges National University of Defense Technology(国防科技大学) Tsinghua University(清华大学) GigaAI

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出WAM-Nav,一种联合学习动作生成与潜在视觉预测的非对称扩散Transformer模型,通过共享扩散Transformer实现长时程动作与短时程视觉预测的联合扩散,并引入双流上下文条件机制和目标对齐模块,在统一策略下支持图像目标、点目标和无目标导航,在ClutterScenes和InternScenes基准上分别提升15.7%和3.3%的成功率,并在真实环境中实现85%的任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04988 2026-06-16 cs.RO cs.SY eess.SY 版本更新 79%

Intelligent Sailing Model for Open Sea Navigation

公海航行智能航行模型

Hanna Krasowski, Stefan Schärdinger, Murat Arcak, Matthias Althoff

机构 * University of California, Berkeley(加州大学伯克利分校) Technical University of Munich(慕尼黑技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出首个智能航行模型(ISM),模拟遵守海上交通规则的船舶,结合模型预测控制实现航点跟踪,在交互仿真中达到约97%的目标到达率且无碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05121 2026-06-12 eess.SY cs.RO cs.SY 版本更新 79%

Trojan Attacks on Neural Network Controllers for Robotic Systems

针对机器人系统神经网络控制器的木马攻击

Farbod Younesi, Walter Lucia, Amr Youssef

机构 * Concordia University(康科德大学) Concordia Institute for Information Systems Engineering(康科德信息系统工程研究所) Fonds de recherche du Québec – Nature et Technologies(魁北克自然与技术研究基金) National Cybersecurity Consortium(国家网络安全联盟)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 针对机器人神经网络控制器,设计轻量级并行木马网络,在特定触发条件下篡改控制指令,通过仿真验证攻击有效性。

Comments Paper submitted to the 2026 IEEE Conference on Control Technology and Applications (CCTA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02519 2026-06-09 cs.RO 版本更新 79%

IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?

IMAC-AgriVLN:农业视觉与语言导航智能体能否意识到指令错误?

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学) China Agricultural University-Sichuan Advanced Agricultural & Industrial Institute(中国农业大学-四川先进农业与工业研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对农业VLN中指令可能错误的问题,提出A2A-MI基准和IMAC模块,通过分析指令与前方图像判断并纠正错误,显著提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01205 2026-06-09 cs.RO 版本更新 79%

ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning

ImagineUAV:通过世界-动作建模和动力学规划实现空中视觉语言导航

Xuchen Liu, Jiawei Huang, Shihao Xia, Bingxi Liu, Jinqiang Cui, Jiankun Yang

机构 * Pengcheng Laboratory(鹏城实验室) School of Computer Science and Cyber Engineering(计算机科学与网络工程学院) Guangzhou University(广州大学) Southern University of Science and Technology(南方科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对无人机视觉语言导航中几何不一致和动力学失配问题,提出基于潜视频扩散模型的世界-动作建模框架,通过生成未来观测推断6自由度运动并规划无碰撞轨迹,以1.3B参数在基准和实际飞行中超越先前方法。

Comments Video demo: https://www.youtube.com/watch?v=Ng1alP0yhc0

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24528 2026-08-13 cs.CV cs.AI 版本更新 79%

CORE-3D: Context-aware Open-vocabulary Retrieval by Embeddings in 3D

CORE-3D: 基于嵌入的上下文感知开放词汇检索

Mohamad Amin Mirzaei, Pantea Amoie, Ali Ekhterachian, Matin Mirzababaei, Babak Khalaj

机构 * Department of Electrical Engineering, Sharif University of Technology(电气工程系,谢里夫大学)

专题命中 具身导航 :robotics(abstract);embodied AI(abstract);navigation(abstract);分类 cs.AI、cs.CV

AI总结 CORE-3D通过结合上下文感知的CLIP编码和渐进粒度细化,提升3D场景理解中开放词汇检索和语义分割的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26798 2026-08-05 physics.bio-ph cond-mat.soft cond-mat.stat-mech q-bio.MN 版本更新 78%

Navigation driven by bidirectional information transmission between sensing and actuation

由感知与执行之间双向信息传输驱动的导航

Avishek Das, Pieter Rein ten Wolde

专题命中 具身导航 :navigation(title,abstract)

AI总结 该研究通过解析模型提出行为状态方程(BESTs),证实感知与执行的双向信息传输是导航的组织原则,且经大肠杆菌趋化性模拟验证。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13814 2026-08-04 eess.IV eess.SP 版本更新 78%

Compact Convolutional Segmentation for Visual Landmark Extraction in GNSS-Denied UAV Navigation

一种深度卷积网络用于UAV导航的实时地标提取

Sude Ertan, Osman Tokluoglu, Mustafa Ozturk

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出一种深度卷积网络,用于在GNSS受限环境下通过无人机摄像头图像实时提取地标,以实现无人机导航。

Comments The paper has been accepted for presentation and publication at IEEE ASYU 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23324 2026-06-24 physics.bio-ph cond-mat.stat-mech q-bio.QM 版本更新 78%

Discrete turn strategies emerge in information-limited navigation

离散转向策略在信息受限导航中的涌现

Jose M. Betancourt, Matthew P. Leighton, Thierry Emonet, Benjamin B. Machta, Michael C. Abbott

专题命中 具身导航 :navigation(title,abstract)

AI总结 通过信息速率最大化框架,发现无方向信息时离散动作策略优于连续转向,并揭示了最优策略随信息量增加的系列相变。

Comments 7 pages, 4 figures, plus appendices. v2 has extended introduction, new figures, minor corrections

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08766 2026-06-24 physics.flu-dyn 版本更新 78%

Optimal navigation in two-dimensional flows: Control theory and reinforcement learning

二维流动中的最优导航:控制理论与强化学习

Vladimir Parfenyev

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究在二维流动中,受平流和自推进的智能体(如漂浮无人机)的最小时间路径问题,利用最优控制理论求解,并应用强化学习(Q学习和演员-评论家算法)设计鲁棒导航策略,在规则流中接近最优解,在湍流中偏差增大,且粗粒化训练可泛化至全流场。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22497 2026-06-11 cs.HC cs.NA math.NA 版本更新 78%

Catheter Monitoring in Intelligent Endovascular Navigation Systems: Interactive Simulations and Mixed Reality for Enhanced Navigational Awareness

智能血管内导航系统中的导管监测:用于增强导航意识的交互式模拟与混合现实

Veronica Ruozzi, Giovanni Battista Regazzo, Maria Chiara Palumbo, Wim-Alexander Beckers, Mouloud Ourak, Xiu Zhang, Francesca Perico, Alessandro Caimi, Emmanuel Vander Poorten, Emiliano Votta

专题命中 具身导航 :navigation(title,abstract)

AI总结 提出一种结合实时导管形状重建、交互式模拟和混合现实可视化的框架,通过有限元模型和传感器数据监测导管-血管相互作用,实验验证位移误差低于2.33毫米。

Comments Int J CARS (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23082 2026-06-09 q-bio.NC 版本更新 78%

Spatial navigation in preclinical Alzheimer's disease: A review

阿尔茨海默病前期阶段的空间导航:综述

Syrine Salouhou, Victor Gilles, Remi Vallée, Gillian T. Coughlan, Romain Bachelet, Michael Hornberger, Hugo Spiers, Antoine Coutrot, Antoine Garnier-Crussard

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文综述了阿尔茨海默病前期阶段空间导航的认知功能,探讨其与AD病理标志物如p-tau的相关性,提出空间导航任务作为早期检测高风险个体的敏感方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05964 2026-06-08 math.PR 版本更新 78%

Strong Solutions to SDEs with Supercritical Drift Arising in Navigation Problems

导航问题中超临界漂移随机微分方程的强解

Carlo Ciccarella

专题命中 具身导航 :navigation(title,abstract)

AI总结 针对极坐标下具有1/r型超临界奇异漂移的两种随机导航模型,通过路径论证证明了强存在性和路径唯一性,并研究了停止半径趋于零时的极限行为。

Comments 28 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21046 2026-07-08 cs.CV cs.AI 版本更新 76%

SpatialFly: Implicit 3D Prior-Guided Visual Reparameterization for Continuous UAV Vision-and-Language Navigation

SpatialFly:基于几何的表示对齐用于城市环境中无人机视觉与语言导航

Wen Jiang, Kangyao Huang, Li Wang, Wang Xu, Wei Fan, Jinyuan Liu, Shaoyu Liu, Hanfang Liang, Hongwei Duan, Bin Xu, Xiangyang Ji, Huaping Liu

机构 * School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Tsinghua University(清华大学) Department of Automation, Tsinghua University(清华大学自动化系) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) Jianghan University(江汉大学)

专题命中 具身导航 :navigation(title);分类 cs.AI、cs.CV

AI总结 本文提出SpatialFly框架,通过几何引导的2D表示对齐机制,解决无人机在复杂3D环境中的视觉与语言导航问题,实验表明其在路径对齐和运动稳定性方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06828 2026-06-23 cs.RO cs.AI 版本更新 76%

NeuPAN: Direct Point Robot Navigation with End-to-End Model-based Learning

NeuPAN: 基于端到端模型学习的直接点机器人导航

Ruihua Han, Shuai Wang, Shuaijun Wang, Zeqing Zhang, Jianjun Chen, Shijie Lin, Chengyang Li, Chengzhong Xu, Yonina C. Eldar, Qi Hao, Jia Pan

专题命中 具身导航 :navigation(title);分类 cs.RO、cs.AI

AI总结 提出NeuPAN,一种实时、高精度、无地图、易部署的机器人运动规划器,通过紧耦合感知-控制框架和端到端模型学习,直接处理原始点云生成无碰撞运动,避免感知到控制的误差传播。

Comments Accepted by TRO 2025; project website: https://hanruihua.github.io/neupan_project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23038 2026-07-07 cs.RO 版本更新 76%

MOSAIC: Modular Scalable Autonomy for Intelligent Coordination of Heterogeneous Robotic Teams

MOSAIC:异构机器人团队智能协作的模块化可扩展自主性

David Oberacker, Julia Richter, Philip Arm, Marvin Grosse Besselmann, Lennart Puck, William Talbot, Maximilian Schik, Sabine Bellmann, Tristan Schnell, Hendrik Kolvenbach, Rüdiger Dillmann, Marco Hutter, Arne Roennau

机构 * FZI Forschungszentrum für Informatik, Karlsruhe, Germany(弗赖堡信息研究中心,卡尔斯鲁厄,德国) Robotic Systems Lab (RSL), ETH Zürich, Zürich, Switzerland(机器人系统实验室(RSL),苏黎世联邦理工学院,苏黎世,瑞士) Machine Intelligence and Robotics Lab (MaiRo), Karlsruhe Institute for Technology (KIT), Karlsruhe, Germany(机器智能与机器人实验室(MaiRo),卡尔斯鲁厄技术学院(KIT),卡尔斯鲁厄,德国) European Space Agency (ESA), Noordwijk, Netherlands(欧洲航天局(ESA),诺德威克,荷兰)

专题命中 具身导航 :robotic(title);分类 cs.RO;robotics(comments)

AI总结 研究针对多机器人科学探索,提出MOSAIC框架,基于兴趣点统一任务抽象与多层自主性,依机器人能力动态分配任务,经模拟月球探测实验验证,可实现强鲁棒性、可扩展的多机器人科学探索。

Comments This work has been accepted for publication with the IEEE Transactions of Field Robotics Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12236 2026-08-13 cs.RO cs.AI cs.LG 版本更新 75%

TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning

TMRL: 差分时间步调节预训练实现高效策略微调的探索

Matthew M. Hong, Jesse Zhang, Anusha Nagabandi, Abhishek Gupta

机构 * University of Washington(华盛顿大学) Amazon FAR(亚马逊FAR)

专题命中 具身导航 :manipulation(abstract);robot policy(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出TMRL框架,通过结合行为克隆预训练与强化学习微调,解决预训练中动作分布狭窄的问题,提升机器人策略微调的样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18324 2026-06-16 cs.CV cs.AI cs.GR cs.LG stat.ML 版本更新 75%

Improved Baselines with Representation Autoencoders

改进的基于表示自动编码器的基线

Jaskirat Singh, Boyang Zheng, Zongze Wu, Richard Zhang, Eli Shechtman, Saining Xie

机构 * Adobe Research(Adobe研究院) ANU(澳大利亚国立大学) New York University(纽约大学)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文研究了基于表示自动编码器(RAE)的设计选择,发现三个见解,简化并改进了RAE。首先,研究了一种通用公式,将表示定义为最后k个编码器层的总和,而不是仅最终层。其次,研究了RAE与表示对齐(REPA)的假设,发现两者具有互补的工作机制。最后,改进了RAE在无分类器指导(CFG)中的表现,通过重新参数化DiT模型输出,实现了无需训练第二个模型的指导效果。RAEv2在ImageNet-256上达到了1.06的gFID,且训练效率显著提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16144 2026-07-15 cs.CV cs.RO 版本更新 74%

LEGO-SLAM: Language-Embedded Gaussian Optimization SLAM

LEGO-SLAM:语言嵌入的高斯优化SLAM

Sibaek Lee, Seongbo Ha, Kyeongsu Kang, Joonyeol Choi, Seungjun Tak, Hyeonwoo Yu

机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人系,成均馆大学)

专题命中 具身导航 :robotics(abstract,comments);robotic(abstract);分类 cs.RO、cs.CV

AI总结 研究将语言特征集成到基于3DGS的SLAM系统的问题,提出LEGO-SLAM框架,利用场景自适应自动编码器压缩语言嵌入,实现语言引导剪枝和回环检测,提升映射质量和跟踪精度,具备开放词汇能力且达15FPS。

Comments Project page :https://lab-of-ai-and-robotics.github.io/LEGO-SLAM/ Submitted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20679 2026-07-27 cs.RO 版本更新 74%

Towards Capability-Aware Traversability Navigation for Unstructured Environments

面向非结构化环境的能力感知可通行性导航

Gianluca Capezzuto, Felipe Tommaselli, Matheus P. Angarola, Ricardo V. Godoy, Marcelo Becker

机构 * University of São Paulo(圣保罗大学)

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 研究非结构化环境中可通行性估计,提出能力感知可通行性(CAT)框架,将物理限制嵌入空间特征空间,通过交互式标注和SPADE块改进可通行性预测,在多数据集上领先,实现实例感知避障。

Comments 8 pages, 7 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Project page: https://capability-aware-traversability.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00406 2026-08-14 eess.SP cs.LG cs.RO 版本更新 73%

LOCUS-DT: Localization via Observation-Conditioned Uncertainty Scoring with Digital Twins

LOCUS-DT:基于数字孪生的观测条件不确定性评分定位方法

Haozhe Lei, Roberto Bomfin, Marwa Chafii, Sundeep Rangan

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出LOCUS-DT框架,利用数字孪生和学习评分函数处理室内多径定位,泛化性好,在Sionna测试中比高斯类基准更精准捕捉多模态后验结构。

详情

展开后加载摘要…

URL PDF HTML 收藏