arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14009 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14009 篇

2605.20254 2026-08-18 cs.IR cs.AI cs.CV cs.LG 版本更新 82%

Efficient Table QA via TableGrid Navigation and Progressive Inference Prompting

通过表格网格导航和逐步推理提示实现高效的表格问答

Amritansh Maurya, Navjot Singh, Mohammed Javed, Omar Moured

机构 * Vision Intelligence Lab, IIIT Allahabad, Prayagraj, India(视觉智能实验室,印度拉贾斯坦邦阿拉哈巴德)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出了一种无需训练的表格问答方法,通过TableGrid导航和Progressive Inference Prompting框架,提升了表格问答的精度和效率,并在多个数据集上验证了其有效性。

Comments Accepted for Presentation in ICDAR 2026, Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07557 2026-08-11 cs.RO cs.AI cs.CV 新提交 82%

AeroDPO: Unleashing Lightweight UAV Navigation with High-Fidelity Perception and Automated Preference Optimization

AeroDPO:释放具备高保真感知与自动偏好优化的轻量级无人机导航能力

Peng Xu, Chengcheng Wang, Shaohua Wan

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出AeroDPO,通过高保真感知与自动偏好优化,使20亿参数轻量级无人机导航模型达到70亿参数模型的成功率,同时降低分布外场景碰撞率,成为自主空中智能体新SOTA。

Comments 7 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07542 2026-08-11 cs.AI cs.LG cs.MA cs.RO 新提交 82%

An AI Scientist that Doesn't Drift: Taste, Structure, and Falsifiable Findings in a Quadruped Navigation Research Loop

不会发生漂移的AI科学家:四足机器人导航研究循环中的偏好、结构与可证伪发现

Yiwen Zhang, Eloise Zeng, Jaeha Lee, Tony Yue Yu

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 该研究提出一款基于自研究范式的AI科学家,通过新增实验卡片、专门子智能体和偏好神谕kkanbu的组件,解决自主研究循环漂移问题,在四足机器人导航实验中验证了框架的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06134 2026-08-11 cs.HC 版本更新 82%

MAESTRO: Adapting GUIs and Guiding Navigation with User Preferences in Conversational Agents with GUIs

MAESTRO:在具有GUI的对话代理中通过用户偏好适应GUI并引导导航

Sangwook Lee, Adnan Abbas, Sang Won Lee, Young-Ho Kim, Yan Chen

专题命中 具身导航 :navigation(title,abstract)

AI总结 MAESTRO通过提取用户偏好并指导工作流导航,提升对话代理中GUI的适应性和导航效率,通过实验验证其有效性。

Comments 19 pages, 6 figures, 2 tables. Published at UIST '26. This is the camera-ready version, posted under CC BY 4.0

Journal ref Proceedings of the 39th Annual ACM Symposium on User Interface Software and Technology (UIST '26), November 2-5, 2026, Detroit, MI, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07267 2026-08-10 cs.AI cs.CV cs.RO 新提交 82%

WNM-3D: A World Navigation Model with 3D Scene Conditioning for Closed-Loop VLN

WNM-3D:一种用于闭环视觉语言导航的带3D场景条件的世界导航模型

Yuehao Huang, Yunzi Wu, Xiaotao Zhang, Xinhai Li, Jiankun Dong, Jiajun Lv, Chi Zhang, Chenjia Bai, Yong Liu, Xuelong Li

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究提出带3D场景条件的WNM-3D模型,通过几何编码器与适配器整合场景上下文,经多阶段训练后在GN-Bench等数据集上的闭环导航性能优于同类模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06558 2026-08-10 astro-ph.EP astro-ph.IM cs.IT math.IT 新提交 82%

Estimating Harmonic Coefficients of Asteroids through LiAISON Navigation

通过LiAISON导航估计小行星的调和系数

Jun Maruyama, Simone Servadio

专题命中 具身导航 :navigation(title,abstract)

AI总结 该研究在近两体小行星系统中评估LiAISON导航方法,采用集成UKF的MMAE框架,仅用测距和测距率测量,通过蒙特卡洛分析准确估计了谷神星、灶神星的位置、速度及摄动,验证了LiAISON在这类系统中的有效性。

Comments 20 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20743 2026-07-24 cs.RO cs.AI cs.LG 新提交 82%

Self-Supervised Bio-Inspired Robotic Trajectory Planning with Obstacle Avoidance

具有避障功能的自监督生物启发式机器人轨迹规划

Miroslav Krupa, Miroslav Cibula, Kristína Malinovská

机构 * Faculty of Mathematics, Physics and Informatics, Comenius University Bratislava(布拉迪斯拉发夸美纽斯大学数学、物理与信息学院)

专题命中 具身导航 :robotic(title);robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究机器人轨迹规划问题,提出基于自监督学习框架,利用正反模型作监督机制,在含障碍物环境下规划轨迹,实验证明方法可行,针对规划器问题提出并评估了额外训练机制和缓解策略。

Comments 12 pages, 3 figures. To be published in 2026 International Conference on Artificial Neural Networks (ICANN) proceedings. This research was supported by the Slovak Research and Development Agency, project APVV-21-0105

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10383 2026-07-20 cs.CV cs.AI cs.RO 版本更新 82%

ABot-N1: Toward a General Visual Language Navigation Foundation Model

ABot-N1:迈向通用视觉语言导航基础模型

Ruiyan Gong, Yingnan Guo, Junjun Hu, Jintao Kong, Xiaoxu Leng, Tianlun Li, Weize Li, Fei Liu, Zhicheng Liu, Jia Lu, Minghua Luo, Chenlin Ming, Yanfen Shen, Jiyue Tao, Zhengbo Wang, Mingyang Yin, Minqi Gu, Zihao Guan, Wei Guo, Guoqing Liu, Huachong Pang, Menglin Yang, Zeqian Ye, Xiaoxiao Geng, Zhining Gu, Honglin Han, Di Jing, Hongyu Pan, Mingchao Sun, Kuan Yang, Jianfang Zhang, Yanghong Chen, Ye He, Wei Mei, Jiahao Shi, Xiangpo Yang, Yanqing Zhu, Yang Cai, Jingjing Ma, Shihui Su, Zixiao Tang, Linbo Zheng, Zedong Chu, Xiaolong Wu, Wenbin Tang, Mu Xu

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究旨在构建通用视觉语言导航基础模型,针对当前方法问题,提出ABot-N1,通过慢-快架构解耦认知与控制,利用双视觉语言信号,实现跨场景稳健、可推广且可解释的导航,在城市规模导航等任务中表现出色并开源新基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18624 2026-07-17 cs.RO cs.AI cs.CV 版本更新 82%

REST: Receding Horizon Explorative Steiner Tree for Zero-Shot Object-Goal Navigation

REST:基于零样本目标导航的视界探索Steiner树

Shuqi Xiao, Maani Ghaffari, Chengzhong Xu, Hui Kong

机构 * State Key Laboratory of Internet of Things for Smart City, University of Macau(智能城市物联网国家重点实验室,澳门大学) University of Michigan(密歇根大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 REST通过构建开放词汇3D地图、生成以代理为中心的路径树以及利用LLM推理选择最佳路径,在多个基准测试中实现了高成功率和高效路径效率。

Comments Accepted to IROS'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18212 2026-06-23 cs.LG cs.AI cs.RO cs.SY eess.SY 82%

SCoTT: Strategic Chain-of-Thought Tasking for Wireless-Aware Robot Navigation in Digital Twins

SCoTT:面向数字孪生的无线感知机器人导航战略链式思维任务规划

Aladin Djuhera, Amin Seffo, Vlad C. Andrei, Holger Boche, Walid Saad

机构 * Technical University of Munich(慕尼黑技术大学) Virginia Tech(弗吉尼亚理工大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出SCoTT框架,利用视觉语言模型优化路径收益与轨迹长度,通过分解搜索问题提升无线约束下的路径规划效率,实验显示其性能接近最优动态规划算法且生成更短轨迹。

Journal ref Asilomar Conference on Signals, Systems, and Computers, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00222 2026-06-16 cs.RO cs.AI cs.CV 版本更新 82%

MapDream: Task-Driven Map Learning for Vision-Language Navigation

MapDream: 面向视觉-语言导航的任务驱动地图学习

Guoxin Lian, Shuo Wang, Yucheng Wang, Yongcai Wang, Maiyue Chen, Kaihui Wang, Bo Zhang, Zhizhong Su, Deying Li, Zhaoxin Fan

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出MapDream框架,通过自回归鸟瞰图生成联合学习地图与动作预测,在R2R-CE和RxR-CE上达到单目最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08992 2026-06-09 cs.RO cs.AI cs.CV 新提交 82%

SpaceVLN: A Zero-Shot Vision-and-Language Navigation Agent with Online Spatial Cognitive Memory and Reasoning

SpaceVLN:具有在线空间认知记忆与推理的零样本视觉与语言导航智能体

Yucheng Deng, Pingrui Lai, Xinhai Li, Chenjia Bai, Xiaoheng Deng, Chengnuo Sun, Xuelong Li, Hua Yang

机构 * Shanghai Jiao Tong University(上海交通大学) China Telecom(中国电信) Central South University(中南大学) Jiangsu University(江苏大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出SpaceVLN,通过空间认知记忆和任务引导的空间推理,在零样本设置下实现连续环境中的视觉与语言导航,在多个基准上达到最优性能。

Comments 23 pages, 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07244 2026-06-08 cs.RO cs.AI cs.CV 新提交 82%

Beyond Waypoints: A Trajectory-Centric Waypointing Paradigm for Vision-Language Navigation

超越航点:面向视觉语言导航的轨迹中心航点范式

Haoxiang Shi, Xiang Deng, Haoyu Zhang, Qiaohui Chu, Yaowei Wang, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出轨迹航点范式,通过TSDF引导的扩散策略预测可执行轨迹,解决VLN-CE中航点不可达与规划控制不一致问题,在基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19452 2026-06-01 cs.RO cs.CV cs.LG 82%

HUNT: High-Speed UAV Navigation and Tracking in Unstructured Environments via Instantaneous Relative Frames

HUNT:通过瞬时相对帧在非结构化环境中进行高速无人机导航与跟踪

Alessandro Saviolo, Jeffrey Mao, Giuseppe Loianno

机构 * New York University(纽约大学) University of California Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出HUNT框架,利用瞬时相对帧统一搜索与跟踪,实现高速飞行和鲁棒自主性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06807 2026-05-19 cs.RO cs.AI cs.LG 82%

SuReNav: Superpixel Graph-based Constraint Relaxation for Navigation in Over-constrained Environments

SuReNav:基于超像素图的约束放松用于过约束环境中的导航

Keonyoung Koh, Moonkyeong Jung, Samuel Seungsup Lee, Daehyung Park

机构 * School of Computing, Korea Advanced Institute of Science and Technology, Korea(韩国科学技术院计算机学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出SuReNav方法,通过超像素图构建区域约束,利用图神经网络实现安全高效导航,适用于半静态环境中过约束规划问题,提升导航的人类类比性能。

Comments Accepted by ICRA 2026. Code and videos are available at https://sure-nav.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06595 2026-05-08 cs.RO cs.AI cs.LG cs.MA 82%

Cross-Modal Navigation with Multi-Agent Reinforcement Learning

跨模态导航与多智能体强化学习

Shuo Liu, Xinzichen Li, Christopher Amato

机构 * Khoury College of Computer Sciences(计算机科学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出CRONA框架,通过多智能体强化学习实现跨模态导航,利用辅助信念和集中式多模态批评者提升协作效率,实验表明多智能体方法在视觉-听觉导航中优于单智能体基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01999 2026-04-30 cs.RO cs.CV cs.LG 82%

Learning Vision-Based Omnidirectional Navigation: A Teacher-Student Approach Using Monocular Depth Estimation

基于视觉的全方位导航学习:一种利用单目深度估计的教师-学生方法

Jan Finke, Wayne Paul Martis, Adrian Schmelter, Lars Erbach, Christian Jestel, Marvin Wiedemann

机构 * Fraunhofer Institute for Material Flow and Logistics(弗劳恩霍夫材料流与物流研究所) The Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔人工智能与机器学习研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出一种教师-学生框架,通过单目深度估计实现无需LiDAR的机器人导航,实验证明在复杂3D障碍物导航中优于传统2D LiDAR。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15391 2026-04-20 q-bio.QM 82%

Dual-Timescale Memory in a Spiking Neuron-Astrocyte Network for Efficient Navigation

双时间尺度记忆在尖峰神经元-胶质细胞网络中的应用:用于高效导航

Yuliya Tsybina, Evgenia Antonova, Sergey Shchanikov, Vsevolod Kulagin, Alexey Mikhaylov, Victor Kazantsev, Vyacheslav Demin, Susanna Gordleeva

专题命中 具身导航 :navigation(title,abstract);robotics(abstract)

AI总结 本文提出了一种结合神经元和胶质细胞动态的双时间尺度记忆机制,通过尖峰时间依赖性可塑性(STDP)和胶质细胞钙瞬变,实现高效导航,减少路径长度并提升目标完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01563 2026-04-10 cs.RO cs.AI cs.LG 82%

NaviSlim: Adaptive Context-Aware Navigation and Sensing via Dynamic Slimmable Networks

NaviSlim: 通过动态可缩放网络实现自适应的上下文感知导航与感知

Tim Johnsen, Marco Levorato

机构 * University of California, Irvine(加州大学尔湾分校) San Diego State University(圣地亚哥州立大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出NaviSlim模型,通过动态调整计算和感知资源,提升小型自主飞行器在复杂环境中的导航能力,实验显示模型复杂度减少57-92%,传感器利用率提升61-80%。

Comments 13 pages, 12 figures

Journal ref 2024 IEEE/ACM Ninth International Conference on Internet-of-Things Design and Implementation (IoTDI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07286 2026-04-09 cs.RO cs.AI cs.LG 82%

CADENCE: Context-Adaptive Depth Estimation for Navigation and Computational Efficiency

CADENCE:面向导航和计算效率的上下文自适应深度估计

Timothy K Johnsen, Marco Levorato

机构 * San Diego State University(圣地亚哥州立大学) University of California, Irvine(加州大学尔湾分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 CADENCE通过动态调整轻量级单目深度估计网络的计算复杂度,实现导航需求与环境上下文的闭环控制,降低能耗并提升导航精度。

Comments 7 pages, 7 figures, Accepted for publication at IEEE World AI IoT Congress (AIIoT) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29165 2026-04-01 cs.CV cs.AI cs.RO 82%

LatentPilot: Scene-Aware Vision-and-Language Navigation by Dreaming Ahead with Latent Visual Reasoning

LatentPilot: 通过潜意识视觉推理进行场景感知的视觉-语言导航

Haihong Hao, Lei Chen, Mingfei Han, Changlin Li, Dong An, Yuqiang Yang, Zhihui Li, Xiaojun Chang

机构 * University of Science and Technology of China(中国科学技术大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) Stanford University(斯坦福大学) Amap, Alibaba Group(阿里巴巴集团高德地图) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 LatentPilot通过利用未来观测作为训练数据源,学习动作条件的视觉动态,无需访问未来帧即可实现场景感知的视觉-语言导航,实验在多个基准上取得新SOTA结果。

Comments Project page:https://abdd.top/latentpilot/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26837 2026-03-31 cs.RO cs.AI cs.CV 82%

SpatialAnt: Autonomous Zero-Shot Robot Navigation via Active Scene Reconstruction and Visual Anticipation

SpatialAnt:通过主动场景重建与视觉预判实现自主零样本机器人导航

Jiwen Zhang, Xiangyu Shi, Siyuan Wang, Zerui Li, Zhongyu Wei, Qi Wu

机构 * Fudan University(复旦大学) University of Southern California(南加州大学) Adelaide University(阿德莱德大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 SpatialAnt通过主动场景重建和视觉预判机制,解决零样本机器人导航中自建场景的不完整和噪声问题,提升导航性能。

Comments 10 pages, 4 figures, 5 tables. Homepage: https://imnearth.github.io/Spatial-X/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25366 2026-03-27 cs.RO cs.AI cs.CV 82%

Integrating Deep RL and Bayesian Inference for ObjectNav in Mobile Robotics

深度强化学习与贝叶斯推断在移动机器人ObjectNav中的集成

João Castelo-Branco, José Santos-Victor, Alexandre Bernardino

机构 * Institute For Systems and Robotics(系统与机器人研究所)

专题命中 具身导航 :robotics(title);navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出结合贝叶斯推断与深度强化学习的混合对象搜索框架,通过在线更新空间信念图和训练导航策略,提升移动机器人在部分可观测环境中的搜索效率和可靠性。

Comments Accepted and to be published in the ICARSC 2026 26th IEEE International Conference on Autonomous Robot Systems and Competitions

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15624 2026-03-18 cs.CV cs.AI cs.RO 82%

Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision

探索视觉语言模型在帮助视障和低视力人士导航中的应用

Yu Li, Yuchen Zheng, Giles Hamilton-Fletcher, Marco Mezzavilla, Yao Wang, Sundeep Rangan, Maurizio Porfiri, Zhou Yu, John-Ross Rizzo

机构 * Columbia University(哥伦比亚大学) New York University(纽约大学) Politecnico di Milano(米兰理工大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文评估了多种VLMs在基础视觉技能和导航任务中的表现,发现GPT-4o在空间推理和场景理解上表现最佳,而开源模型在复杂环境中存在不足,需进一步改进以提升实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14363 2026-03-17 cs.CV cs.AI cs.RO 82%

AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control

AerialVLA:一种用于无人机导航的视觉-语言-动作模型 via 最小化端到端控制

Peng Xu, Zhengnan Deng, Jiayan Deng, Zonghua Gu, Shaohua Wan

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出AerialVLA,一种基于视觉-语言-动作的端到端控制模型,通过减少视觉冗余并整合连续3D运动指令与内在着陆信号,实现无人机自主导航。实验表明其在可见环境和未知场景中均表现优异。

Comments 18 pages, 4 figures. Code and demo videos will be available at: https://github.com/XuPeng23/AerialVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09961 2026-03-11 cs.RO cs.AI cs.CV 82%

BEACON: Language-Conditioned Navigation Affordance Prediction under Occlusion

BEACON: 语言条件下的遮挡区域导航可行性预测

Xinyu Gao, Gang Chen, Javier Alonso-Mora

机构 * Department of Cognitive Robotics (CoR), Delft University of Technology(认知机器人学系(CoR),代尔夫特理工大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 BEACON通过融合视觉语言模型与深度信息,提升遮挡区域导航可行性预测的准确性。

Comments 8 pages. Project page: https://xin-yu-gao.github.io/beacon

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08173 2026-03-11 cs.RO cs.AI cs.CL cs.CV 82%

NavSpace: How Navigation Agents Follow Spatial Intelligence Instructions

NavSpace: 导航代理如何遵循空间智能指令

Haolin Yang, Yuxing Long, Zhuoyuan Yu, Zihan Yang, Minghan Wang, Jiapeng Xu, Yihan Wang, Ziyan Yu, Wenzhe Cai, Lei Kang, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 NavSpace基准测试通过评估导航代理的空间感知与推理能力,提出SNav模型在指令遵循任务中表现优异,为具身智能研究提供新基准。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07545 2026-03-10 cs.CV cs.AI cs.LG 82%

DreamSAC: Learning Hamiltonian World Models via Symmetry Exploration

DreamSAC:通过对称探索学习哈密顿世界模型

Jinzhou Tang, Fan Feng, Minghao Fu, Wenjun Lin, Biwei Huang, Keze Wang

专题命中 具身导航 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 DreamSAC通过基于哈密顿的对称探索方法,学习物理不变性以提升3D物理模拟中的外推泛化能力。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06729 2026-03-10 cs.LG cs.AI cs.RO 82%

Don't Freeze, Don't Crash: Extending the Safe Operating Range of Neural Navigation in Dense Crowds

不要冻结,不要崩溃:扩展神经导航在密集人群中的安全操作范围

Jiefu Zhang, Yang Xu, Vaneet Aggarwal

机构 * Purdue University(普渡大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出了一种强化学习方法,通过密度不变的观察编码和物理激励的亲密度奖励塑造,实现密集人群导航中的零样本密度泛化,显著减少冻结现象并提高无碰撞成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08177 2026-03-06 cs.RO cs.AI cs.CV 82%

Quadrotor Navigation using Reinforcement Learning with Privileged Information

四旋翼导航使用强化学习与优先信息

Jonathan Lee, Abhishek Rathod, Kshitij Goel, John Stecklein, Wennie Tabib

机构 * Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出一种基于强化学习的四旋翼导航方法,利用优先信息和损失函数提高绕过大型障碍物的能力,实验表明其在复杂环境中具有更高的成功率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏