arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-13 至 2026-05-13 共收录 11 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 11 篇

2605.12084 2026-05-13 cs.RO cs.AI cs.IT cs.LG cs.SY eess.SY math.IT 80%

Learning What Matters: Adaptive Information-Theoretic Objectives for Robot Exploration

学习关键要素:面向机器人探索的自适应信息论目标

Youwei Yu, Jionghao Wang, Zhengming Yu, Wenping Wang, Lantao Liu

机构 * Luddy School of Informatics, Computing, and Engineering(信息学、计算与工程学院)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出Quasi-Optimal Experimental Design方法,通过Fisher信息矩阵分析和参数方向选择,提升机器人探索效率,实验证明在导航和操作任务中性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17510 2026-05-13 cs.RO 79%

Interpreting Context-Aware Human Preferences for Multi-Objective Robot Navigation

解释情境感知的人类偏好以实现多目标机器人导航

Tharun Sethuraman, Subham Agrawal, Nils Dengler, Jorge de Heuvel, Teena Hassan, Maren Bennewitz

机构 * Hochschule Bonn-Rhein-Sieg, Germany(波恩-莱茵-锡格应用科学大学,德国) University of Bonn, Germany(波恩大学,德国) Lamarr Institute for Machine Learning and Artificial Intelligence, Germany(拉马尔机器学习与人工智能研究所,德国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种结合基础模型与多目标强化学习政策的框架,使机器人能理解并应用情境依赖的导航偏好,提升在共享人类环境中的适应性、透明性和可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13690 2026-05-13 cs.LG 79%

Physics Aware Neural Networks: Denoising for Magnetic Navigation

具有物理意识的神经网络:用于磁导航的去噪

Aritra Das, Yashas Shende, Muskaan Chugh, Reva Laxmi Chauhan, Arghya Pathak, Debayan Gupta

机构 * Ashoka University(阿什oka大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.LG

AI总结 本文提出基于物理约束的神经网络方法,用于磁导航中去除飞机自身引起的磁噪声,通过 divergence-free 和 E(3)-equivariance 约束提升时空性能,实验表明其在预测准确性和物理合理性上优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12177 2026-05-13 cs.AI 79%

Floorplan2Guide: LLM-Guided Floorplan Parsing for BLV Indoor Navigation

Floorplan2Guide: 基于LLM的BLV室内导航floorplan解析

Aydin Ayanzadeh, Tim Oates

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文提出利用基础模型将floor plan转化为可导航的知识图谱,并生成可读的导航指令,通过LLM提取空间信息,提升BLV用户室内导航的精度与安全性。

Comments Accepted for publication in the proceedings of the IEEE International Conference on Big Data (IEEE BigData 2025)

Journal ref IEEE International Conference on Big Data (IEEE BigData 2025), pp. 7477-7485

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21260 2026-05-13 cs.RO eess.SP math.ST stat.TH 70%

Remarks on stochastic cloning and delayed-state filtering

关于随机克隆和延迟状态滤波的评论

Tara Mina, Lindsey Marinello, John Christian

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 本文探讨了延迟状态滤波器与随机克隆在处理延迟状态测量时的等效性,证明了延迟状态卡尔曼滤波无需状态扩展即可实现相同结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12255 2026-05-13 cs.AI cs.CY cs.LG 62%

Why Conclusions Diverge from the Same Observations: Formalizing World-Model Non-Identifiability via an Inference

结论为何从相同观察中分歧:通过推理正式化世界模型非识别性

Toru Takahashi

机构 * Human Informatics and Systems Laboratory, Doshisha University, Kyoto, Japan(大阪大学人文学与系统实验室,京都,日本) Linked Open Data Initiative, NPO, Tokyo, Japan(开放数据倡议,东京,日本) Keio Research Institute at SFC, Fujisawa, Japan(庆应义塾大学SFC研究所, Fujisawa,日本) Stroly Inc., Kyoto, Japan(Stroly公司,京都,日本)

专题命中 具身导航 :world model(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了在相同观察下推理结论分歧的本质,提出非识别性是推理学习的固有属性,而非对方认知缺陷。通过θ-级和W-级非识别性分析,揭示了推理框架对数据暴露和模型学习的影响,并关联深度表示学习与监管辩论案例。

Comments 12 pages, 2 figures, 1 table. Extended English version of a paper accepted for presentation at JSAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18780 2026-05-13 cs.RO cs.LG 62%

DreamPolicy: A Unified World-model Policy for Scalable Humanoid Locomotion

DreamPolicy: 一种统一的世界模型策略用于可扩展的人形机器人运动

Yahao Fan, Tianxiang Gui, Kaiyang Ji, Shutong Ding, Chixuan Zhang, Yifeng Xu, Ke Yang, Jiayuan Gu, Jingyi Yu, Jingya Wang, Ye Shi

机构 * ShanghaiTech University(上海科技大学) InstAdapt

专题命中 具身导航 :world model(abstract);分类 cs.RO、cs.LG

AI总结 DreamPolicy通过整合离线数据与扩散式世界模型,实现单一策略掌握已知和未知地形。其地形感知世界模型能生成物理合理的未来轨迹,作为动态目标指导策略,避免手动奖励工程。实验表明,DreamPolicy在未知和复合地形上性能优于基线38%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12247 2026-05-13 cs.RO 57%

SI-Diff: A Framework for Learning Search and High-Precision Insertion with a Force-Domain Diffusion Policy

SI-Diff: 一种通过力域扩散策略学习搜索和高精度插入的框架

Yibo Liu, Stanko Oparnica, Simon Shewchun-Jakaitis, Guoyi Fu, Jie Wang, Jun Yang, Anand Jagannathan, Tony Hong-Yau Lo

机构 * Epson Canada(爱普生加拿大) Queen’s University(皇后大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 SI-Diff通过力域扩散策略整合搜索与高精度插入,提升装配容忍度与迁移能力。

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21887 2026-05-13 cs.RO 57%

IGV-RRT: Prior-Real-Time Observation Fusion for Active Object Search in Changing Environments

IGV-RRT:面向动态环境主动目标搜索的先验-实时观测融合

Wei Zhang, Ping Gong, Yujie Wang, Leilei Yao, Minghui Bai, Rongfeng Ye, Yinchuan Wang, Yachao Wang, Chen Sun, Chaoqun Wang

机构 * The School of Control Science and Engineering, Shandong University(控制科学与工程学院,山东大学) Department of Data and Systems Engineering, HKU(数据与系统工程系,香港大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出IGV-RRT框架,结合先验场景知识与实时目标相关性估计,通过双层语义映射模块和实时规划器提升动态环境中目标搜索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11748 2026-05-13 cs.CV 57%

BronchoLumen: Analysis of recent YOLO-based architectures for real-time bronchial orifice detection in video bronchoscopy

BronchoLumen:基于最新YOLO架构的实时支气管开口检测分析:用于视频支气管镜检查

Yongchao Li, Marian Himstedt

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出BronchoLumen系统,基于最新YOLO架构实现支气管开口实时检测,评估不同模型在多域数据中的鲁棒性,展示YOLOv12在定位精度上的优势,但精度略逊。

Comments 10 pages, 4 figures, IPCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11536 2026-05-13 cs.GR 50%

ToF ReSTIR: Time-of-Flight Rendering with Spatio-temporal Reservoir Resampling

ToF ReSTIR: 时间飞行渲染中的时空共振重采样

Juhyeon Kim, Wojciech Jarosz, Adithya Pediredla

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种时空重用框架,用于时间分辨光传输,实现高效蒙特卡洛渲染时间飞行现象。通过改进ReSTIR技术,解决传统方法计算成本高、扩展性差的问题,提出路径重用公式确保物理光学路径长度,支持交互速率的时间门控和瞬态渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏