arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-26 至 2026-06-26 共收录 11 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 11 篇

2603.06480 2026-06-26 cs.RO 版本更新 83%

History-Conditioned Spatio-Temporal Visual Token Pruning for Efficient Vision-Language Navigation

基于历史条件的时空视觉令牌剪枝用于高效视觉-语言导航

Qitong Wang, Yijun Liang, Ming Li, Tianyi Zhou, Christopher Rasmussen

机构 * Department of Computer and Information Sciences at the University of Delaware(德克萨斯大学达勒姆分校计算机与信息科学系) University of Maryland’s Department of Computer Science(马里兰大学计算机科学系) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种无需训练的时空视觉令牌剪枝框架,通过空间令牌选择和时空压缩减少冗余计算,在保持导航精度的同时显著提升推理效率,并在真实机器人上验证了低延迟指令跟随导航。

Comments International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16932 2026-06-26 cs.RO 版本更新 79%

BAT-Nav: Budget-Aware Arbitration and Termination for Long-Horizon Semantic Navigation

MORN: 为资源理性长周期导航的元认知目标-目标调节

Xi Lin, Kangyi Wu, Jiayi Li, Jiaqiao Tang, Qingrong He, Lin Zhao

机构 * LCSR Lab, Johns Hopkins University(约翰霍普金斯大学LCSR实验室) Xi’an Jiaotong University(西安交通大学) JD Explore Academy, Beijing, China(京东探索研究院,北京,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出MORN,一种基于双过程理论的元认知导航架构,通过引入资源理性机制,解决传统导航系统在长周期任务中因缺乏全局资源意识导致的资源浪费问题,提升了目标完成率和任务效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01461 2026-06-26 cs.CV 版本更新 79%

UltraStar: Semantic-Aware Star Graph Modeling for Echocardiography Navigation

UltraStar: 面向超声心动图导航的语义感知星图建模

Teng Wang, Haojun Jiang, Chenxi Li, Diwen Wang, Yihang Tang, Zhenguo Sun, Yujiao Deng, Shiji Song, Gao Huang

机构 * Department of Automation, BNRist, Tsinghua University, Beijing, China(自动化系、BNRist、清华大学、北京、中国) School of Automation, Beijing Institute of Technology, Beijing, China(自动化学院、北京理工大学、北京、中国) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院、北京、中国) Chinese PLA General Hospital, Beijing, China(中国人民解放军总医院、北京、中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 提出UltraStar方法,通过星图将探头导航从路径回归重构为基于锚点的全局定位,并采用语义感知采样策略选择代表性关键帧,有效处理噪声轨迹,在131万样本数据集上优于基线方法。

Comments Accepted to MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26383 2026-06-26 cs.LG cs.AI cs.AR cs.MA cs.PF 新提交 62%

SOLAR: AI-Powered Speed-of-Light Performance Analysis

SOLAR: AI驱动的光速性能分析

Qijing Huang, Sana Damani, Zhifan Ye, Athinagoras Skiadopoulos, Siva Kumar Sastry Hari, Jason Clemons, Sahil Modi, Jingquan Wang, Aditya Kane, Edward C Lin, Humphrey Shi, Christos Kozyrakis

机构 * NVIDIA(英伟达)

专题命中 具身导航 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 提出SOLAR框架,自动从PyTorch和JAX代码推导理论最小执行时间(光速界限),通过LLM前端和确定性分析实现无违反界限的多保真度性能分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26928 2026-06-26 cs.RO cs.SI 新提交 61%

UAV-MapFusion: RTK-Aligned Uncertainty-Aware Coarse-to-Fine Multi-Session UAV Mapping

UAV-MapFusion: RTK对齐的不确定性感知粗到细多会话无人机建图

Feng Pan, Chunran Zheng, Bing Xue, Yukang Cui, Jiayu Wen, Zhiyu Chen, Wei Wang

机构 * College of Automation, Harbin Engineering University(哈尔滨工程大学自动化学院) Department of Mechanical Engineering, University of Hong Kong(香港大学机械工程系) College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院)

专题命中 具身导航 :robotics(abstract,comments);分类 cs.RO

AI总结 提出一种不确定性感知的多会话点云地图合并与粗到细优化系统,通过RTK时空对齐和迭代平面因子优化,在抑制长距离漂移的同时保持局部几何精度。

Comments 8 pages, 5 figures, accepted by IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26647 2026-06-26 cs.CV 新提交 57%

LayersReg: A Layer-by-Layer Progressive Regressor for Reliable Intraoperative 3D/2D Registration

LayersReg:一种用于可靠术中3D/2D配准的逐层渐进回归器

Xiyuan Wang, Zhenchao Wang, Xinran Chen, Junkai Liu, Chuan Chen, Feng Yin

机构 * School of Biological Science and Medical Engineering(生物科学与医学工程学院) Southeast University(东南大学) School of Engineering, College of Engineering and Physical Sciences(工程学院,工程与物理科学学院) University of Birmingham(伯明翰大学) State Key Laboratory of Digital Medical Engineering(数字医学工程国家重点实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出LayersReg,一种逐层渐进回归范式,通过特征空间搜索像素流趋势迭代收敛到正确空间位姿,在X射线/CT配准和切片定位任务上达到高精度,满足术中实时需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26168 2026-06-26 cs.LG q-bio.QM 新提交 57%

Implementation of reinforcement learning in chemical reaction networks: application to phototaxis as curiosity-driven exploration

强化学习在化学反应网络中的实现:以好奇心驱动的探索为例的趋光性

Ruyi Tang, Grégoire Sergeant-Perthuis, David Colliaux

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 将趋光性建模为部分可观测马尔可夫决策过程,通过化学反应网络常微分方程实现内部状态更新,利用逆强化学习从实验轨迹推断行为目标,揭示游动-翻滚交替作为信息获取策略。

Comments This paper is accepted as talk at ALIFE 2026 (Waterloo, Canada)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08639 2026-06-26 cs.CY cs.AI cs.DL 版本更新 57%

The Journal of Prompt-Engineered (Moral) Philosophy Or: Why AI-Assisted Ethics Research Requires Process Transparency

提示工程(道德)哲学杂志或:为何AI辅助伦理研究需要过程透明

Michele Loi

机构 * University of Milan(米兰大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文探讨了AI辅助伦理研究中过程透明的必要性,提出透明义务应基于主体完整性,通过五个透明元素构建文档充分性框架,以实现未来规范性判断的可能。

Comments 21 pages Transparency material documenting LLM usage available at: https://github.com/MicheleLoi/JPEP.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06080 2026-06-26 cs.CV cs.CY cs.HC 版本更新 57%

AIDEN: Design and Pilot Study of an AI Assistant for the Visually Impaired

AIDEN:面向视障人士的AI助手设计与初步研究

Luis Marquez-Carpintero, Francisco Gomez-Donoso, Zuria Bauer, Bessie Dominguez-Dager, Alvaro Belmonte-Baeza, Mónica Pina-Navarro, Francisco Morillas-Espejo, Felix Escalona, Miguel Cazorla

机构 * Institute for Computer Research, University of Alicante(计算机研究所,阿利坎特大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出AIDEN系统,结合YOLO实时目标检测、LLaVA场景描述与OCR,以及基于盖革计数器隐喻的连续触觉引导,避免听觉过载并保护隐私,实验表明用户满意度高。

Journal ref IEEE Access 14 (2026) 80406-80420

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17916 2026-06-26 cs.CV 版本更新 57%

EndoUFM: Utilizing Foundation Models for Monocular depth estimation of endoscopic images

EndoUFM:利用基础模型进行内窥镜图像的单目深度估计

Xinning Yao, Bo Liu, Bojian Li, Jingjing Wang, Jinghua Yue, Fugen Zhou

机构 * Image Processing Center, Beihang University(北京航空航天大学图像处理中心) State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高效可重复航天运输技术国家重点实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出EndoUFM框架,通过双基础模型和自适应微调策略(RVLoRA和Res-DSC)提升内窥镜图像单目深度估计性能,在多个数据集上达到最优。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27080 2026-06-26 cs.SE 新提交 50%

ATGBuilder: Feature-Assisted Graph Learning for Activity Transition Graph Construction with Seed Supervision

ATGBuilder: 基于特征辅助图学习的活动转换图构建与种子监督

Chenhui Cui, Zixiang Xian, Danyu Li, Tao Li, Rubing Huang, Dave Towey, Shikai Guo, Jiakun Liu

专题命中 具身导航 :navigation(abstract)

AI总结 提出ATGBuilder,利用大语言模型总结UI布局元数据,并将控件触发信息建模为边属性,通过辅助重构目标进行图学习,在种子监督下构建高质量活动转换图,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏