On the coherent extension of some Fano-type learning bounds
关于某些Fano型学习界限的相干扩展
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文通过信息论方法建立学习准确性的下界,将量子纠缠与经典学习联系起来,提出了一种适用于无限维量子系统的纠缠操作任务。
Comments 27 pages, 1 figure
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
关于某些Fano型学习界限的相干扩展
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文通过信息论方法建立学习准确性的下界,将量子纠缠与经典学习联系起来,提出了一种适用于无限维量子系统的纠缠操作任务。
Comments 27 pages, 1 figure
平面光学用于模拟计算:从基本机制到高级元处理器
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文探讨了基于元表面的光学计算的基本机制,包括傅里叶域、非局部空间域和干涉架构,重点介绍了空间微分和边缘检测等计算任务,并展望了AI驱动逆设计与类脑光学神经网络的协同作用。
复杂布尔图灵机:计算复杂性的代数语义框架
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文提出复杂布尔图灵机,通过将计算符号提升为GF(4)中的代数元素,为非确定性提供代数解释,并证明其与传统图灵机等价。
图表作为接口:迈向面向大语言模型的科学发现原生图件
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文提出LLM原生图件概念,通过融合语言-视觉接口,实现数据驱动的可解释图件,提升科学发现的可重复性和透明性。
HAVEN:基于深度变换器Q网络的分层对抗感知可见性导航与覆盖利用
机构 * IDEAS Lab, Department of Computer Science, Purdue University(IDEAS实验室,计算机科学系,普渡大学) ; DEVCOM Army Research Laboratory(国防部陆军研究实验室)
专题命中 具身导航 :navigation(title,abstract);robotics(abstract);robotic(abstract);分类 cs.RO
AI总结 本文提出一种分层导航框架,结合深度变换器Q网络作为高层子目标选择器和模块化低层控制器,通过可见性感知候选生成和潜在场控制器提升导航安全性与效率。
基于3D激光雷达的实时室内导航鸟瞰图像结构检测
机构 * Universidad Politécnica de Madrid(马德里理工大学)
专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO
AI总结 本文提出一种轻量实时框架,通过将3D激光雷达数据投影到2D鸟瞰图像中,实现高效结构检测,采用几何方法和YOLO-OBB深度学习检测器,结合时空融合模块提升稳定性,实验证明YOLO-OBB在资源受限平台上的高效鲁棒性。
RHINO-AR:一种用于博物馆中教学移动机器人概念的增强现实展览
机构 * Humanoid Robots Lab, University of Bonn, Germany(波恩大学人形机器人实验室,德国)
专题命中 具身导航 :robotics(title,abstract);navigation(abstract);分类 cs.RO
AI总结 RHINO-AR通过将虚拟重建的机器人置于真实博物馆空间,解决了VR展览与现实环境分离的问题,提升了非专业观众对移动机器人导航概念的理解。
VLN-NF:具有假前提指令的视图与语言导航
机构 * National Taiwan University(国立台湾大学) ; National Tsing Hua University(国立清华大学) ; DRIC
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV
AI总结 本文提出VLN-NF基准,通过引入假前提指令,要求智能体在目标不存在时进行探索并明确输出NOT-FOUND,采用ROAM方法在房间级导航与室内探索中取得最佳性能。
Comments ACL 2026 camera ready
TagaVLM:面向视觉语言导航的拓扑感知全局动作推理
机构 * School of Information Science and Technology, Beijing University of Technology, China(信息科学与技术学院,北京理工大学,中国) ; Imperial College London, U.K.(伦敦帝国理工学院,英国)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV
AI总结 TagaVLM通过引入拓扑结构增强视觉语言模型,提升空间推理能力,在R2R基准中取得最佳性能,优于现有方法。
NaviFormer:一种深度强化学习变换器模型,以整体解决导航问题
机构 * Grupo de Tratamiento de Imágenes, Information Processing and Telecommunications Center, ETSI Telecomunicación, Universidad Politécnica de Madrid(图像处理与电信中心,信息处理与电信中心,电信工程学院,马德里理工大学) ; Idiap Research Institute(Idiap研究机构)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI
AI总结 NaviFormer通过预测高层路线和底层轨迹,整体解决导航问题,实验表明其在准确性和计算速度上表现优异,适用于实时任务。
Comments Published in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2025
指令作为状态:环境引导和状态条件的语义理解用于具身导航
机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) ; The Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) ; School of Information Science and Technology(信息科学与技术学院) ; Zhongguancun Academy(中关村学院)
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 本文提出了一种环境引导和状态条件的语义理解方法,通过动态指令-感知纠缠提升具身导航性能,实验表明在多个基准测试中表现优异。
一种基于哈密顿-雅可比可达性的搜索框架用于高效安全的室内平面机器人导航
机构 * Simon Fraser University(西蒙弗雷泽大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出结合离线哈密顿-雅可比可达性与在线图搜索的方法,提升室内机器人导航的效率和安全性,通过预计算的HJ值函数作为启发式和安全约束,减少计算开销。
先思后行:面向图像目标导航的层次推理
机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究所、西安交通大学) ; University of Macau(澳门大学) ; Xiaomi EV(小米电动车) ; School of Automation, Beijing Institute of Technology(自动化学院,北京理工大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出HRNav框架,通过分层规划与执行解决图像目标导航问题,利用视觉语言模型生成短期计划并结合在线强化学习策略,引入Wandering Suppression Penalty降低漂移问题,实验验证其有效性。
Comments Accepted by ACL2026 (main conference)
LookasideVLN: 基于方向的空中视觉与语言导航
机构 * Sun Yat-sen University(中山大学) ; Peng Cheng Laboratory(鹏城实验室) ; The Chinese University of Hong Kong(香港中文大学) ; Centre for Perceptual and Interactive Intelligence(感知与交互智能中心) ; Cardiff University(卡迪夫大学) ; Beihang University(北航) ; Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室)
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 本文提出LookasideVLN,通过利用自然语言中的方向线索提升空中视觉与语言导航的准确性和效率,采用方向感知图、空间地标知识库和方向MLLM导航代理三种核心组件。
Comments Accepted by CVPR 2026
基于LiDAR的人群导航与可见边缘组表示
机构 * Miraikan, the National Museum of Emerging Science and Innovation(日本新兴科学与创新国家博物馆) ; the Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出基于LiDAR的人群导航方法,通过可见边缘组表示提升导航安全性与社交性,同时在密集人群环境中实现更快的计算速度。
Comments Under review
进化作为适应度景观导航:概念、度量和新兴问题
专题命中 具身导航 :navigation(title,abstract)
AI总结 本文综述了进化中适应度景观导航的理论与方法,定义了关键概念,探讨了表型-基因型映射与适应度景观的关系,提出新的导航度量,并讨论了非单调路径对进化导航的影响。
Comments 27 pages, 2 figures
一种用于高效机器人导航的空间记忆表示综述
机构 * University of the Philippines Diliman(菲律宾大学杜马扬分校) ; University of Santo Tomas(圣托马斯大学)
专题命中 具身导航 :navigation(title);分类 cs.RO、cs.CV
AI总结 本文综述了88篇文献,探讨了空间记忆效率问题,提出α指标评估部署可行性,揭示了内存架构对实际部署的影响。
Comments Accepted at the Women in Computer Vision (WiCV) Workshop at CVPR 2026
贪心卡尔曼-群:在恶劣环境中提高机器人群的状态估计
机构 * International School of Engineering, Chulalongkorn University(国际工程学院,朱拉隆功大学)
专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO
AI总结 本文提出贪心卡尔曼-群方法,通过局部分布式状态估计提升机器人群在恶劣环境中的状态估计精度,平衡了独立估计的低开销与集中系统的高精度。
Comments accepted at ECTI-CON 2026
关于条件轨迹预测的讨论
机构 * Sun Yat-sen University(中山大学) ; Alibaba Group(阿里巴巴集团)
专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV
AI总结 本文提出CiT方法,通过跨时间域意图交互实现轨迹预测,结合自身运动与社交交互信息,提升预测精度并集成机器人运动规划模块。
基于AI的MRI-only全脊柱椎体分割及3D重建在儿童脊柱侧弯中的应用
机构 * Biomechanics and Spine Research Group, School of Mechanical, Medical, and Process Engineering, Faculty of Engineering, Queensland University of Technology(生物力学与脊柱研究组,机械、医学与过程工程学院,工程学院,昆士兰理工大学) ; Centre for Biomedical Technologies, School of Mechanical, Medical and Process Engineering, Faculty of Engineering, Queensland University of Technology(生物医学技术中心,机械、医学与过程工程学院,工程学院,昆士兰理工大学) ; Orthopaedics Department, Queensland Children’s Hospital(骨科部门,昆士兰儿童医院)
专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV
AI总结 本文提出一种AI框架,通过GAN将低剂量CT转换为MRI图像,结合已有MRI数据训练U-Net模型,实现全脊柱3D重建,提升分割精度并缩短处理时间,支持无辐射的脊柱侧弯评估。
Comments Presented at 2026 Spine Society of Australia 37th Annual Scientific Meeting
时间表示用于探索:在没有外在奖励的情况下学习复杂探索行为
机构 * Mila-Quebec AI Institute(魁北克AI研究所) ; Université de Montréal(蒙特利尔大学) ; Princeton University(普林斯顿大学)
专题命中 具身导航 :manipulation(abstract);分类 cs.AI、cs.LG
AI总结 本文提出一种基于时间对比表示的探索方法,通过优先选择不可预测未来结果的状态,实现复杂探索行为的学习,无需外在奖励。
多模态大语言模型驱动机器人中的躯体自我识别
机构 * Center for Automation and Robotics(自动化与机器人中心) ; University of Azuay(阿祖亚大学)
专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.AI
AI总结 本文研究多模态大语言模型通过躯体运动经验发展自我识别能力,展示机器人在环境感知、自我识别和预测意识方面的表现,揭示感觉整合对最小自我的影响及记忆协调机制。
Comments 16 pages, 3 figures, 1 table
具有4D信息检索的主动世界模型用于探索与意识
机构 * KavAI ; UCSD(加州大学圣迭戈分校)
专题命中 具身导航 :world model(abstract,comments);分类 cs.CV
AI总结 本文提出AW4RE模型,通过结合4D信息检索、几何支持与时间一致性,提升在动态环境中感知决策的准确性与一致性。
Comments 11 pages, 4 figures, submitted to ICLR 2026 2nd Workshop on World Models
通过改进的接触建模将体外感知与本体感觉联系起来用于软生长机器人
机构 * School of Mechanical Engineering, Purdue University, West Lafayette, IN, USA(帕克大学机械工程学院) ; Department of Computer Science, Purdue University, West Lafayette, IN, USA(帕克大学计算机科学系)
专题命中 具身导航 :navigation(abstract);分类 cs.RO;robotics(comments)
AI总结 本文提出利用软生长机器人进行环境映射与探索,通过分析碰撞行为并开发基于几何的模拟器,验证了其在不同环境中高效探索的潜力。
Comments Accepted to International Journal of Robotics Research (IJRR), 23 pages, 22 figures, 1 table
表面采矿中的自动化与人工智能技术及皮尔巴拉露天采矿简介
专题命中 具身导航 :robotic(abstract);robotics(comments,journal_ref)
AI总结 本文综述了采矿行业,特别是西澳皮尔巴拉铁矿区在工程问题、技术创新、机器人开发和自动化方面的挑战与进展,旨在展示技术现状并提高工程界对采矿中AI和自动化趋势的认识。
Comments Accepted manuscript. Paper provides insights on state-of-the-art technologies and future trends. Keywords: Mining automation, robotics, intelligent systems, machine learning, remote sensing, geostatistics, planning, scheduling, optimization, modelling, geology, complex systems. Document: 21 pages, 6 figures, 2 tables. 2024 Update: Added ICRA conference poster + slides as ancilliary files
Journal ref IEEE Robotics & Automation Magazine 32:3 (2025) 164-183
环境表征假设:重新思考普遍性
机构 * Institute of Cognitive Science, University of Osnabrück(奥尔登堡大学认知科学研究所) ; Department of Psychology and Education, Freie Universität Berlin(柏林自由大学心理学与教育系) ; Bernstein Center for Computational Neuroscience, Berlin(柏林计算神经科学中心)
专题命中 具身导航 :world model(abstract);分类 cs.LG
AI总结 本文提出环境表征假设,认为系统表征的相似性源于生态约束下的重叠而非单一最优解,挑战了普遍性观点。
Comments preprint v1
关于计算机使用代理的可靠性
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 研究计算机使用代理可靠性问题,分析执行中的随机性、任务描述模糊性和代理行为差异三大因素,发现任务指定和代理行为变化影响可靠性,需通过重复执行评估并提升稳定性。
Comments 33 pages, 3 figures, 4 tables
图、大语言模型与代理的整合:推理与检索
机构 * Canadian Institute for Cybersecurity, Faculty of Computer Science, University of New Brunswick(加拿大网络安全研究所,计算机科学学院,新不伦瑞克大学)
专题命中 具身导航 :robotics(abstract);分类 cs.AI
AI总结 本文综述了图与大语言模型整合的设计选择,分类了基于用途、图模态和整合策略的方法,探讨了不同领域中的适用场景和优缺点。
基于深度学习的非刚性体积分到表面注册用于脑移位补偿的点云方法
机构 * Austrian Center for Medical Innovation and Technology(奥地利医学创新与技术中心) ; Medical University of Vienna(维也纳医学大学) ; University of Cambridge(剑桥大学) ; Danube Private University (DPU)(多瑙私人大学(DPU))
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 本文提出基于深度学习的非刚性体积分到表面注册方法,利用稀疏手术表面观测进行密集位移场估计,实现有限视野下的脑移位补偿。
为躲避障碍物的单轮机器人规划平滑且安全的控制律
机构 * Faculty of Information Technology and Electrical Engineering, University of Oulu(奥卢大学信息科技与电气工程学院) ; Department of Advanced Computing Sciences, Maastricht University(马斯特里赫特大学高级计算科学系)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出了一种框架,用于在存在障碍物的环境中安全导航单轮点机器人至目标位置,通过引入新的QP公式生成减少总弯曲和总转向的Cinfinity光滑向量场,并设计非线性反馈控制器保证安全集的前向不变性。
Comments This work has been accepted for publication in the 2026 European Control Conference (ECC)