Strong Solutions to SDEs with Supercritical Drift Arising in Navigation Problems
导航问题中超临界漂移随机微分方程的强解
专题命中 具身导航 :navigation(title,abstract)
AI总结 针对极坐标下具有1/r型超临界奇异漂移的两种随机导航模型,通过路径论证证明了强存在性和路径唯一性,并研究了停止半径趋于零时的极限行为。
Comments 28 pages, 6 figures
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
导航问题中超临界漂移随机微分方程的强解
专题命中 具身导航 :navigation(title,abstract)
AI总结 针对极坐标下具有1/r型超临界奇异漂移的两种随机导航模型,通过路径论证证明了强存在性和路径唯一性,并研究了停止半径趋于零时的极限行为。
Comments 28 pages, 6 figures
SpatialFly:基于几何的表示对齐用于城市环境中无人机视觉与语言导航
机构 * School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院) ; Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) ; Tsinghua University(清华大学) ; Department of Automation, Tsinghua University(清华大学自动化系) ; School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) ; Jianghan University(江汉大学)
专题命中 具身导航 :navigation(title);分类 cs.AI、cs.CV
AI总结 本文提出SpatialFly框架,通过几何引导的2D表示对齐机制,解决无人机在复杂3D环境中的视觉与语言导航问题,实验表明其在路径对齐和运动稳定性方面优于现有方法。
NeuPAN: 基于端到端模型学习的直接点机器人导航
专题命中 具身导航 :navigation(title);分类 cs.RO、cs.AI
AI总结 提出NeuPAN,一种实时、高精度、无地图、易部署的机器人运动规划器,通过紧耦合感知-控制框架和端到端模型学习,直接处理原始点云生成无碰撞运动,避免感知到控制的误差传播。
Comments Accepted by TRO 2025; project website: https://hanruihua.github.io/neupan_project/
MOSAIC:异构机器人团队智能协作的模块化可扩展自主性
机构 * FZI Forschungszentrum für Informatik, Karlsruhe, Germany(弗赖堡信息研究中心,卡尔斯鲁厄,德国) ; Robotic Systems Lab (RSL), ETH Zürich, Zürich, Switzerland(机器人系统实验室(RSL),苏黎世联邦理工学院,苏黎世,瑞士) ; Machine Intelligence and Robotics Lab (MaiRo), Karlsruhe Institute for Technology (KIT), Karlsruhe, Germany(机器智能与机器人实验室(MaiRo),卡尔斯鲁厄技术学院(KIT),卡尔斯鲁厄,德国) ; European Space Agency (ESA), Noordwijk, Netherlands(欧洲航天局(ESA),诺德威克,荷兰)
专题命中 具身导航 :robotic(title);分类 cs.RO;robotics(comments)
AI总结 研究针对多机器人科学探索,提出MOSAIC框架,基于兴趣点统一任务抽象与多层自主性,依机器人能力动态分配任务,经模拟月球探测实验验证,可实现强鲁棒性、可扩展的多机器人科学探索。
Comments This work has been accepted for publication with the IEEE Transactions of Field Robotics Journal
TMRL: 差分时间步调节预训练实现高效策略微调的探索
机构 * University of Washington(华盛顿大学) ; Amazon FAR(亚马逊FAR)
专题命中 具身导航 :manipulation(abstract);robot policy(abstract);分类 cs.RO、cs.AI、cs.LG
AI总结 本文提出TMRL框架,通过结合行为克隆预训练与强化学习微调,解决预训练中动作分布狭窄的问题,提升机器人策略微调的样本效率。
改进的基于表示自动编码器的基线
机构 * Adobe Research(Adobe研究院) ; ANU(澳大利亚国立大学) ; New York University(纽约大学)
专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.AI、cs.CV、cs.LG
AI总结 本文研究了基于表示自动编码器(RAE)的设计选择,发现三个见解,简化并改进了RAE。首先,研究了一种通用公式,将表示定义为最后k个编码器层的总和,而不是仅最终层。其次,研究了RAE与表示对齐(REPA)的假设,发现两者具有互补的工作机制。最后,改进了RAE在无分类器指导(CFG)中的表现,通过重新参数化DiT模型输出,实现了无需训练第二个模型的指导效果。RAEv2在ImageNet-256上达到了1.06的gFID,且训练效率显著提高。
LEGO-SLAM:语言嵌入的高斯优化SLAM
机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人系,成均馆大学)
专题命中 具身导航 :robotics(abstract,comments);robotic(abstract);分类 cs.RO、cs.CV
AI总结 研究将语言特征集成到基于3DGS的SLAM系统的问题,提出LEGO-SLAM框架,利用场景自适应自动编码器压缩语言嵌入,实现语言引导剪枝和回环检测,提升映射质量和跟踪精度,具备开放词汇能力且达15FPS。
Comments Project page :https://lab-of-ai-and-robotics.github.io/LEGO-SLAM/ Submitted to IEEE RA-L
面向非结构化环境的能力感知可通行性导航
机构 * University of São Paulo(圣保罗大学)
专题命中 具身导航 :navigation(title);分类 cs.RO
AI总结 研究非结构化环境中可通行性估计,提出能力感知可通行性(CAT)框架,将物理限制嵌入空间特征空间,通过交互式标注和SPADE块改进可通行性预测,在多数据集上领先,实现实例感知避障。
Comments 8 pages, 7 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Project page: https://capability-aware-traversability.github.io/
LOCUS-DT:基于数字孪生的观测条件不确定性评分定位方法
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG
AI总结 本文提出LOCUS-DT框架,利用数字孪生和学习评分函数处理室内多径定位,泛化性好,在Sionna测试中比高斯类基准更精准捕捉多模态后验结构。
Traj-VLN:通过自回归轨迹生成学习像素空间交互
机构 * Southern University of Science and Technology(南方科技大学) ; Peng Cheng National Laboratory(鹏城国家实验室) ; Guangdong University of Technology(广东工业大学)
专题命中 具身导航 :embodied agent(abstract);navigation(abstract);分类 cs.RO、cs.CV
AI总结 研究连续环境中视觉与语言导航问题,提出通过自回归轨迹生成在2D像素空间微调视觉语言模型来学习导航交互的方法,实验验证该方法能显著提升性能,旗舰模型在有限资源和数据下达最优水平。
稳健导航
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI
AI总结 研究旨在解决大规模导航系统部署问题,提出Robostral Navigate模型,仅用单目RGB图像流预测路点,具鲁棒性。通过模拟场景减少对真实数据依赖,用前缀缓存训练等方法,在基准测试中达新最优,提升导航系统性能。
库普曼梦想家:用于稳定世界模型想象的频谱约束潜在动力学
机构 * College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学与技术学院) ; School of Engineering, Newcastle University(纽卡斯尔大学工程学院)
专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.RO、cs.LG
AI总结 研究针对潜在世界模型长期展开中模态持久性和误差积累控制有限的问题,提出库普曼梦想家模型,通过频谱约束潜在动力学核心及多种目标结合优化,推导误差界,实验证明其提高了长期潜在展开稳定性及闭环控制性能。
Comments 20 pages, 13 figures, 11 tables. Revised manuscript with a more concise and precise abstract and improved clarity and presentation throughout the main text. The main technical content, experimental results, and conclusions remain unchanged
不要愚弄我两次:通过经验驱动推理在野外适应逆境
机构 * Department of Engineering Design, Indian Institute of Technology, Madras(印度理工学院工程设计系,马德拉斯) ; Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
专题命中 具身导航 :robotics(abstract);embodied agent(abstract);分类 cs.RO、cs.LG
AI总结 提出一种持续学习框架,使移动机器人能够在线从干扰中学习,通过语义将异常行为归因于原因,从而更好地预测和规划未来。
Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)
闪烁多臂老虎机
机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) ; INRIA Paris(巴黎国家信息与自动化研究所)
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.AI、cs.LG
AI总结 提出闪烁多臂老虎机模型,通过随机图约束动作可用性,设计两阶段懒惰随机游走算法实现次线性遗憾界,并证明信息论下界的最优性。
语言气味:探索跨语言信息导航
专题命中 具身导航 :navigation(title)
AI总结 研究探讨了多语言用户在信息检索中跨语言切换的机制,提出'语言气味'理论,并设计Niffler系统支持跨语言信息导航,通过上下文线索和工具提升探索性搜索策略。
机器人位姿图SLAM中的重叠型Schwarz预条件子
专题命中 具身导航 :robotics(title)
AI总结 提出基于GDSW型能量最小化粗空间的两层重叠Schwarz预条件子,用于SLAM位姿图优化中的稀疏线性系统,数值实验表明其具有数值可扩展性。
Comments 26 pages, 8 figures. To be submitted
PBD-AG:面向长周期服务机器人的具有不确定性感知检查的持久基线-增量主动图
专题命中 具身导航 :world model(abstract);robotic(abstract);分类 cs.RO
AI总结 针对长周期服务机器人世界模型构建的现有方法存在不足,本文提出PBD-AG框架,通过解耦稳定固定装置与动态对象事件,结合不确定性感知检查,在仿真与物理机器人实验中取得更优性能。
多智能体系统的解耦控制
机构 * Department of Electrical Engineering and Computer Science, University of California, Irvine(加州大学 Irvine 分校 电气工程与计算机科学系) ; Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学 电气与计算机工程系) ; University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO
AI总结 本文提出一种通用多智能体控制合成框架,适用于具有收敛保证的广泛问题,包括具有时间变化目标函数的问题。该框架实现去中心化而不引入智能体间的动态耦合,自然支持多目标机器人和实时实现。
RoboHarness:用于长期规划的异构机器人策略的内存驱动编排
机构 * Huawei Noah’s Ark Lab(华为诺亚方舟实验室) ; University of British Columbia(英属哥伦比亚大学) ; University of Toronto(多伦多大学) ; McGill University(麦吉尔大学) ; Labs(2012实验室)
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO
AI总结 针对长期机器人任务需多种能力、异构策略编排难的问题,提出RoboHarness框架,通过多模态执行内存等表征策略能力边界,经内存桥接稳定策略交接,实验验证其在长期规划和分布外鲁棒性上有显著提升。
Comments 21 pages, 8 figures
高斯种子:用于高分辨率3D占用预测的分层高斯播种
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV
AI总结 针对现有3D占用预测方法难以扩展到高体素分辨率的问题,提出高斯种子框架,通过分层设计规避内存瓶颈,构建TJScenes数据集,实验表明该方法在保持高精度的同时具有最低延迟,推动了高分辨率3D占用预测的效率-质量前沿。
通过学习的线性Koopman动力学加速基于采样的控制
机构 * School of Aeronautics and Astronautics, Purdue University(航空航天学院,普渡大学)
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO
AI总结 本文提出了一种基于学习的线性Koopman动力学的MPPI控制框架,通过减少计算成本实现高效实时控制。
面向移动服务机器人的成对人-人交互检测与识别框架
机构 * Wallenberg AI, Autonomous Systems and Software Program – Humanity and Society(瓦伦贝格人工智能、自主系统和软件计划—人类与社会)
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO
AI总结 提出两阶段框架,先利用轻量几何和运动线索识别交互对,再通过关系网络分类交互类型,在JRDB数据集上以较低计算成本取得竞争性能,并在CAD和零样本数据集上验证泛化性。
SPIRONet:用于血管分割的空间-频率学习与基于图的通道交互网络
机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV
AI总结 提出SPIRONet,通过双空间-频率编码器、交叉注意力融合和基于图的通道交互模块,解决低信噪比、细小血管和强干扰下的血管分割难题,在五个数据集上取得最优性能。
Comments Accepted by Biomedical Signal Processing and Control. 15 Pages, 9 Figures, 13 Tables
可信DFGO:具有可信度监督的可微因子图优化
机构 * Department of Aeronautical and Aviation Engineering(航空与航空工程系)
专题命中 具身导航 :navigation(abstract,comments);分类 cs.RO、cs.AI、cs.LG
AI总结 针对GNSS协方差不可靠问题,提出CredibleDFGO框架,通过可微高斯-牛顿求解器与加权生成网络,利用适当评分规则监督预测分布,提升协方差可信度与定位精度。
Comments Submitted to NAVIGATION: Journal of the Institute of Navigation
整体融合:基于因子图的与任务和设置无关的机器人定位与状态估计
机构 * ETH Zürich(苏黎世联邦理工学院) ; Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) ; NASA Jet Propulsion Laboratory(美国国家航空航天局喷气推进实验室)
专题命中 具身导航 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.CV
AI总结 研究针对移动机器人定位与状态估计问题,提出整体融合方法,通过因子图公式融合多类型测量,注重局部平滑性与一致性,能在典型硬件上实现低延迟、平滑在线估计及低漂移全局定位,在多场景验证了框架有效性。
Comments 21 pages, 25 figures, 9 tables, Transactions on Robotics, accepted
Journal ref Transactions on Robotics 2026
Dual-Force:模仿约束下的增强型离线多样性最大化算法
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG
AI总结 Dual-Force是一种离线算法,通过后继特征的VdW力目标和功能奖励编码,实现模仿约束下的多样化行为策略学习,在Solo12仿真任务中提升了性能与鲁棒性。
智能策略用于在湍流气味团中导航:重新定向到局部风
专题命中 具身导航 :navigation(abstract);robotic(abstract)
AI总结 本文提出了一种基于风的强化学习框架,用于在湍流中导航,通过局部风方向估计和时间间隔来选择动作,展示了在不同风条件下策略的有效性。
OREN:八叉树残差网络用于实时欧几里得符号距离映射
机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电子与计算机工程系)
专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 OREN结合八叉树插值的显式先验和神经网络回归的隐式残差,实现高效且可微的非截断SDF重建,优于现有方法的准确性和效率。
Comments Accepted to IEEE/RSJ International Conference Intelligent Robots & Systems (IROS) 2026
PiDR:面向自主平台的物理信息惯性航位推算
机构 * Autonomous Navigation and Sensor Fusion Lab (ANSFL)(自主导航与传感器融合实验室(ANSFL)) ; Hatter Department of Marine Technologies(海洋技术系) ; Charney School of Marine Sciences(海洋科学学院) ; University of Haifa(海法大学)
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG
AI总结 提出PiDR框架,将惯性导航原理作为物理信息残差融入网络训练,在纯惯性导航中减少轨迹漂移,在移动机器人和水下自主航行器数据集上定位精度提升超29%。
Comments 11 pages and 7 figures
联网自动驾驶车辆中深度多任务学习综述
机构 * Department of Electrical and Computer Engineering, University of Windsor(温莎大学电气与计算机工程系) ; Department of Electrical and Computer Engineering, Queen’s University(皇后大学电气与计算机工程系)
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV、cs.LG
AI总结 综述联网自动驾驶车辆中深度多任务学习,涵盖感知、预测、规划、控制及V2X通信与资源管理,分析现有方法优缺点并指出未来方向。