Navigating in Uncertain Environments with Heterogeneous Visibility
在不确定环境中利用异质可见性导航
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出了一种基于异质可见性的导航算法,通过优化观察奖励与通行成本之和,有效降低导航成本并提升信息获取效率。
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
在不确定环境中利用异质可见性导航
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出了一种基于异质可见性的导航算法,通过优化观察奖励与通行成本之和,有效降低导航成本并提升信息获取效率。
基于逐步一致运动的移动机器人自主探索精准建图
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出一种面向采用激光SLAM的室内移动机器人的自主探索框架,通过多RRT采样、逐步一致运动等策略提升建图精度与鲁棒性,经仿真与真实实验验证其优于基准2D算法。
Comments 8 pages, 11 figures. This work has been submitted to the IEEE for possible publication
通过信息多视图投影可视化高维图嵌入
机构 * Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院) ; School of Computation, Information and Technology, Technical University of Munich(慕尼黑工业大学计算、信息与技术学院)
专题命中 具身导航 :navigation(abstract);分类 cs.LG
AI总结 提出在高维空间中嵌入图,并通过可微分的边交叉代理搜索优化美学和可读性指标的二维视角,优于标准布局,并引入交互系统DataFly。
Comments 20 pages, 15 figures
全局-局部注意力分解用于人形感知运动中的地形编码
机构 * Tongji University(同济大学) ; Shanghai Innovation Institute(上海创新研究院) ; Shanghai Jiao Tong University(上海交通大学) ; Humanoid Robot (Shanghai) Co., Ltd.(人形机器人(上海)有限公司)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 提出全局-局部注意力分解(GLAD)方法,通过粗到细编码器分离全局地形感知和局部立足点选择,实现人形机器人在稀疏立足点和受限环境中的鲁棒运动。
视角:透视如何影响感知的机器人社交性
机构 * Humanoid Robots Lab, University of Bonn, Germany(波恩大学人形机器人实验室,德国)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文通过VR用户研究,比较全知视角与第一人称视角对机器人轨迹社交性的感知差异,发现全知视角下社交性高的轨迹在近距离第一人称体验中可能更令人不安,而头部点头等社交信号可提升感知社交性。
LineGraph2Road:基于线路图的结构图推理用于道路网络提取
机构 * Stanford University(斯坦福大学) ; Georgia Institute of Technology(佐治亚理工学院)
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 LineGraph2Road通过构建全局稀疏欧几里得图并应用图变换器,提升道路网络提取的连通性预测,解决长距离依赖和复杂拓扑问题,实现高精度道路提取。
CLEAR: 一种用于大规模无结构环境的语义-几何地形抽象
机构 * Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学) ; Department of Mechanical and Aerospace Engineering, University at Buffalo(机械与航空航天工程系,布法罗大学)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 CLEAR通过结合边界感知的空间分解与递归平面拟合,实现了大规模无结构环境中的高效地形抽象,提高了路径规划的速度和可靠性。
Comments Accepted in IEEE RA-L August, 2026
超越Top-K:用可解释智能体操作替代黑盒检索
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 该研究针对长文档检索的结构缺陷,提出无嵌入智能体检索框架READ,在政府财务报告数据集上显著优于密集检索,且性能提升源于操作界面,同时发现BM25与READ无统计差异。
Comments 20 pages, 5 figures, 14 tables. Code, benchmark, and full result trajectories: https://github.com/twospoon/READ
GeminiPainter的序列式流程由感知、认知、规划和行动阶段组成
机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科学技术学院)
专题命中 具身导航 :robotic(abstract);分类 cs.RO
AI总结 该研究提出自主机器人肖像生成系统,整合多技术实现绘画,经实验获用户高分评价,产出可识别且具吸引力的机器人肖像。
评估自主编程代理中的计划合规性
机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校) ; IBM(IBM公司)
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 本文系统分析了编程代理在执行任务时对计划的遵循情况,通过16991条轨迹评估不同计划变体的影响,发现计划提醒能提高任务成功率,但不恰当的计划补充可能降低性能。
隐形墨水威胁:计算机使用智能体中合法任务背后的对抗目标
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 该研究针对计算机使用智能体的隐形墨水威胁,构建II-Bench与HITLCUA框架评估后发现,低危害注入可绕过防御,暴露出现有CUAs的安全风险。
SafeLand: 在未知环境中使用贝叶斯语义映射实现安全自主着陆
机构 * Fraunhofer IVI Autonomous Aerial Systems(弗劳恩霍夫IVI自主航空系统) ; TU Munich Computer Vision Group(慕尼黑工业大学计算机视觉组) ; Munich Center for Machine Learning(慕尼黑机器学习中心)
专题命中 具身导航 :robotics(abstract);分类 cs.RO
AI总结 本文提出SafeLand系统,通过深度学习语义分割构建在线语义地面地图,结合贝叶斯概率过滤和行为树实现安全自主着陆,通过200次模拟和60次实地测试,展示零误报的人类检测率和亚秒响应延迟。
Journal ref ECCV 2026 Workshops
PersonaTrail:通过浏览轨迹对个性化网络代理进行基准测试
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 研究针对用户指令不明确时网络代理需从浏览历史推断上下文的问题,引入PersonaTrail基准及偏好感知上下文记忆框架PACMem,利用浏览轨迹评估代理,实验证明PACMem优于现有基于记忆的基线。
MVP-Tac:一种用于机器人辅助微创手术的小型化双模态视觉与光弹性触觉传感器
机构 * Elmore Family School of Electrical and Computer Engineering, Purdue University(普渡大学埃尔莫尔电气与计算机工程学院) ; Edwardson School of Industrial Engineering, Purdue University(普渡大学爱德华森工业工程学院) ; School of Mechanical Engineering, Purdue University(普渡大学机械工程学院) ; Robotics Engineering Technology, Purdue University(普渡大学机器人工程技术学院) ; Department of Civil Engineering, Stony Brook University(石溪大学土木工程系) ; Department of Mechanical Engineering, Michigan State University(密歇根州立大学机械工程系)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 研究针对机器人辅助微创手术缺乏触觉反馈问题,介绍了MVP-Tac传感器,它采用反射光弹性成像,能在视觉触觉间切换,经力校准及肿瘤触诊等实验验证其有效性,为恢复RMIS中触诊并保持视觉反馈提供实用途径。
Comments 8 pages, 8 figures. To appear in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026
MeSS: 基于城市网格的户外场景生成与跨视角一致扩散
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 MeSS通过改进跨视角一致性,利用城市网格模型生成高质量且风格一致的户外场景,并结合3D高斯点划重建技术提升生成质量。
识别机器人协同设计的归纳偏置
机构 * Robotics and Biology Laboratory, Technische Universität Berlin(柏林工业大学机器人与生物学实验室) ; Science of Intelligence (SCIoI), Cluster of Excellence, Berlin, Germany(德国柏林卓越集群“智能科学”(SCIoI))
专题命中 具身导航 :manipulation(abstract);分类 cs.RO
AI总结 本文通过分析软运动和操作任务的协同设计景观,识别出三种跨区域一致的模式,提出高效的协同设计算法,比基准算法提升36%,并在样本效率上提升两序量级。
从船舶轨迹到安全关键性遭遇场景:一种生成式AI框架用于自主船舶数字测试
专题命中 具身导航 :navigation(abstract);分类 cs.LG
AI总结 本文提出一种数据驱动框架,将大规模AIS轨迹转化为结构化安全关键性遭遇场景,结合生成轨迹建模与自动化遭遇配对,提升场景生成的可扩展性与真实性。
Comments 19 pages
3D-CovDiffusion:面向覆盖路径规划的三维感知扩散策略
机构 * IEEE
专题命中 具身导航 :robotic(abstract);分类 cs.RO
AI总结 本文提出 3D-CovDiffusion,将覆盖路径规划转化为条件序列生成问题,采用几何条件扩散框架从三维点云合成轨迹,相比基线方法在轨迹平滑度、覆盖率等指标上实现显著提升。
Good Weights:用于连续鲁棒视觉SLAM的主动自适应航位推算融合算法
机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) ; Institute of Robotics and Intelligent Machines(机器人与智能机械研究所) ; Georgia Institute of Technology(佐治亚理工学院)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出Good Weights算法,通过自适应融合航位推算与被动视觉SLAM,解决纹理缺失等环境下视觉SLAM位姿估计差、跟踪丢失的问题,提升了视觉SLAM的性能与鲁棒性。
Comments 8 pages, 9 figures, 1 table. Accepted to ICRA 2026
ARCSnake V2:适用于水陆两栖多领域的螺旋推进蛇形机器人的机械改进
机构 * Mechanical and Aerospace Engineering Department, University of California San Diego(加州大学圣地亚哥分校机械与航空航天工程系) ; Electrical and Computer Engineering Department, University of California, San Diego(加州大学圣地亚哥分校电气与计算机工程系)
专题命中 具身导航 :robotic(abstract);分类 cs.RO
AI总结 ARCSnake V2是ARCSnake V1的改进型两栖螺旋推进蛇形机器人,结合超冗余蛇形机器人高机动性与阿基米德螺旋推进的地形适应性,经实验验证具备水下作业能力,可作为多领域探索等任务的多功能平台。
Comments 8 pages, 5 figures, IROS
RVC-NMPC:基于互斥碰撞回避的非线性模型预测控制
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出一种基于RVC-NMPC的非线性模型预测控制方法,通过高效计算和直接整合互斥速度约束,实现高频率的碰撞回避控制,适用于敏捷无人机飞行。
Comments 8 pages, 8 figures
利用动态图与轨道数据条件化预测GNSS视线上电离层不规则性
机构 * Nanyang Technological University(南洋理工大学)
专题命中 具身导航 :navigation(abstract);分类 cs.LG
AI总结 本文提出利用动态图和轨道数据条件化预测GNSS视线上电离层不规则性,通过构建动态图结构提升预测精度,实验结果显示模型在BSS和PR-AUC指标上均优于传统方法。
Comments 17 pages, 8 figures, submitted to IEEE Transactions on Geoscience and Remote Sensing
将全球导航卫星系统(GNSS)导出的天顶湿延迟整合到天气基础模型中可改善降水预报
机构 * Weather Foundation(天气基金会)
专题命中 具身导航 :navigation(abstract);分类 cs.LG
AI总结 研究将GNSS导出的ZWD整合到Aurora天气基础模型中,扩展后的模型学习ZWD能力与预训练变量相当,微调时纳入ZWD可改善降水预报,增益随严重程度增加,能让降水功率谱更现实。
MAGS-SLAM:单目多智能体高斯点云SLAM用于几何和光度一致的重建
机构 * ETH Zurich(苏黎世联邦理工学院) ; Harbin Engineering University(哈尔滨工程大学) ; University of Liverpool(利物浦大学) ; University of Macau(澳门大学) ; University of Ottawa(多伦多大学) ; Wuhan University(武汉大学) ; Imperial College London(伦敦帝国学院)
专题命中 具身导航 :robotic(abstract);分类 cs.RO
AI总结 MAGS-SLAM通过单目视觉实现多智能体高斯点云SLAM,无需RGB-D传感器即可完成几何和光度一致的场景重建,实验表明其跟踪精度和渲染质量可与现有RGB-D方法媲美。
基于专家混合模型的自行车定位学习惯性里程计
机构 * School of Geodesy and Geomatics(测绘学院) ; GNSS Research Center(GNSS研究中心) ; Hubei Luojia Laboratory(湖北珞珈实验室)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 针对城市峡谷中自行车定位难题,提出基于MoE网络的学习惯性里程计,将神经速度预测器与扩展卡尔曼滤波器耦合,减少计算开销,在低FLOPs下取得良好精度和泛化能力,优于其他模型。
Comments This work has been submitted to the IEEE for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible
CodexGraph:通过代码图数据库连接大型语言模型和代码库
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 研究旨在解决大型语言模型处理整个代码库的难题,提出通过将LLM代理与代码库图数据库接口集成的CodexGraph系统,利用图数据库特性实现精确上下文检索和代码导航,经多基准评估及实际应用开发,展现其在软件工程中的竞争力与潜力。
Comments work in progress
WebCoach:具有跨会话记忆引导的自我进化网络代理
机构 * University of California, Los Angeles(加州大学洛杉矶分校) ; Amazon(亚马逊)
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 研究针对网页代理跨会话学习不足问题,提出WebCoach框架,通过三个关键组件赋予代理跨会话记忆,可长期规划与自我进化,在WebVoyager基准测试中提升了不同LLM backbone的代理性能。
Comments 18 pages
pacSTL: 基于数据驱动可达性分析的PAC有界信号时序逻辑
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 提出pacSTL框架,结合PAC有界可达集预测与区间STL,通过优化问题计算原子鲁棒性上下界并传播,实现规范级别的PAC有界鲁棒性评估,用于不确定动态系统的验证与监控。
交互式医学-SAM2 GUI:基于Napari的半自动标注工具用于医学图像
机构 * Department of Biomechatronic Engineering, Sungkyunkwan University(生物机电工程系,全州大学) ; Department of Neurosurgery, Seoul National University Hospital, Seoul National University College of Medicine(神经外科,首尔国立大学医院,首尔国立大学医学院)
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 交互式医学-SAM2 GUI 提供基于Napari的本地工作流,实现高效的3D医学图像半自动标注与导出功能。
Comments Planning to submit JOSS (Journal of Open Source Software)
MVGD-Net: 一种新颖的运动感知视频玻璃表面检测网络
机构 * Tao Yan(谭燕)
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 MVGD-Net通过利用视频中运动不一致特性,提出新颖网络检测玻璃表面,结合多模块融合与大规模数据集提升检测性能。
Comments This paper has been accepted by the 40th AAAI Conference on Artificial Intelligence (AAAI-26). It contians 9 pages, 11 figures