arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-31 至 2026-03-31 共收录 6 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 6 篇

2603.26995 2026-03-31 cs.RO 71%

SCRAMPPI: Efficient Contingency Planning for Mobile Robot Navigation via Hamilton-Jacobi Reachability

SCRAMPPI: 通过哈密顿-雅可比可达性实现移动机器人导航的高效应急规划

Raj Harshit Srirangam, Leonard Jung, Rohith Poola, Michael Everett

机构 * Northeastern University(东北大学)

专题命中 GUI与网页智能体 :planning(title)

AI总结 本文提出SCRAMPPI算法,通过哈密顿-雅可比可达性分析实现移动机器人导航中的应急规划,结合采样基于规划器(MPPI)提升采样效率,实现实时生成主计划和应急计划。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26859 2026-03-31 cs.CV cs.AI eess.IV 57%

Beyond Textual Knowledge-Leveraging Multimodal Knowledge Bases for Enhancing Vision-and-Language Navigation

超越文本知识的多模态知识库用于增强视觉-语言导航

Dongsheng Yang, Yinfeng Yu, Liejun Wang

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing(丝绸之路多语言认知计算联合国际研究实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出BTK框架,通过整合环境特定文本知识与生成图像知识库,提升视觉-语言导航中的语义 grounding 和跨模态对齐,实验表明在R2R和REVERIE数据集上性能显著提升。

Comments Main paper (37 pages). Accepted for publication by the Information Processing and Management,Volume 63,Issue 6,September 2026,104766

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26741 2026-03-31 cs.CV cs.AI cs.RO 57%

Language-Conditioned World Modeling for Visual Navigation

基于语言的视觉导航世界建模

Yifei Dong, Fengyi Wu, Yilong Dai, Lingdong Kong, Guangyu Chen, Xu Zhu, Qiyu Hu, Tianyu Wang, Johnalbert Garnica, Feng Liu, Siyu Huang, Qi Dai, Zhi-Qi Cheng

机构 * University of Washington(华盛顿大学) National University of Singapore(新加坡国立大学) Clemson University(克莱姆森大学) Drexel University(德雷塞尔大学) Microsoft Research(微软研究院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文研究了基于语言的视觉导航问题,提出LCVN数据集并开发了两种模型家族,通过语言 grounding、未来状态预测和动作生成实现统一任务学习。

Comments 19 pages, 6 figures, Code: https://github.com/F1y1113/LCVN

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04094 2026-03-31 cs.RO 50%

Object-Reconstruction-Aware Whole-body Control of Mobile Manipulators

面向物体重建的移动机械臂整体控制

Fatih Dursun, Bruno Vilhena Adorno, Simon Watson, Wei Pan

机构 * University of Manchester(曼彻斯特大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一种高效方法,通过计算最信息区域的焦点点,使移动机械臂在路径上保持该点在摄像头视野中,从而在不增加路径规划的情况下提升物体重建效率。

Comments 19 pages, 17 figures, 5 tables. Under Review for the IEEE Transactions on Robotics (T-RO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11479 2026-03-31 cs.RO 50%

OVSegDT: Segmenting Transformer for Open-Vocabulary Object Goal Navigation

OVSegDT:用于开放词汇物体目标导航的分割Transformer

Tatiana Zemskova, Aleksei Staroverov, Dmitry Yudin, Aleksandr Panov

机构 * Cognitive AI Systems Lab(认知人工智能系统实验室) MIRAI NUST MISIS(国立研究型技术大学MISIS)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出OVSegDT,一种轻量级Transformer策略,通过语义分支和熵自适应损失调节解决开放词汇物体目标导航中的过拟合和安全问题,提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21798 2026-03-31 eess.SP 50%

Adaptive Multipath-Based SLAM for Distributed MIMO Systems

自适应多径基于的分布式MIMO系统SLAM

Xuhong Li, Benjamin J. B. Deutschmann, Erik Leitinger, Florian Meyer

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出一种基于贝叶斯的多径SLAM方法,用于分布式MIMO系统,解决现有方法在非凸几何环境中融合多径信息的限制,通过自适应检测概率和软射线追踪策略提升定位和建图性能。

Comments 32 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏