arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 103 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 103 篇

2511.12501 2026-06-26 cs.NI 版本更新 50%

Collaborative Charging Optimization for Wireless Rechargeable Sensor Networks via Heterogeneous Mobile Chargers

异构移动充电器协同优化无线可充电传感器网络充电

Jianhang Yao, Hui Kang, Geng Sun, Jiahui Li, Hongjuan Li, Jiacheng Wang, Yinqiu Liu

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 针对无线可充电传感器网络能量受限问题,提出异构移动充电架构,结合无人机与地面智能车协同充电,并设计IHATRPO算法优化充电效率,显著降低节点死亡率。

Comments 16 pages, 52 figures, submitted to IEEE Internet of Things Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08766 2026-06-24 physics.flu-dyn 版本更新 50%

Optimal navigation in two-dimensional flows: Control theory and reinforcement learning

二维流动中的最优导航:控制理论与强化学习

Vladimir Parfenyev

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 研究在二维流动中,受平流和自推进的智能体(如漂浮无人机)的最小时间路径问题,利用最优控制理论求解,并应用强化学习(Q学习和演员-评论家算法)设计鲁棒导航策略,在规则流中接近最优解,在湍流中偏差增大,且粗粒化训练可泛化至全流场。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17525 2026-06-23 cs.RO 版本更新 50%

HumanHalo -- Safe and Efficient 3D Navigation Among Humans via Minimally Conservative MPC

HumanHalo -- 通过最小保守MPC实现安全高效的三维人群导航

Simon Schaefer, Helen Oleynikova, Sandra Hirche, Stefan Leutenegger

机构 * Technical University of Munich(慕尼黑技术大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 提出HumanHalo框架,结合可达性安全保证与数据驱动人体运动预测,通过仅约束初始控制输入实现安全高效的3D MAV人群导航,在仿真和真实实验中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18313 2026-06-23 cs.CV 版本更新 50%

OmniNWM: Omniscient Driving Navigation World Models

OmniNWM:全知驾驶导航世界模型

Bohan Li, Zhuang Ma, Dalong Du, Baorui Peng, Zhujin Liang, Zhenqiang Liu, Xianda Guo, Zheng Zhu, Chao Ma, Yueming Jin, Xin Jin, Hao Zhao, Wenjun Zeng

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(东部技术研究所) PhiGent National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) Wuhan University(武汉大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 提出OmniNWM全知全景导航世界模型,在统一概率框架下处理状态、动作和奖励三个维度,实现多模态全景视频生成、零样本轨迹控制及内在奖励机制,在生成保真度和控制精度上达到SOTA。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16000 2026-06-23 cs.CV 版本更新 50%

SenseExpo: Spatial Exploration and Navigation via Scene Estimation from Expeditious Predictive Operators

SenseExpo: 通过快速预测算子的场景估计进行空间探索与导航

Haojia Gao, Haohua Que, Mingkai Liu, Jiayue Xie, Hoiian Au, Yusen Qin, Qian Zhang, Jiajun Sun, Weihao Shan, Tianle Zhu, Handong Yao, Fei Qiao

机构 * Tsinghua University(清华大学) University of Georgia(佐治亚大学) Peking University(北京大学) D-Robotics(D-机器人) Infinity Robotics(Infinity机器人)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 提出轻量级单机器人探索框架SenseExpo,结合紧凑地图预测网络与前沿策略,以709K参数实现优于U-Net和LaMa的预测性能,并在探索实验中显著加速目标覆盖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02773 2026-06-16 cs.RO 版本更新 50%

Bimanual High-Density EMG Control for In-Home Mobile Manipulation by Users with Quadriplegia

用于四肢瘫痪用户居家移动操作的双侧高密度肌电控制

Jehan Yang, Eleanor Hodgson, Cindy Sun, Zackory Erickson, Doug Weber

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 针对颈椎脊髓损伤用户,提出双侧高密度肌电(HDEMG)前臂袖套,结合共享自主框架实现实时手势控制移动操作器,经12天居家研究验证日常任务有效性。

Comments 17 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15919 2026-06-16 cs.RO 版本更新 50%

ReMoBot: Retrieval-Based Few-Shot Imitation Learning for Mobile Manipulation with Vision Foundation Models

ReMoBot: 基于检索的少样本模仿学习用于移动操作与视觉基础模型

Yuying Zhang, Wenyan Yang, Francesco Verdoja, Ville Kyrki, Joni Pajarinen

机构 * School of Electrical Engineering, Aalto University, Espoo, Finland(艾尔沃大学电气工程学院,埃斯波,芬兰)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 提出ReMoBot,一种基于检索的少样本模仿学习框架,利用视觉基础模型从演示中检索信息,解决移动操作任务中的部分可观测性和数据有限问题,在真实世界任务中取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04988 2026-06-16 cs.RO cs.SY eess.SY 版本更新 50%

Intelligent Sailing Model for Open Sea Navigation

公海航行智能航行模型

Hanna Krasowski, Stefan Schärdinger, Murat Arcak, Matthias Althoff

机构 * University of California, Berkeley(加州大学伯克利分校) Technical University of Munich(慕尼黑技术大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 提出首个智能航行模型(ISM),模拟遵守海上交通规则的船舶,结合模型预测控制实现航点跟踪,在交互仿真中达到约97%的目标到达率且无碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01621 2026-06-12 cs.CV cs.RO 版本更新 50%

Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation

Goal2Pixel: 将目标锚定到像素以实现视觉语言导航

Muyi Bao, Yuxin Cai, Hang Xu, Zongtai Li, Jinxi He, Jingfan Tang, Chen Lv, Ji Zhang, Yaqi Xie, Wenshan Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) Nanyang Technological University(南洋理工大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 提出Goal2Pixel范式,通过将连续环境中的视觉语言导航(VLN-CE)重新定义为可导航像素锚定,利用图像平面作为统一空间接口,预测可见导航像素并反投影为3D航点,结合可见性感知关键帧记忆和坐标感知辅助损失,在减少VLM调用次数的同时实现竞争性性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02519 2026-06-09 cs.RO 版本更新 50%

IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?

IMAC-AgriVLN:农业视觉与语言导航智能体能否意识到指令错误?

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学) China Agricultural University-Sichuan Advanced Agricultural & Industrial Institute(中国农业大学-四川先进农业与工业研究院)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 针对农业VLN中指令可能错误的问题,提出A2A-MI基准和IMAC模块,通过分析指令与前方图像判断并纠正错误,显著提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18670 2026-06-08 cs.NI 版本更新 50%

Masking Intent, Sustaining Equilibrium: Risk-Aware Potential-Game-Based Service Provision in Dynamic Mobile Crowdsensing

掩盖意图,维持平衡:基于风险的潜在游戏的动态移动 crowdsensing 服务提供

Houyi Qi, Minghui Liwang, Kaiwen Tan, Wenyong Wang, Sai Zou, Yiguang Hong, Xianbin Wang, Wei Ni

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出iParts框架,通过隐私保护和风险意识的两阶段方法,解决动态移动 crowdsensing 中任务完成、预算可行性和传感质量的不确定性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22041 2026-06-08 cs.MA cs.CY 版本更新 50%

Using Feasible Action-Space Reduction by Groups to fill Causal Responsibility Gaps in Spatial Interactions

通过群体可行动作空间缩减来填补空间互动中的因果责任空缺

Ashwin George, Vassil Guenov, Arkady Zgonnikov, David A. Abbink, Luciano Cavalcante Siebert

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出一种群体因果责任度量方法,用于解决个体中心度量在因果过定性情况下失效的问题,通过定义积极影响类型和分层算法来识别因果责任主体,并通过场景模拟展示群体效应的动态变化。

Comments Presented at COINE workshop collocated with AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11740 2026-06-08 cs.RO 版本更新 50%

From Pixels to Shelf: An Integrated Robotic System for Autonomous Supermarket Stocking with a Mobile Manipulator

从像素到货架:基于移动操作臂的自主超市补货集成机器人系统

Davide Peron, Victor Nan Fernandez-Ayala, Lukas Segelmark

机构 * Department of Information Engineering, University of Padova(帕多瓦大学信息工程系) Division of Decision and Control Systems, School of Electrical Engineering and Computer Science, KTH Royal Institute of Technology(皇家理工学院电气工程与计算机科学学院决策与控制系统系) Animum AB(Animum公司)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 提出一种集成商用硬件与ROS2的模块化机器人系统,利用行为树规划、视觉检测和两步MPC控制,在700多次补货实验中实现98%以上的抓取成功率,但性能仍逊于人类工人。

Comments Preprint for CASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏