arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-10 至 2026-06-10 共收录 17 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 17 篇

2606.09916 2026-06-10 cs.LG cs.AI 新提交 89%

IntentKV: Cross-Turn Intent-Aware KV Cache Pruning for Agent Inference

IntentKV: 面向Agent推理的跨轮次意图感知KV缓存剪枝

Junjie Li, Jiong Lou, Jie Li

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 工具调用 :agent(title,title_cn);分类 cs.AI、cs.LG

AI总结 针对多轮LLM Agent中KV缓存成为服务瓶颈的问题,提出IntentKV方法,通过会话级QueryMemory和残差注意力头实现跨轮次意图感知的KV剪枝,在保持精度的同时大幅降低峰值请求token和KV读取量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10803 2026-06-10 cs.CL cs.AI cs.CV 新提交 86%

Beyond APIs: Probing the Limits of MLLMs in Physical Tool Use

超越API:探索多模态大语言模型在物理工具使用中的极限

Zhixin Ma, Yutong Zhou, Yongqi Li, Chong-Wah Ngo, Wenjie Li

机构 * Singapore Management University(新加坡管理大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 工具调用 :tool use(title,abstract);tool-use(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 提出PhysTool-Bench基准,评估多模态大语言模型在真实场景中识别物理工具并规划使用的能力,发现最强模型仅完成21%任务,揭示感知与规划双重缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00809 2026-06-10 cs.OH cs.AI cs.MA 85%

A Modular Reference Architecture for MCP-Servers Enabling Agentic BIM Interaction

一种模块化参考架构用于MCP服务器,以实现代理BIM交互

Tobias Heimig-Elschner, Changyu Du, Anna Scheuvens, André Borrmann, Jakob Beetz

机构 * Chair of Design Computation, RWTH Aachen University(设计计算系,亚琛工业大学) Chair of Computing in Civil and Building Engineering, Technical University of Munich(土木与建筑工程计算系,慕尼黑技术大学) Federal Institute for Research on Building, Urban Affairs and Spatial Development (BBSR)(建筑、都市事务和空间发展研究院) TUM Georg Nemetschek Institute(慕尼黑技术大学Georg Nemetschek研究所)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种模块化参考架构,通过解耦MCP接口与特定BIM-API,实现API无关、隔离且可重复的BIM代理交互,提升重用性和研究系统性。

Comments Accepted at the GNI Symposium on Artificial Intelligence for the Built World (Technical University of Munich, May 18--20, 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07920 2026-06-10 math.OC 版本更新 82%

Combining Reinforcement Learning with Arc-search Interior-Point Method for Path Planning

结合强化学习与弧搜索内点法的路径规划

Yaguang Yang, Qiang Le, Isaac E. Weintraub

专题命中 工具调用 :planning(title,abstract);agent(abstract)

AI总结 提出一种结合强化学习与弧搜索内点法的框架,利用强化学习的实时决策能力和弧搜索内点法的优化性能,实现障碍物环境下的高效路径规划。

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10438 2026-06-10 econ.TH 新提交 78%

Sequential Search with Planning

带有规划的序贯搜索

Ruhi Sonal, Saptarshi Mukherjee, Abhinaba Lahiri, Aniruddha Ghosh

专题命中 工具调用 :planning(title,abstract)

AI总结 本文通过有序潘多拉盒子模型研究新产品开发或资源勘探中的序贯搜索,引入规划成本,证明存在与已支付范围相关的保留值,并分析保证效应、已支付范围效应和剩余阶段效应对最优策略的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10875 2026-06-10 cs.CL 新提交 77%

Pushing the Limits of LLM Tool Calling via Experiential Knowledge Integration and Activation

通过经验知识集成与激活推动LLM工具调用极限

Yupu Hao, Zhuoran Jin, Huanxuan Liao, Kang Liu, Jun Zhao

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 工具调用 :autonomous agent(abstract);tool use(abstract);tool-use(abstract);分类 cs.CL

AI总结 研究如何通过经验知识获取、激活和内化提升LLM多步工具调用性能,提出知识增强工具执行框架KATE,结合宽度扩展推理与知识感知训练,在BFCL-V3和AppWorld上显著优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10709 2026-06-10 cs.IR cs.AI 新提交 74%

Effective Reinforcement Learning for Agentic Search by Recycling Zero-Variance Queries During Training

通过训练期间回收零方差查询实现智能体搜索的有效强化学习

João Coelho, João Magalhães, Bruno Martins, Chenyan Xiong

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所) Instituto Superior Técnico and INESC-ID, University of Lisbon(里斯本大学理工学院和INESC-ID) NOVA LINCS, NOVA School of Science and Technology(NOVA科学与技术学院LINCS)

专题命中 工具调用 :agentic(title);分类 cs.AI

AI总结 提出查询回收方法,将训练中零方差查询重新投入采样池,使有效训练分布随策略演化,1.7B模型在7个多跳QA基准上平均Pass@1达66.0,匹配或超越7B模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19218 2026-06-10 cs.SE cs.MA 版本更新 74%

Gecko: A Simulation Environment with Stateful Feedback for Refining Agent Tool Calls

Gecko: 一种具有状态反馈的仿真环境,用于优化智能体工具调用

Zeyu Zhang, Guohao Li, Zhenchang Xing, Alexandros Apostolopoulos, Yu Lin Lee, Liang Zheng

专题命中 工具调用 :agent(title);分类 cs.SE

AI总结 提出Gecko仿真环境,通过规则与LLM结合提供工具名称/参数验证、模式一致响应合成和任务完成判断三类反馈,形成GATS方法,在BFCLv3和τ²-bench上显著提升LLM工具调用性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04935 2026-06-10 cs.SE cs.AI 版本更新 73%

ASA: Backbone-Training-Free Representation Engineering for Tool-Calling Agents

ASA:无需骨干训练的工具调用智能体表示工程

Youjin Wang, Run Zhou, Yingjie Ma, Rong Fu, Jiani Liang, Shuaishuai Cao, Min Huang, Tao Fang, Liangming Pan

机构 * Renmin University of China(中国人民大学) University of Macau(澳门大学) Central South University(中南大学) Jiangxi Normal University(江西师范大学) Macau Millennium College(澳门 millennium 学院) Peking University(北京大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);分类 cs.AI、cs.SE

AI总结 针对大语言模型在工具调用中的惰性代理问题,提出一种无需训练、推理时激活干预的方法ASA,通过路由条件混合引导向量和探针引导门控,显著提升工具使用F1并降低误报率。

Comments The manuscript consists of 24 pages formatted in the ACL style. Youjin Wang, Run Zhou, and Yingjie Ma contributed equally to this work. Tao Fang and Liangming Pan are the co-corresponding authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10304 2026-06-10 cs.CL 新提交 70%

MIRAGE: A Polarity-Flipping Encoding Subspace in LLM Agents

MIRAGE: LLM智能体中的极性翻转编码子空间

Pratibha Revankar, Kargi Chauhan, Jihye Kim, Sadiba Nusrat Nur, Vincent Siu, Chenguang Wang

机构 * University of California, Santa Cruz(加州大学圣克ruz分校)

专题命中 工具调用 :planning(abstract);agentic(abstract);分类 cs.CL

AI总结 发现LLM智能体在隐蔽编码敏感数据时,残差流中存在共享的低维编码子空间,通过逻辑回归探针可高精度检测,并构建MIRAGE实时监控器,在126个场景中AUC达0.918,远超仅输出检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01248 2026-06-10 cs.LG 版本更新 70%

$S^3$-R1: Learning to Retrieve and Answer Step-by-Step with Synthetic Data

$S^3$-R1: 通过合成数据学习逐步检索与回答

Harsh Goel, Akhil Udathu, Susmija Jabbireddy, Pradnesh Kalkar, Atharva Parulekar

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Google DeepMind(谷歌DeepMind)

专题命中 工具调用 :tool-use(abstract);agentic(abstract);分类 cs.LG

AI总结 提出S^3-R1框架,通过合成数据生成和密集奖励信号,解决强化学习后训练中稀疏奖励和缺乏多跳问题数据的问题,提升模型搜索与问答能力。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16700 2026-06-10 cs.SE cs.AI cs.ET cs.HC 版本更新 62%

Adoption of Generative Artificial Intelligence in the German Software Engineering Industry: An Empirical Study

生成式人工智能在德国软件工程行业的采用:一项实证研究

Ludwig Felder, Tobias Eisenreich, Mahsa Fischer, Stefan Wagner, Chunyang Chen

机构 * Technical University of Munich(慕尼黑技术大学) Heilbronn University of Applied Science(海德堡应用科学大学)

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.SE

AI总结 通过混合方法研究德国软件工程师采用生成式AI工具的情况,发现经验水平调节感知收益,组织规模影响工具选择和使用强度,项目上下文意识不足是主要障碍。

Comments Accepted at FSE '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09863 2026-06-10 cs.LG 新提交 57%

From Confident Closing to Silent Failure: Characterizing False Success in LLM Agents

从自信收尾到无声失败:LLM智能体中的虚假成功特征分析

Laksh Advani

机构 * Laksh Advani

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 研究LLM智能体在环境状态未完成时声称任务完成的虚假成功模式,发现其普遍存在但检测困难,轻量级TF-IDF检测器优于LLM评判器。

Comments Accepted to FAGEN@ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04397 2026-06-10 cs.SE cs.IR 版本更新 57%

Context-as-AI-Service: Surfacing Cross-File Dependency Chains for LLM-Generated Developer Documentation

上下文即服务:为LLM生成的开发者文档揭示跨文件依赖链

Ameya Gawde, Vyzantinos Repantis, Harshvardhan Singh, Lucy Moys

专题命中 工具调用 :agent(abstract);分类 cs.SE

AI总结 提出Context-as-a-Service (CaaS)检索层,通过索引代码库并支持关键词与语义搜索,帮助LLM代理在生成或审查文档时追踪跨文件依赖链,实验表明CaaS能发现基线遗漏的错误并减少时间和输入令牌消耗。

Comments 8 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11145 2026-06-10 cs.CR 新提交 50%

OpenPCC: Open and Confidential LLM Serving on Commodity TEEs

OpenPCC:在商用TEE上提供开放且保密的LLM服务

Haoling Zhou, Shixuan Zhao, Chao Wang, Zhiqiang Lin

专题命中 工具调用 :AI agent(abstract)

AI总结 针对云推理服务中用户请求包含敏感信息的问题,提出OpenPCC框架,利用商用TEE实现开放、保密的LLM服务,并通过原型验证其可行性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10579 2026-06-10 cs.RO cs.SY eess.SY 新提交 50%

LieIPM: Lie Group Interior Point Method for Direct Trajectory Optimization of Rigid Bodies

LieIPM:用于刚体直接轨迹优化的李群内点法

Sangli Teng, Ruiqi Zhang, Tzu-Yuan Lin, William A Clark, Mark Mueller, Ram Vasudevan, Maani Ghaffari, Koushil Sreenath

机构 * University of California, Berkeley(加州大学伯克利分校) MIT(麻省理工学院) Ohio University(俄亥俄大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

专题命中 工具调用 :planning(abstract)

AI总结 提出一种基于李群结构的约束轨迹优化框架LieIPM,利用二阶刚体模型和变分积分器,实现无奇异、快速收敛的牛顿型更新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10215 2026-06-10 physics.space-ph physics.plasm-ph 新提交 50%

LEAP: A Rapid Neural Surrogate of Multi-Fluid MHD at Europa

LEAP: 欧罗巴多流体磁流体动力学的快速神经替代模型

Sachin Alexander Reddy, Abigail R. Azari, Corey J. Cochrane, Xianzhe Jia, Tom A. Nordheim, Lukas Mandrake, Steven D. Vance, Camilla Harris, Ioana Ciucǎ

专题命中 工具调用 :planning(abstract)

AI总结 针对欧罗巴地下海洋探测中MHD模型计算成本高的问题,提出基于Transformer的替代模型LEAP,实现毫秒级预测磁场扰动,速度提升约40000倍,精度与MHD相当。

详情

展开后加载摘要…

URL PDF HTML 收藏