arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-21 至 2026-08-21 共收录 9 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2605.10555 2026-08-21 cs.AI 版本更新 92%

Agent-First Tool API: A Semantic Interface Paradigm for Enterprise AI Agent Systems

代理优先工具API:面向企业AI代理系统的语义接口范式

Kai Pan, Rong Hou

机构 * A2A Lab(A2A实验室)

专题命中 工具调用 :agent(title,summary_cn);AI agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出Agent-First Tool API范式,通过六动词语义协议、标准化工具合同和双层治理管道,解决传统API与自主代理需求的五大匹配问题,实验证明其在任务成功率、人工干预和自主纠错方面显著优于传统CRUD方法。

Comments Metadata correction: Rong Hou was inadvertently omitted from the arXiv author metadata. The author list in the manuscript already included Rong Hou. The manuscript content is unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20314 2026-08-21 cs.AI 新提交 90%

MidTool: Mid-training Data Synthesis for Agentic Tool Use

MidTool:面向智能体工具使用的训练中期数据合成

Fengqing Jiang, Yite Wang, Boyi Liu, Zhaoyang Wang, Canwen Xu, Zhewei Yao, Radha Poovendran, Yuxiong He

机构 * University of Washington(华盛顿大学) Snowflake(雪花公司) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 工具调用 :tool use(title,abstract);agentic(title,abstract);tool-use(abstract);workflow(abstract)

AI总结 本研究提出MidTool流水线,构建面向智能体工具使用的训练中期数据,在MidTool-Mix上微调Qwen3模型,可显著提升工具使用相关下游任务性能,证明通用工具使用需专门训练中期调整。

Comments Data & Model: this https URL (https://hf.co/collections/MidTool/midtool-release)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20317 2026-08-21 cs.IR 新提交 82%

Projecting BrowseComp-Plus onto ClimbMix: Toward More Realistic Corpora for Agentic Search

将BrowseComp-Plus映射到ClimbMix:构建更符合智能体搜索需求的真实语料库

Sahel Sharifymoghaddam, Lingwei Gu, Yijun Ge, Jimmy Lin

专题命中 工具调用 :agentic(title,abstract);agent(abstract)

AI总结 该研究将BrowseComp-Plus的查询映射到NVIDIA的ClimbMix语料库,构建了与基准无关的映射流水线,生成57个有效查询,使智能体搜索难度向检索环节转移,发布了相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19303 2026-08-21 cs.AI cs.CL cs.SE 新提交 75%

Outcome Monitors: Recovery Affordances for Silent Tool Failures

结果监控器:针对静默工具故障的恢复可行性

Sugam Panthi, Rabab Abdelfattah

专题命中 工具调用 :agent(abstract,abstract_cn);分类 cs.AI、cs.CL、cs.SE

AI总结 该研究针对智能体决策中的静默工具故障问题,提出结果监控器方法,可检测结果契约违反并提供恢复工具,显著提升ToolMaze和tau-bench任务的完成率。

Comments 16 pages (9 main + 7 pages supplementary material), 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00156 2026-08-21 cs.RO 版本更新 67%

Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search

双信息引导的垂直扩展用于任意时间冲突搜索中的多目标节点选择

Willem van Osselaer, Jiarui Li, Meshal Alharbi, Gioele Zardini

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 提出DIVE策略,通过最佳边界搜索与深度优先搜索结合,在保持最优性的同时减少搜索中断、提供早期可行解并降低内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01548 2026-08-21 cs.AI cs.LG 版本更新 62%

LLM Capability Limits: Static Emergence and Dynamic Boundary Control

涌现不变性:从符号化思维到结构控制

Yi Liu

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

AI总结 该研究形式化了语言为核心的智能的限制,提出动态边界控制框架,通过DeepSeek V4-Flash实验验证其可提升大语言模型的推理性能,组织了大语言模型的涌现限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17546 2026-08-21 cs.SE 版本更新 57%

REST API Testing with Verified LLM-Inferred Dependencies and Response-Driven Refinement

基于经验证的LLM推断依赖关系与响应驱动优化的REST API测试

Tu Nguyen, Thanh Nguyen, Huy Nguyen, Viet Nguyen, Tien N. Nguyen, Vu Nguyen

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 本文提出APIPilot框架,通过执行验证LLM推断的REST API依赖关系,结合响应驱动优化,在16个真实API上实现高覆盖率与成功率,优于现有基线。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19933 2026-08-21 cond-mat.mtrl-sci 新提交 50%

Building atomistic models of heterointerfaces with optimal transport

基于最优传输构建异质界面的原子模型

Yuxuan Tang, Keith T. Butler

专题命中 工具调用 :workflow(abstract)

AI总结 本文提出融合格罗莫夫-瓦瑟斯坦(FGW)距离结合贝叶斯优化的工作流,构建异质界面原子模型,可高效筛选界面晶格匹配关系,性能优于随机搜索及预训练MACE能量引导方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16004 2026-08-21 math.FA math.CV 版本更新 50%

A proof of Esterle's conjecture on negative powers of Hilbert-space contractions

关于Hilbert空间收缩算子负幂的Esterle猜想的证明

Thomas Ransford

专题命中 工具调用 :tool use(abstract)

AI总结 本文证明了Esterle关于Hilbert空间收缩算子负幂的猜想,通过构造正序列验证了在特定条件下的算子为单位算子。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏