arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-03 至 2026-04-03 共收录 8 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2604.02023 2026-04-03 cs.CR cs.AI 89%

APEX: Agent Payment Execution with Policy for Autonomous Agent API Access

APEX:基于策略的自主代理API访问支付执行

Mohd Safwan Uddin, Mohammed Mouzam, Mohammed Imran, Syed Badar Uddin Faizan

专题命中 工具调用 :agent(title,abstract);autonomous agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 APEX提出了一种适应法币系统的自主代理支付框架,通过HMAC签名短时令牌实现安全支付流程,实验显示政策控制可减少27.3%的总支出并保持52.8%的合法请求成功率。

Comments 13 pages, 4 figures, 8 tables. Includes implementation details, experimental evaluation with statistical analysis, and reproducible results. Code and data available upon request

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22862 2026-04-03 cs.SE cs.CL 86%

The Evolution of Tool Use in LLM Agents: From Single-Tool Call to Multi-Tool Orchestration

大语言模型代理中工具使用的演变:从单工具调用到多工具编排

Haoyuan Xu, Chang Li, Xinyan Ma, Xianhao Ou, Zihan Zhang, Tao He, Xiangyu Liu, Zixiang Wang, Jiafeng Liang, Zheng Chu, Runxuan Liu, Rongchuan Mu, Dandan Tu, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Harvard University(哈佛大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 工具调用 :tool use(title,abstract);agent(abstract);planning(abstract);分类 cs.CL、cs.SE

AI总结 本文探讨了大语言模型代理中工具使用从单次调用到长期编排的演变,分析了多工具代理的最新进展,涵盖任务规划、安全控制、效率优化及实际应用等领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23752 2026-04-03 cs.CV 80%

ThinkGeo: Evaluating Tool-Augmented Agents for Remote Sensing Tasks

ThinkGeo: 评估用于遥感任务的工具增强代理

Akashah Shabbir, Muhammad Akhtar Munir, Akshay Dudhane, Muhammad Umer Sheikh, Muhammad Haris Khan, Paolo Fraccaro, Juan Bernabe Moreno, Fahad Shahbaz Khan, Salman Khan

机构 * Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学) IBM Research(IBM研究院) Linköping University(林雪平大学) Australian National University(澳大利亚国立大学)

专题命中 工具调用 :tool use(abstract);tool-use(abstract);planning(abstract);agentic(abstract)

AI总结 ThinkGeo是一个针对遥感任务设计的代理基准,评估LLM驱动代理在结构化工具使用和多步骤规划中的能力,通过人类 curated 查询和专家验证的推理步骤测试不同模型的工具准确性和规划一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02155 2026-04-03 cs.CL 77%

Brief Is Better: Non-Monotonic Chain-of-Thought Budget Effects in Function-Calling Language Agents

简洁即更好:函数调用语言代理中的非单调链式思维预算效应

Xuan Qi

机构 * IIIS, Tsinghua University(清华大学交叉信息研究院)

专题命中 工具调用 :agent(abstract);tool-use(abstract);function calling(abstract);分类 cs.CL

AI总结 研究探讨了链式思维预算对函数调用代理性能的影响,发现简短的链式思维显著提升准确性,而延长的链式思维反而降低性能,提出Function-Routing CoT方法提升可靠性。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20755 2026-04-03 cs.LG cs.AI stat.ML 62%

Provable Benefits of In-Tool Learning for Large Language Models

大语言模型中工具学习的可证明优势

Sam Houliston, Ambroise Odonnat, Charles Arnal, Vivien Cabannes

机构 * ETH Zürich(苏黎世联邦理工学院) Inria, Univ. Rennes 2(法国国家信息与自动化研究所,雷恩第二大学) FAIR at Meta(Meta FAIR实验室)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了工具学习在事实回忆中的优势,证明通过工具可实现无限制的事实回忆,优于单纯记忆。

Journal ref ICLR 2026 MemAgents Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.30031 2026-04-03 cs.AI 57%

Cognitive Friction: A Decision-Theoretic Framework for Bounded Deliberation in Tool-Using Agents

认知摩擦:一种决策理论框架,用于工具使用智能体的有限推理

Davide Di Gioia

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 本文提出Triadic Cognitive Architecture框架,通过认知摩擦建模决策过程,提升资源利用效率和行动速度,实验显示在EMDG和NSTG环境中优于贪心基线。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29018 2026-04-03 math.NA cs.NA 50%

Discrete Poincare and Bogovskii operators on cochains and Whitney forms

离散的庞加莱和博戈维斯基算子在余链和惠特尼形式上

Johnny Guzmán, Anil N. Hirani, Bingyan Liu, Pratyush Potu

专题命中 工具调用 :tool use(abstract)

AI总结 本文构造了作用于余链和惠特尼形式的离散庞加莱算子,并探讨了其在不同域假设下的构造方法,同时提出了满足同伦恒等式的离散博戈维斯基算子。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07508 2026-04-03 cs.CE econ.GN q-fin.EC 50%

The Pandora's Box Problem with Sequential Inspections

潘多拉之盒问题与序列检查

Ali Aouad, Jingwei Ji, Yaron Shaposhnik

专题命中 工具调用 :agent(abstract)

AI总结 研究潘多拉之盒问题的扩展形式,探讨信息获取与成本效率的权衡,分析最优策略结构并提出近优解,通过数值研究比较不同策略性能。

详情

展开后加载摘要…

URL PDF HTML 收藏