arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 92539 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5014 篇

2501.18922 2025-06-02 cs.CL cs.AI cs.DB 84%

KBQA-o1: Agentic Knowledge Base Question Answering with Monte Carlo Tree Search

Haoran Luo, Haihong E, Yikai Guo, Qika Lin, Xiaobao Wu, Xinyu Mu, Wenhao Liu, Meina Song, Yifan Zhu, Luu Anh Tuan

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

Comments Accepted by ICML 2025 main conference

Journal ref ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21237 2025-03-28 cs.IR cs.AI cs.CL 84%

Bias-Aware Agent: Enhancing Fairness in AI-Driven Knowledge Retrieval

Karanbir Singh, William Ngu

专题命中 工具调用 :agent(title);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11444 2025-03-17 cs.MA cs.AI cs.CL cs.OS 84%

Cerebrum (AIOS SDK): A Platform for Agent Development, Deployment, Distribution, and Discovery

Balaji Rama, Kai Mei, Yongfeng Zhang

专题命中 工具调用 :agent(title,abstract);tool-use(abstract);分类 cs.AI、cs.CL

Comments Accepted to the 2025 Annual Conference of the North American Chapter of the Association for Computational Linguistics (NAACL) - System Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04479 2025-03-12 cs.AI cs.SE 84%

ToolFuzz -- Automated Agent Tool Testing

Ivan Milev, Mislav Balunović, Maximilian Baader, Martin Vechev

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05366 2025-01-10 cs.AI cs.CL cs.IR 84%

Search-o1: Agentic Search-Enhanced Large Reasoning Models

Xiaoxi Li, Guanting Dong, Jiajie Jin, Yuyao Zhang, Yujia Zhou, Yutao Zhu, Peitian Zhang, Zhicheng Dou

专题命中 工具调用 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14054 2024-11-22 cs.CL cs.AI 84%

FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs

Shinbok Lee, Gaeun Seo, Daniel Lee, Byeongil Ko, Sunghee Jung, Myeongcheol Shin

专题命中 工具调用 :tool-use(title,abstract);function calling(abstract);分类 cs.AI、cs.CL

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19054 2024-10-28 cs.AI cs.CL 84%

Infogent: An Agent-Based Framework for Web Information Aggregation

Revanth Gangi Reddy, Sagnik Mukherjee, Jeonghwan Kim, Zhenhailong Wang, Dilek Hakkani-Tur, Heng Ji

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract);分类 cs.AI、cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04474 2024-02-23 cs.SE cs.AI cs.PL 84%

Reverse Chain: A Generic-Rule for LLMs to Master Multi-API Planning

Yinger Zhang, Hui Cai, Xeirui Song, Yicheng Chen, Rui Sun, Jing Zheng

专题命中 工具调用 :planning(title);tool-use(abstract);function calling(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08693 2023-12-05 cs.AI cs.LG 84%

AI planning in the imagination: High-level planning on learned abstract search spaces

Carlos Martin, Tuomas Sandholm

专题命中 工具调用 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18062 2023-12-01 cs.LG cs.AI 84%

Understanding Your Agent: Leveraging Large Language Models for Behavior Explanation

Xijia Zhang, Yue Guo, Simon Stepputtis, Katia Sycara, Joseph Campbell

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13065 2023-10-23 cs.RO cs.AI cs.LG 84%

Creative Robot Tool Use with Large Language Models

Mengdi Xu, Peide Huang, Wenhao Yu, Shiqi Liu, Xilun Zhang, Yaru Niu, Tingnan Zhang, Fei Xia, Jie Tan, Ding Zhao

专题命中 工具调用 :tool use(title,abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 19 pages, 14 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04444 2025-06-03 cs.AI 84%

Gödel Agent: A Self-Referential Agent Framework for Recursive Self-Improvement

Xunjian Yin, Xinyi Wang, Liangming Pan, Li Lin, Xiaojun Wan, William Yang Wang

机构 * Peking University(北京大学) University of California, Santa Barbara(加州大学圣巴巴拉分校) University of Arizona(亚利桑那大学)

专题命中 工具调用 :agent(title,abstract);agentic(abstract);分类 cs.AI

Comments ACL 2025 main. The code can be found at https://github.com/Arvid-pku/Godel_Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25624 2026-07-21 cs.CR cs.AI cs.CL cs.LG 版本更新 83%

STAC: When Innocent Tools Form Dangerous Chains for LLM Agents

STAC:当无害工具形成危险链以劫持LLM代理

Jing-Jing Li, Jianfeng He, Chao Shang, Devang Kulshreshtha, Xun Xian, Yi Zhang, Hang Su, Sandesh Swamy, Yanjun Qi

机构 * AWS AI Labs(AWS人工智能实验室) UC Berkeley(伯克利大学)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);tool use(abstract);tool-use(abstract)

AI总结 STAC通过多轮工具链攻击揭示LLM代理的安全漏洞,提出基于推理的防御策略,显著降低攻击成功率。

Comments Long version with 15 pages in main draft and a total of 39 pages including references and appendix. Data and code \url{https://github.com/amazon-science/MultiTurnAgentAttack}

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15144 2025-12-29 cs.CR 83%

MCPZoo: A Large-Scale Dataset of Runnable Model Context Protocol Servers for AI Agent

MCPZoo:大规模可运行模型上下文协议服务器数据集用于AI代理

Mengying Wu, Pei Chen, Geng Hong, Baichao An, Jinsong Chen, Binwang Wan, Xudong Pan, Jiarun Dai, Min Yang

专题命中 工具调用 :agent(title);AI agent(title)

AI总结 MCPZoo是一个大规模可运行模型上下文协议服务器数据集,用于支持AI代理与外部工具交互的实证研究和安全分析

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19495 2024-07-01 cs.DM 83%

Multi-Agent Search-Type Problems on Polygons

Konstantinos Georgiou, Caleb Jones, Jesse Lucier

专题命中 工具调用 :agent(title);multi-agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13161 2024-06-21 cs.AI cs.CL cs.LG cs.PL 83%

APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts

Honghua Dong, Qidong Su, Yubo Gao, Zhaoyu Li, Yangjun Ruan, Gennady Pekhimenko, Chris J. Maddison, Xujie Si

专题命中 工具调用 :agent(abstract);tool use(abstract);workflow(abstract);multi-agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.00533 2023-05-02 cs.MA 83%

Guaranteed Evader Detection in Multi-Agent Search Tasks using Pincer Trajectories

Roee M. Francos, Alfred M. Bruckstein

专题命中 工具调用 :agent(title);multi-agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.08025 2021-09-01 cs.RO cs.MA 83%

STT-CBS: A Conflict-Based Search Algorithm for Multi-Agent Path Finding with Stochastic Travel Times

Oriana Peltzer, Kyle Brown, Mac Schwager, Mykel J. Kochenderfer, Martin Sehr

专题命中 工具调用 :agent(title);multi-agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12888 2026-08-14 cs.CL 新提交 83%

When Your Agent Opens the Chat App: Agent-Controlled Search over Raw Chat Logs Rivals Structured Memory

当你的智能体打开聊天应用时:智能体控制的原始聊天日志搜索可与结构化记忆相媲美

Ruizhe Li, Licheng Zhang, Benfeng Xu, Mingxuan Du, Zheren Fu, Weidong Chen

机构 * University of Science and Technology of China(中国科学技术大学) MetaStone Technology(MetaStone科技公司)

专题命中 工具调用 :agent(title,abstract);agentic(abstract);分类 cs.CL

AI总结 该研究提出无语义结构的智能体控制搜索界面ReFind,在MemoryAgentBench等任务上,其检索准确率优于HippoRAG 2等结构化记忆系统,证明可控词汇检索可替代复杂记忆结构实现高效会话记忆任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10363 2026-08-14 cs.AI 版本更新 83%

Nutrition Data Infrastructure for the AI Era: Operationalizing FAIR for Agent-Mediated Research

AI时代的营养数据基础设施:为智能体介导的研究实现FAIR原则

Lin Liao, Peng Li

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究针对AI智能体介导营养研究的数据歧义问题,提出NDS基础设施,实现FAIR原则,在基准测试中表现优于现有模型,保障分析可复现,为相关研究提供新型数据支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12282 2026-08-13 cs.AI 新提交 83%

VAKRA: Evaluating Multi-Hop Reasoning Across APIs and Retrieval Under Tool-Use Policies

VAKRA:评估工具使用策略下跨API与检索的多跳推理能力

Ankita Rajaram Naik, Anupama Murthi, Benjamin Elder, Siyu Huo, Raavi Gupta, Abhinav Jain, Praveen Venkateswaran, Abdulhamid Adebayo, Danish Contractor

机构 * IBM(国际商业机器公司(IBM))

专题命中 工具调用 :tool-use(title,abstract);agent(abstract);分类 cs.AI

AI总结 本研究推出VAKRA基准评估工具使用策略下跨API与检索的多跳推理,发现现有最优模型在相关任务上性能随推理深度显著下降,失败集中于语言介导推理环节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00316 2026-08-13 cs.LG stat.ML 版本更新 83%

Agentic Bayesian Optimization through Surrogate-Augmented Autoresearch

基于代理的贝叶斯优化:通过代理增强的自动研究

Paul Brunzema, Louis Tiao, Nhat Le, Kevin De Angeli, Yao Xuan, Djordje Gligorijevic

机构 * Meta RWTH Aachen University(亚琛工业大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 该研究提出代理式贝叶斯优化范式,构建Sara代理与lenz后端,在合成及真实基准测试中,其兼具可靠性与性能,还可动态重构优化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10039 2026-08-12 cs.LG 新提交 83%

FlowScout: From Execution Feedback to Reliable Tool-Using Agent Workflows

FlowScout:从执行反馈到可靠的工具使用智能体工作流

Shuo Hao, You Lu, Bihuan Chen, Xin Peng

专题命中 工具调用 :agent(title);workflow(abstract);agentic(abstract);分类 cs.LG

AI总结 FlowScout是从历史任务记录生成工具集成型智能体工作流的执行引导框架,经多任务域评估,其工具调用正确性与执行质量均显著优于PM4Py等基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01344 2026-08-11 cs.AI 版本更新 83%

Agentic Stage-One Stellarator Optimization: Autonomous Multi-Objective Search for Finite-Beta Equilibria

智能体阶段一仿星器优化:有限β平衡的自主多目标搜索

Tingjia Zhang, Zhuoran Meng, Runlai Xu

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出智能体阶段一仿星器优化概念,通过语言模型智能体与DESC执行配合,提升有限β平衡构型的质量与数量,生成结构化决策数据,实现可扩展的多目标优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06510 2026-08-10 cs.CY cs.AI cs.HC 新提交 83%

Agentic AI: User Empowerment or Enclosure?

智能体AI:用户赋能还是圈地?

David Gamba, Daniel M. Romero, Grant Schoenebeck

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 本文通过分析广告拦截器等四个领域,指出智能体AI的治理决策本质是政治选择,其配置正被模型上下文协议等专有框架锁定,可能损害用户权益。

Comments Extended version of AIES'2026 publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06270 2026-08-07 cs.AI 新提交 83%

The Illusion of Visual Tool-Use: A Causal Audit of Thinking with Images

视觉工具使用的错觉:对图像思考的因果审查

Zhiheng Wang, Bo Peng, Lai Wei, Chaochao Lu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 工具调用 :tool-use(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文通过因果审查方法,发现多模态大语言模型的视觉工具使用存在“调用而不查看”“查看而不规划”等错觉,整体准确率增益下大量场景无因果效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05359 2026-08-07 cs.AI 新提交 83%

CASCADE: An Agentic Regulatory Network Framework for Patient-Data-Validated Downstream Perturbation Prediction

CASCADE:一种用于经患者数据验证的下游扰动预测的智能体调控网络框架

Jose A. Bird

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究提出CASCADE智能体调控网络框架,基于ARACNe网络预测基因扰动下游转录效应,通过TCGA、METABRIC数据验证其MYC基因预测方向的准确性,还评估LLM智能体映射自然语言请求至MCP工具调用的表现,发现其在模糊查询时存在错误选择扰动类型的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21806 2026-08-07 cs.SE 版本更新 83%

Where Agent Frameworks Fall Short: Examining Functional Challenges and Usability Concerns

对现代LLM代理框架中缺陷的实证研究

Xinxue Zhu, Yanzhou Mu, Xiaoyu Zhang, Tianlin Li, Chao Shen, Chunrong Fang, Yang Liu, Juan Zhai

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.SE

AI总结 本文通过分析998个缺陷报告,发现现代LLM代理框架中缺陷主要源于API误用、不兼容和文档不同步,集中在自我行动阶段,导致功能错误、崩溃和构建失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20244 2026-08-05 cs.LO cs.AI cs.CL cs.LG cs.SE 版本更新 83%

Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search

Lean Refactor: 通过代理策略搜索实现多目标可控的证明优化

Jialin Lu, Soonho Kong, Rodrigo Stehling, Kaiyu Yang, Zhangyang Wang, Weiran Sun, Wuyang Chen

机构 * Simon Fraser University(西蒙弗雷泽大学) Amazon Web Services(亚马逊网络服务) MiroMind University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出Lean Refactor框架,通过检索增强的代理策略搜索,解决多目标、可控和版本鲁棒的Lean证明重构问题,主要贡献是通过预注释的多目标重构策略数据库实现高效的证明优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01881 2026-08-04 cs.MM cs.AI 新提交 83%

Hear, Invoke, and Understand: A Skill-Calling Multimodal Agent for Large Audio Language Models

聆听、调用与理解:面向大型音频语言模型的技能调用多模态智能体

Yuwen Wang, Tian-Hao Zhang, Minghao Cai, Yilin Ren, Ziyang Jiang, Xin Wang, Zhichao Wang, Pan Zhou, Kun Zhan, Xinyuan Qian

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本研究针对工具交互型音频推理问题,开发了SpeechAgent-R智能体,构建了HIU-Corpus与HIU-Bench,经实验验证其在分布内外任务上均较基础模型有显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏