arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5039 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5039 篇

1607.06886 2017-02-27 cs.RO 78%

Real-Time Stochastic Kinodynamic Motion Planning via Multiobjective Search on GPUs

Brian Ichter, Edward Schmerling, Ali-akbar Agha-mohammadi, Marco Pavone

专题命中 工具调用 :planning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1607.04800 2016-11-01 cs.RO cs.CG 78%

Collision detection or nearest-neighbor search? On the computational bottleneck in sampling-based motion planning

Michal Kleinbort, Oren Salzman, Dan Halperin

专题命中 工具调用 :planning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1610.00663 2016-10-04 cs.IT math.IT 78%

Privacy-guaranteed Two-Agent Interactions Using Information-Theoretic Mechanisms

Bahman Moraffah, Lalitha Sankar

专题命中 工具调用 :agent(title,abstract)

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1405.5848 2015-08-14 cs.RO 78%

Batch Informed Trees (BIT*): Sampling-based Optimal Planning via the Heuristically Guided Search of Implicit Random Geometric Graphs

Jonathan D. Gammell, Siddhartha S. Srinivasa, Timothy D. Barfoot

专题命中 工具调用 :planning(title,abstract)

Comments 8 Pages. 6 Figures. Video available at http://www.youtube.com/watch?v=TQIoCC48gp4

Journal ref 2015 IEEE International Conference on Robotics and Automation (ICRA 2015), pp. 3067-3074, 26-30 May 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
1408.1052 2014-08-06 cs.NI 78%

Optimal path selection in Graded network using Artificial Bee Colony algorithm with Agent enabled Information

Kavitha Sooda, T. R. Gopalakrishnan Nair

专题命中 工具调用 :agent(title,abstract)

Comments 6 pages, 4 figures, 2 tables, Hybrid Intelligent Systems (HIS), 2012 12th International Conference on

详情

展开后加载摘要…

URL PDF HTML 收藏
1305.4195 2013-07-10 cs.DB 78%

Search and Result Presentation in Scientific Workflow Repositories

Susan B. Davidson, Xiaocheng Huang, Julia Stoyanovich, Xiaojie Yuan

专题命中 工具调用 :workflow(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1208.0573 2012-08-03 math.AT cs.RO 78%

Invariants for Homology Classes with Application to Optimal Search and Planning Problem in Robotics

Subhrajit Bhattacharya, David Lipsky, Robert Ghrist, Vijay Kumar

专题命中 工具调用 :planning(title,abstract)

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1206.1305 2012-06-07 cs.CE cs.NE math.OC 78%

MACS: An Agent-Based Memetic Multiobjective Optimization Algorithm Applied to Space Trajectory Design

Massimiliano Vasile, Federico Zuiani

专题命中 工具调用 :agent(title,abstract)

Journal ref Proceedings of the Institution of Mechanical Engineers, Part G: Journal of Aerospace Engineering September 5, 2011 0954410011410274

详情

展开后加载摘要…

URL PDF HTML 收藏
1008.1335 2010-08-10 cs.IR 78%

Designing a Dynamic Components and Agent based Approach for Semantic Information Retrieval

Zeeshan Ahmed, Detlef Gerhard

专题命中 工具调用 :agent(title,abstract)

Comments In the proceedings of 6th CIIT Workshop on Research in Computing, (CWRC 07) , P8, Pakistan 27 October, 2007

详情

展开后加载摘要…

URL PDF HTML 收藏
0801.3209 2010-07-05 cs.NE cs.CE 78%

A Pyramidal Evolutionary Algorithm with Different Inter-Agent Partnering Strategies for Scheduling Problems

Uwe Aickelin

专题命中 工具调用 :agent(title,abstract)

Journal ref Proceedings of the Genetic and Evolutionary Computation Conference (GECCO 2001), late-breaking papers volume, pp 1-8, San Francisco, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
1006.5059 2010-06-29 cs.IR 78%

Capacity Planning for Vertical Search Engines

Claudine Badue, Jussara Almeida, Virgilio Almeida, Ricardo Baeza-Yates, Berthier Ribeiro-Neto, Artur Ziviani, Nivio Ziviani

专题命中 工具调用 :planning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
q-bio/0612037 2010-03-23 q-bio.TO q-bio.MN 78%

Simulating Brain Tumor Heterogeneity with a Multiscale Agent-Based Model: Linking Molecular Signatures, Phenotypes and Expansion Rate

Le Zhang, Costas G. Strouthos, Zhihui Wang, Thomas S. Deisboeck

专题命中 工具调用 :agent(title,abstract)

Comments 37 pages, 10 figures

Journal ref Mathematical and Computer Modelling 49 (1-2), pp. 307-319, 2009

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08907 2026-08-11 cs.CV cs.AI 新提交 77%

ToolVision: Learning When and How to Use Visual Tools with Capability-Aligned Supervision

ToolVision:通过能力对齐监督学习何时以及如何使用视觉工具

Delin Mao, Chenghao Sun, Jingwei Song, Chishui Chen, Linfeng Zhang

专题命中 工具调用 :agent(abstract);tool use(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对多模态模型工具使用监督错位问题,提出ToolVision方法,通过能力对齐的SFT与RL监督优化工具使用学习,在多个视觉基准上实现性能提升并将公开发布相关资源。

Comments 18 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18414 2026-08-11 cs.CR cs.AI 版本更新 77%

Prompts Don't Protect: Architectural Enforcement via MCP Proxy for LLM Tool Access Control

提示不保护:通过MCP代理实现的架构强制以实现LLM工具访问控制

Rohith Uppala

机构 * Independent Researcher(独立研究员)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种受控的MCP代理,通过在工具发现和工具调用两个阶段实施基于属性的访问控制(ABAC),有效阻止了未经授权的工具调用,而提示基于的限制仅能减少11-18个百分点的未授权调用率,证明了架构强制在部署的智能体系统中实现可靠工具访问控制的必要性。

Comments 7 pages, 4 tables, 2 figures. Revised version with 200 adversarial tasks and expanded limitations

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07223 2026-08-11 cs.CR cs.AI cs.CL cs.LG cs.SE 版本更新 77%

TraceSafe: A Systematic Assessment of LLM Guardrails on Multi-Step Tool-Calling Trajectories

TraceSafe: 对LLM在多步骤工具调用轨迹上的安全护栏的系统评估

Yen-Shan Chen, Sian-Yao Huang, Cheng-Lin Yang, Yun-Nung Chen

机构 * CyCraft AI Lab, Taiwan(CyCraft AI实验室(台湾)) National Taiwan University(国立台湾大学)

专题命中 工具调用 :autonomous agent(abstract);tool-use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出TraceSafe-Bench,首个评估中间轨迹安全的综合基准,发现安全护栏效果更依赖结构数据能力而非语义安全对齐,通用模型在轨迹分析中表现更优,且准确性随执行步骤增加而提升。

Comments Accepted to Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00737 2026-08-07 cs.AI 版本更新 77%

To Call or Not to Call: A Framework to Assess and Optimize LLM Tool Calling

调用还是不调用:评估和优化LLM工具调用的框架

Qinyuan Wu, Soumi Das, Mahsa Amani, Arijit Nag, Seungeon Lee, Krishna P. Gummadi, Abhilasha Ravichander, Muhammad Bilal Zafar

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) Ruhr University Bochum(博德姆鲁尔大学) UAR RC Trust(UAR RC信托)

专题命中 工具调用 :tool use(abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

AI总结 提出一个基于决策理论的框架,从必要性、效用和可负担性三个关键因素评估LLM的网页搜索工具调用决策,并训练轻量级估计器优化调用,提升任务性能。

Comments Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02358 2026-08-04 cs.CL 新提交 77%

ScrambleToolBench: Agents Search Exhaustively Even When Their Own Map Points to the Next Step

ScrambleToolBench:即使自身的“地图”指向下一步,智能体仍会进行穷尽式搜索

Vernon Toh, Navonil Majumder, Zhengyuan Liu, Nancy F. Chen, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学) Agency for Science, Technology, and Research (A*STAR)(新加坡科学、技术与研究局)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);tool-use(abstract);分类 cs.CL

AI总结 针对现有工具使用基准依赖先验知识的局限,推出ScrambleToolBench交互式终端基准,评估发现当前语言模型面对环境结构变化时难以实现稳健适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02101 2026-08-04 cs.CL 新提交 77%

Cross-Domain Hybrid OPD for Generalizable Search Agents

面向通用搜索智能体的跨域混合在线策略蒸馏

Hongzhan Chen, Xiaoyu Liu, Dengming Zhang, Minzhou Huang, Dongliang Xu, Jingcheng Xie, Dongxiang Fang, Bowen Qin, Minsheng Hao, Yaozong Shen, Xiaojun Quan, Mona Zhou, Haosheng Zou, Jeff Chen

机构 * Yuanbao Team, Tencent Shanghai Innovation Institute(腾讯上海研究院元宝团队)

专题命中 工具调用 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本研究提出基于混元3架构的元宝搜索智能体训练框架,通过跨域混合在线策略蒸馏联合优化搜索专业化与通用能力,缓解对齐损耗,在现实搜索场景中实现两者的良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29250 2026-08-03 cs.CL 新提交 77%

Data Turnstile: A Scalable Open Framework for Function-Calling Data Generation

Data Turnstile:面向函数调用数据生成的可扩展开源框架

Goutham Ramakrishnan, Megha Sharma

机构 * Amazon AGI(亚马逊AGI)

专题命中 工具调用 :tool-use(abstract);function calling(abstract);agentic(abstract);分类 cs.CL

AI总结 该研究提出开源框架Data Turnstile,可基于用户定义API规范生成高质量函数调用合成训练数据,经其微调的小型语言模型在BFCL、τ²-bench等基准上性能大幅提升,缩小了与更大规模模型的差距。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25415 2026-07-29 cs.AI 新提交 77%

A Control System, a Dataset, and a Recipe for Making Frozen LLM Agents Learn a Domain

一种用于使冻结的语言模型智能体学习领域的控制系统、数据集和方法

Debjyoti Paul

机构 * Meta AI

专题命中 工具调用 :tool-use(abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 研究如何让冻结的语言模型智能体学习领域,核心方法是将框架视为特定动作空间,用经典强化学习在线学习策略并以多目标奖励评分,贡献包括用DSPy实例化系统并评估,还发布相关代码、任务套件、训练日志及部署方法。

Comments 8 pages, 1 figure, 3 tables. Code and dataset: https://github.com/dpaul0501/context-optimization-rl

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16038 2026-07-20 cs.AI 新提交 77%

SciForge: An AI-Native, Multimodal Workbench for Scientific Discovery

SciForge:用于科学发现的人工智能原生多模态工作台

SciForge Team, Zhangyang Gao, Minghao Fang, Yifei Liu, Hanhui Yang, Xinyu Gu, Shixiang Tang, Siqi Sun, Lei Bai, Cheng Tan, Mengdi Liu, Hao Wu, Shuizhou Chen

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 工具调用 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 SciForge针对科学工作中异构工件难保存为连贯可审计状态的问题,构建多模态工作台,围绕五个支柱运行,结合多种组件,通过多种应用场景展示实际影响,当前为桌面应用,未来深化团队协作且开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09421 2026-07-20 cs.CL 版本更新 77%

What Should a Skill Remember? Quality--Cost Trade-offs in Cost-Aware Skill Rewriting for Language Model Agents

技能应记住什么?语言模型代理中成本感知技能重写的质量-成本权衡

Qinghua Xing, Yinda Chen, Yaping Jin, Zhenhe Wu, Bohan Lin, Hang Zhou, Xinghao Chen, Hanting Chen, Zhiwei Xiong

机构 * University of Science and Technology of China(中国科学技术大学) Huawei Technologies(华为技术有限公司) Tianjin University(天津大学)

专题命中 工具调用 :agent(abstract);tool use(abstract);workflow(abstract);分类 cs.CL

AI总结 研究语言模型代理中技能重写的质量-成本权衡,提出信息保留策略,在SkillsBench上实现成本降低7%-14.7%且保持验证质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10559 2026-07-14 cs.AI 新提交 77%

Large language model agents accelerate inverse design of metal-organic frameworks for gas separation

大语言模型智能体加速用于气体分离的金属有机框架的逆设计

Zhaolin Hu, Hehe Fan, Wangyihan Guo, Meng Xu, Chenhao Rao, Qiwei Yang, Yi Yang

专题命中 工具调用 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 研究旨在加速金属有机框架用于气体分离的逆设计。提出LEMO智能体框架,结合多种技术,经迭代循环指导搜索。在分离任务中评估,相比基线有优势,丰富候选、提性能、保多样,还经实验筛选实现合成与表征,证明大语言模型智能体可加速MOF发现。

Comments 19 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01143 2026-07-14 cs.AI 版本更新 77%

A Low-Latency Fraud Detection Layer for Detecting Adversarial Interaction Patterns in LLM-Powered Agents

面向LLM代理的低延迟欺诈检测层:用于检测对抗性交互模式

Sheldon Yu, Yingcheng Sun, Hanqing Guo, Qianqian Tong

机构 * University of California, San Diego(加州大学圣地亚哥分校) Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 工具调用 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出一种低延迟欺诈检测机制,通过交互轨迹的结构化运行时特征检测对抗性交互模式,采用轻量模型实现实时部署,实验表明交互层面行为检测应成为LLM代理部署时的核心防护措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05876 2026-07-09 cs.PF cs.AI cs.DC 新提交 77%

Think Before You Grid-Search: Floor-First Triage for LLM Serving

在进行网格搜索之前先思考:大语言模型服务的楼层优先分类法

Yihua Liu

机构 * NVIDIA

专题命中 工具调用 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 研究大语言模型服务优化,提出楼层优先分类法,基于残差构建五维资源向量,通过墙排序比较部署方案,以案例分析模型在特定GPU上的情况,揭示布局判断与操作点的关系及不同布局差异的原因。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13148 2026-07-02 cs.AI 新提交 77%

TerraBench: Can Agents Reason Over Heterogeneous Earth-System Data?

TerraBench: 智能体能否对异构地球系统数据进行推理?

Dat Tien Nguyen, Thao Nguyen, Fadillah Adamsyah Maani, Huy M. Le, Muhammad Umer Sheikh, Numan Saeed, Muhammad Haris Khan, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 工具调用 :tool-use(abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 提出TerraBench基准,基于TerraAgent框架,通过结合大语言模型规划与科学工具,实现跨网格数据、卫星图像、地理空间和模拟器的交互式推理,包含403个任务和24,500个执行步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30531 2026-06-30 cs.AI 77%

Entity Binding Failures in Tool-Augmented Agents

工具增强型代理中的实体绑定失败

Rahul Suresh Babu, Shashank Indukuri

专题命中 工具调用 :agent(abstract);tool use(abstract);tool-use(abstract);分类 cs.AI

AI总结 研究工具增强型语言模型代理中实体绑定失败问题,提出实体感知执行机制,实验表明该方法可消除错误实体操作但可能降低任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25605 2026-06-25 cs.CL 新提交 77%

Constraint Tax in Open-Weight LLMs: An Empirical Study of Tool Calling Suppression Under Structured Output Constraints

开源大语言模型中的约束税:结构化输出约束下工具调用抑制的实证研究

Fangzheng Li, Aimin Zhang, Chen Lv

机构 * Focus AI Center, Focus Technology Co., Ltd.(焦点科技有限公司焦点人工智能中心) Nanjing University of Science and Technology(南京理工大学)

专题命中 工具调用 :agent(abstract,abstract_cn);tool use(abstract);分类 cs.CL

AI总结 本文通过实验发现,在同时启用工具调用和JSON Schema约束时,多个开源模型会抑制工具调用,并提出透明两遍执行策略来恢复工具调用同时保证结构化输出。

Comments 2 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23132 2026-06-25 cs.CR cs.AI 版本更新 77%

Verifiable Manifest Signing and Transparency Enforcement for Secure MCP-Based LLM Pipelines

可验证的清单签名与透明度强制:面向基于MCP的安全LLM流水线

Saeid Jamshidi, Kawser Wazed Nafi, Arghavan Moradi Dakhel, Foutse Khomh, Mohammad Hamdaqa

机构 * SWAT Laboratory, Polytechnique Montréal(SWAT实验室,蒙特利尔理工学院) SæT Laboratory, Polytechnique Montréal(SæT实验室,蒙特利尔理工学院)

专题命中 工具调用 :agent(abstract);tool-use(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对MCP协议缺乏工具清单认证的问题,提出清单级强制层,通过策略验证、新鲜度检查、数字签名、执行前验证和Merkle透明度日志,实现低开销、可追溯的LLM工具调用安全控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16591 2026-06-17 cs.CL 新提交 77%

SING: Synthetic Intention Graph for Scalable Active Tool Discovery in LLM Agents

SING: 用于LLM代理中可扩展主动工具发现的合成意图图

Qiao Xiao, Haochen Shi, Yisen Gao, Wenbin Hu, Huihao Jing, Tianshi Zheng, Baixuan Xu, Ziheng Zhang, Weiqi Wang, Haoran Li, Jiaxin Bai, Yangqiu Song

机构 * Cornell University(康奈尔大学) The Hong Kong University of Science and Technology(香港科技大学) The Ohio State University(俄亥俄州立大学) Hong Kong Baptist University(香港浸会大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.CL

AI总结 提出SING框架,通过构建意图-工具图并动态检索工具,在长周期任务中提升工具发现准确率,Global Recall@5提高59.8%,下游成功率提高28.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏