arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-25 至 2026-02-25 共收录 8 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2602.20867 2026-02-25 cs.CR cs.AI cs.CE cs.ET 89%

SoK: Agentic Skills -- Beyond Tool Use in LLM Agents

SoK: 代理技能——超越LLM代理中的工具使用

Yanna Jiang, Delong Li, Haiyu Deng, Baihe Ma, Xu Wang, Qin Wang, Guangsheng Yu

机构 * University of Technology Sydney(悉尼科技大学) CSIRO Data61(CSIRO数据61)

专题命中 工具调用 :agentic(title,abstract);tool use(title);agent(abstract);autonomous agent(abstract)

AI总结 本文探讨了代理技能在LLM代理中的应用,分析了技能的生命周期管理、分类方法及其安全影响,并提出了未来研究挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20739 2026-02-25 cs.AI cs.CV 83%

PyVision-RL: Forging Open Agentic Vision Models via RL

通过强化学习构建开放代理视觉模型:PyVision-RL

Shitian Zhao, Shaoheng Lin, Ming Li, Haoquan Zhang, Wenshuo Peng, Kaipeng Zhang, Chen Wei

机构 * Shanghai AI Lab(上海人工智能实验室) Rice University(里士满大学) Shanda AI Research, Tokyo(上海沙达人工智能研究东京)

专题命中 工具调用 :agentic(title,abstract);tool use(abstract);分类 cs.AI

AI总结 PyVision-RL通过强化学习框架解决多模态代理的交互崩溃问题,结合回放策略和累积奖励提升多轮推理能力,实现高效视频理解与处理。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03022 2026-02-25 cs.AI 83%

STAR: Similarity-guided Teacher-Assisted Refinement for Super-Tiny Function Calling Models

STAR: 基于相似性引导的教师辅助细化方法用于超小功能调用模型

Jiliang Ni, Jiachen Pu, Zhongyi Yang, Jingfeng Luo, Conggang Hu

机构 * Algorithm Platform Team, AI Hardware Division, Alibaba(阿里巴巴人工智能硬件事业部算法平台团队)

专题命中 工具调用 :function calling(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 STAR通过约束知识蒸馏和基于相似性的强化学习,有效将大语言模型能力转移到超小模型,实现复杂功能调用任务的高性能表现。

Comments The paper has been accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24694 2026-02-25 cs.CL cs.AI 81%

Repurposing Synthetic Data for Fine-grained Search Agent Supervision

将合成数据重新利用于细粒度搜索代理的监督

Yida Zhao, Kuan Li, Xixi Wu, Liwen Zhang, Dingchu Zhang, Baixuan Li, Maojia Song, Zhuo Chen, Chenxi Wang, Xinyu Wang, Kewei Tu, Pengjun Xie, Jingren Zhou, Yong Jiang

机构 * School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院) Shanghai Engineering Research Center of Intelligent Vision and Imaging(智能视觉与成像上海工程研究中心) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出E-GRPO框架,通过利用训练中被丢弃的实体信息,提升搜索代理的细粒度学习和推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14281 2026-02-25 cs.CR cs.CL 77%

MCPShield: A Security Cognition Layer for Adaptive Trust Calibration in Model Context Protocol Agents

MCPShield: 一种用于模型上下文协议代理自适应信任校准的安全认知层

Zhenhong Zhou, Yuanhe Zhang, Hongwei Cai, Moayad Aloqaily, Ouns Bouachir, Linsey Pang, Prakhar Mehrotra, Kun Wang, Qingsong Wen

专题命中 工具调用 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.CL

AI总结 MCPShield通过元数据引导探测和历史轨迹推理,提升代理在调用MCP工具时的安全性,有效防御MCP攻击。

Comments 21 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20809 2026-02-25 cs.LG cs.AI 62%

Regret-Guided Search Control for Efficient Learning in AlphaZero

基于遗憾的搜索控制用于AlphaZero中的高效学习

Yun-Jui Tsai, Wei-Yu Chen, Yan-Ru Ju, Yu-Hung Chang, Ti-Rong Wu

机构 * Department of Computer Science, National Yang Ming Chiao Tung University, Taiwan(National Yang Ming Chiao Tung University) Institute of Information Science, Academia Sinica, Taiwan(Academia Sinica) College of Computing, Georgia Institute of Technology(Georgia Institute of Technology)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 RGSC通过学习识别高遗憾状态,提升AlphaZero的搜索效率和鲁棒性,显著提高围棋等游戏的性能。

Comments Accepted by the Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15796 2026-02-25 cs.LG cs.AI q-bio.BM 62%

Monte Carlo Tree Diffusion with Multiple Experts for Protein Design

结合多专家的蒙特卡洛树扩散用于蛋白质设计

Xuefeng Liu, Mingxuan Cao, Songhao Jiang, Xiao Luo, Xiaotian Duan, Mengdi Wang, Tobin R. Sosnick, Jinbo Xu, Rick Stevens

机构 * University of Chicago(芝加哥大学) Data Science Institute(数据科学研究所) Department of Biochemistry and Molecular Biology(生物化学与分子生物学系) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所) Argonne National Laboratory(阿贡国家实验室) Princeton University(普林斯顿大学)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 MCTD-ME通过结合多专家的蒙特卡洛树扩散方法,提升蛋白质设计任务的性能,特别是在反向折叠、折叠和条件设计挑战中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21041 2026-02-25 cs.GT cs.MA 50%

Stability Under Valuation Updates in Coalition Formation

联盟形成中估值更新下的稳定性

Fabian Frank, Matija Novaković, René Romen

专题命中 工具调用 :agent(abstract)

AI总结 本文研究了在代理人估值变化下联盟形成中的稳定性问题,证明了多种稳定性概念下的NP完全性,并提出了在受限对称估值下的多项式时间算法以保证长期更新中的稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏