arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-30 至 2026-07-30 共收录 14 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 14 篇

2607.26656 2026-07-30 cs.CR cs.AI cs.SE 新提交 84%

Graph Is the Verifier: Agentic Reinforcement Learning for Interprocedural Vulnerability Detection

图作为验证器:用于过程间漏洞检测的智能体强化学习

Yikun Li, Ting Zhang, Jiakun Liu, Jinfeng Jiang, Yuheng Yieh, Yixin Yang, Wen Bin Leow, Yide Yin, Yintong Huo, Eng Lieh Ouh, Lwin Khin Shar, David Lo

专题命中 工具调用 :agentic(title,abstract);tool-use(abstract);分类 cs.AI、cs.SE

AI总结 针对现有漏洞检测孤立处理函数的问题,提出基于CPG的智能体强化学习框架VulAgentRL,通过图验证设计可靠奖励并预热初始化策略,在仓库级划分下的严格指标及多场景中均优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26070 2026-07-30 cs.IR cs.AI 新提交 83%

SimpleWikiSearch: A Clean Offline Wikipedia Environment for Agentic Search

SimpleWikiSearch:用于智能体搜索的简洁离线维基百科环境

Guanming Xiong, Penghui Zhang

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 SimpleWikiSearch是一套明确可运行的离线维基百科环境,用于智能体搜索的可复现评估,提供基线结果及对比闭源模型的子集,而非提出新智能体算法。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23624 2026-07-30 cs.SE cs.AI cs.CL 版本更新 82%

Where Is the Cost of Third-Party API Routers in Agentic Software Development?

代理软件开发中第三方 API 路由器的成本在哪里?

Donghao Fu, Jingxin Li, Xue Jiang, Yihong Dong

专题命中 工具调用 :agentic(title);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究第三方 API 路由器在代理软件开发中的影响,通过实证研究编码代理中路由器端注入的四个干预级别,开发 SIDEL 框架评估代理,发现路由器端干预难测,客户端缓解措施未完全恢复控制,强调需提供商端输出完整性保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14029 2026-07-30 cs.CV 版本更新 80%

POINTS-Seeker: An Open Recipe for Multimodal Search Agents with Visual Memory Management

POINTS-Seeker:从零开始训练多模态代理搜索模型

Yikun Liu, Yuan Liu, Haicheng Wang, Zhongyin Zhao, Le Tian, Xiao Zhou, Jiangchao Yao, Yanfeng Wang, Weidi Xie

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) CMIC, Shanghai Jiao Tong University(上海交通大学CMIC) WeChat AI, Tencent(腾讯WeChat AI)

专题命中 工具调用 :agent(abstract);tool-use(abstract);planning(abstract);agentic(abstract)

AI总结 本文提出POINTS-Seeker模型,通过引入代理播种机制和V-Fold压缩方案,解决长周期交互中的证据检索问题,并在六个基准测试中超越现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22916 2026-07-30 cs.AI 版本更新 79%

Intent-Governed Tool Authorization for AI Agents

意图驱动的AI代理工具授权

Genliang Zhu, Chu Wang

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Accentrust

专题命中 工具调用 :AI agent(title,abstract);分类 cs.AI

AI总结 提出意图驱动访问控制(IGAC),通过将用户意图作为单调可审计策略属性,限制AI代理的工具调用权限,防止静态凭证滥用。

Comments 33 pages. Revised presentation and analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27083 2026-07-30 cs.LG cs.AI 新提交 73%

Scores Are Not Decisions: Cost-Aware Stopping for Tool Acquisition in LLM Agents

分数并非决策:大语言模型智能体工具获取的成本感知停止策略

Yicheng Feng, Yan Zhang, Yan Cheng, Wei Qi

专题命中 工具调用 :agent(abstract);tool-use(abstract);分类 cs.AI、cs.LG

AI总结 针对LLM智能体工具获取的异构成本问题,提出CAM-DF及其轻量变体,通过训练停止决策的离线差距实现成本感知停止,在1343个任务上验证其优于基线,减少工具接触量的同时保持任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16387 2026-07-30 cs.SE cs.AI 版本更新 73%

Fantastic Adaptive Taxonomies and How to Use Them

奇妙的自适应分类法及其使用方法

Mert Cemri, Andrei Cojocaru, Melissa Pan, Shu Liu, Shubham Agarwal, Alexander Krentsel, Jay Tang, Kannan Ramchandran, Joseph E. Gonzalez, Matei Zaharia, Alex Dimakis, Ion Stoica

机构 * University of California, Berkeley(加州大学伯克利分校) Apple(苹果公司) Bespoke Labs(Bespoke实验室)

专题命中 工具调用 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 研究智能体系统失败反馈问题,提出AdaMAST方法将轨迹转换为自适应失败分类法,该分类法能作为共享反馈接口,在智能体系统搜索、运行时及轨迹选择等方面改进智能体,提升准确率和分辨率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26358 2026-07-30 cs.LG cs.AI cs.GT 新提交 62%

Post-Training at the Edge of Detectability: A Game-Theoretic Approach to Fine-Tuning

可检测边界处的后训练:一种用于微调的博弈论方法

Keegan Harris, Brian W. Lee, Ian Waudby-Smith, Philip Amortila, Nika Haghtalab, Michael I. Jordan

机构 * University of California, Berkeley(加州大学伯克利分校) Inria(法国国家信息与自动化研究所) École Normale Supérieure(巴黎高等师范学院)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出博弈论框架解决RL微调中KL正则化系数设置问题,将均衡系数归约为KL正则化RL目标,在Qwen3-8B等模型实验中实现良好奖励-保留权衡,可用于审计开源模型API提供商。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25718 2026-07-30 cs.LG cs.AI cs.IR 版本更新 62%

Tools Are Not Islands: Set-Level Tool Retrieval for LLM Agents via Query-Conditioned Hyperedge Prediction

工具并非孤岛:通过查询条件超边预测为语言模型智能体进行集合级工具检索

Xinyi Hong, Pinjun Dong, Xinyang Yu, Binyan Jiang

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究LLM智能体的工具检索问题,提出HYSET方法,将其表述为查询条件超边预测,通过特定基数交互捕捉工具兼容性,设计为预选择模块,实验证明该方法在工具检索性能及任务成功率上优于基线,还支持零样本/少样本迁移。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17100 2026-07-30 cs.MA cs.AI cs.SE 版本更新 62%

Auto Research for Materials: Auditable AI-Scientist Workflows with Held-Out Transfer

材料的自动研究:具有留出转移的可审计人工智能科学家工作流程

Jingjie Ning, Xiaochuan Li, Shanshan Zhong, Ji Zeng, Guolin Ke

机构 * School of Computer Science, Carnegie Mellon University(计算机科学系,卡内基梅隆大学) DP Technology(DP科技)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究材料预测中人工智能代理的工作流程,通过多方面搜索产生评估更改,经留出数据测试,发现不同建模机制下的有效变化,证明闭环代理决策及代码可复用组合,还提供了评估设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26642 2026-07-30 cs.AI 新提交 57%

AlphaSchema: Exploring the Space of Trading Semantics for LLM-Based Alpha Mining

AlphaSchema:探索基于大语言模型(LLM)的阿尔法挖掘的交易语义空间

Jingyang Yi, Jian Yang, Yifei Jin, Yuqi Li, Jian Li

机构 * X-Tech Monash University(莫纳什大学) PandaAI(熊猫AI) IIIS, Tsinghua University(清华大学智能产业研究院(IIIS))

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 AlphaSchema构建并探索结构化交易语义空间,通过解耦探索与实施、结合代理模型平衡探索与利用,在中国股市挖掘出强预测与投资组合表现的因子池,且对LLM选择具鲁棒性。

Comments Initial Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20797 2026-07-30 cs.RO cs.AI 交叉投稿 57%

A Methodology for Designing Knowledge-Driven Missions for Robots

为机器人设计知识驱动任务的方法论

Guillermo GP-Lenza, Carmen DR. Pita-Romero, Miguel Fernandez-Cortizas, Pascual Campoy

机构 * Computer Vision and Aerial Robotics group (CVAR), Centre for Automation and Robotics (CAR) Universidad Politécnica de Madrid (UPM), Madrid, Spain(计算机视觉与空中机器人小组(CVAR)、自动化与机器人中心(CAR)马德里理工大学(UPM)、马德里,西班牙)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于知识图谱的机器人任务设计方法论,通过在ROS 2系统中实现,提升自主任务的效率和智能性。

Journal ref 2024 7th Iberian Robotics Conference (ROBOT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26402 2026-07-30 cs.CY 新提交 50%

From Micro-Cognition to Self-Construction: A Four-Layer Integrative Review of Psychological Theories in HCI

从微观认知到自我建构:人机交互中心理学理论的四层整合综述

Xiaohe Bie, Bo Wang, Xinyu Long

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对HCI从“工具使用”向“心智共生”的范式转变,提出四层整合心理学理论框架,明确其对生成式AI等场景的启示及核心挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21329 2026-07-30 physics.flu-dyn physics.bio-ph physics.comp-ph 版本更新 50%

Smart strategies to navigate turbulent odor plumes reorienting to local wind

智能策略用于在湍流气味团中导航:重新定向到局部风

Lorenzo Piro, Maurizio Carbone, Luca Biferale, Massimo Cencini, Robin A. Heinonen, Marco Rando, Agnese Seminara

专题命中 工具调用 :agent(abstract)

AI总结 本文提出了一种基于风的强化学习框架,用于在湍流中导航,通过局部风方向估计和时间间隔来选择动作,展示了在不同风条件下策略的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏