arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-27 至 2026-04-27 共收录 7 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 7 篇

2601.12979 2026-04-27 cs.CL 87%

The Bitter Lesson of Diffusion Language Models for Agentic Workflows: A Comprehensive Reality Check

扩散语言模型在代理工作流中的苦涩教训:全面的现实检验

Qingyu Lu, Liang Ding, Kanjian Zhang, Jinxia Zhang, Dacheng Tao

机构 * Southeast University(东南大学) Alibaba(阿里巴巴) Southeast University Shenzhen Research Institute(东南大学深圳研究院) College of Computing and Data Science at Nanyang Technological University(南洋理工大学计算机与数据科学学院)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文评估了扩散语言模型在代理任务中的表现,发现其在长期规划和工具调用任务中存在系统性失败,提出需整合因果推理机制以提升代理能力。

Comments ACL 2026 - Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22571 2026-04-27 physics.comp-ph 82%

LARA: Validation-Driven Agentic Supercomputer Workflows for Atomistic Modeling

LARA:面向原子模拟的验证驱动代理超级计算机工作流

William Dawson, Louis Beal, Yoann Curé, Giuseppe Fisicaro, Dorian Rolland, Luigi Genovese

专题命中 工具调用 :agentic(title,abstract);workflow(abstract)

AI总结 本文提出LARA-HPC框架,通过验证驱动方法提升原子模拟工作流的可靠性,结合控制执行层、干运行验证和多阶段代理流程,有效解决计算资源交互中的不一致性和物理配置问题。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21236 2026-04-27 cs.CR cs.AI cs.SE 81%

AgentBound: Securing Execution Boundaries of AI Agents

AgentBound: 保障AI代理的执行边界安全

Christoph Bühler, Matteo Biagiola, Luca Di Grazia, Guido Salvaneschi

机构 * University of St. Gallen(圣加尔大学) Università della Svizzera italiana(瑞士联邦理工学院)

专题命中 工具调用 :AI agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出AgentBound,首个MCP服务器访问控制框架,通过声明性策略机制和执行引擎自动从源代码生成访问控制策略,有效阻止安全威胁且无显著开销。

Journal ref Proceedings of the 34th ACM Joint European Software Engineering Conference and Symposium on the Foundations of Software Engineering (FSE). 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03294 2026-04-27 cs.CR cs.AI 77%

AgentMark: Utility-Preserving Behavioral Watermarking for Agents

AgentMark:用于代理的效用保持行为水印

Kaibo Huang, Jin Tan, Yukun Wei, Wanling Li, Zipei Zhang, Hui Tian, Zhongliang Yang, Linna Zhou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Huaqiao University(华侨大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出AgentMark,一种用于代理的行为水印方法,通过在规划决策中嵌入多比特标识符以保持效用,适用于黑盒API和动作层内容水印。

Comments Accepted to ACL 2026 (Main, Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.00931 2026-04-27 cs.AI cs.HC cs.LG 62%

Explanation through Reward Model Reconciliation using POMDP Tree Search

通过POMDP树搜索实现奖励模型协调以进行解释

Benjamin D. Kraske, Anshu Saksena, Anna L. Buczak, Zachary N. Sunberg

机构 * Department of Aerospace Engineering Sciences, University of Colorado Boulder(科罗拉多大学博尔德分校航空航天工程科学系) Applied Physics Laboratory, Johns Hopkins University(约翰霍普金斯大学应用物理实验室)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文通过POMDP树搜索协调算法与用户隐式奖励模型差异,以提升用户对AI系统的信任度。

Journal ref IEEE ICAA (2023), pg. 137-140

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22254 2026-04-27 cs.LG cs.MA 57%

Fast Neural-Network Approximation of Active Target Search Under Uncertainty

快速神经网络近似主动目标搜索在不确定性下的应用

Bilal Yousuf, Zsofia Lendek, Lucian Busoniu

机构 * Technical University of Cluj-Napoca(克卢日-纳波卡技术大学)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 本文提出用卷积神经网络近似主动搜索算法,以降低在线计算成本,通过多通道网格训练实现目标检测率与传统方法相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22245 2026-04-27 eess.AS 50%

Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding

通过时间聆听:为长音频理解实现精确的时间意识

Mingchen Shao, Hang Su, Wenjie Tian, Bingshen Mu, Zhennan Lin, Lichun Fan, Zhenbo Luo, Jian Luan, Lei Xie

专题命中 工具调用 :tool use(abstract)

AI总结 本文提出LAT-Audio模型,通过构建长音频数据集和基准测试,解决长音频时间意识任务中的性能下降问题,提升模型对长音频的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏