arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-16 至 2026-07-16 共收录 8 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2607.13474 2026-07-16 cs.CL 新提交 83%

MyAG: A Graph-Based Framework for Designing and Analyzing Composable LLM Agent Systems

MyAG:一种用于设计和分析可组合大语言模型智能体系统的基于图的框架

Zhisong Zhang

机构 * City University of Hong Kong(香港城市大学)

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.CL

AI总结 介绍用于设计和分析可组合大语言模型智能体系统的MyAG框架,它将构建分为三个图抽象,支持分层组合,提供监控和可视化工具,实验表明其能支持灵活设计并助于分析性能-效率权衡,且已开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13411 2026-07-16 cs.CR cs.LG 新提交 83%

Evaluating Frontier AI Agents as Autonomous Clinical Security Auditors

评估前沿人工智能代理作为自主临床安全审计员

Michael O. Eniolade

机构 * University of the Cumberlands(坎伯兰大学)

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究旨在评估前沿人工智能代理能否自主进行临床人工智能安全审计。基于METR任务标准构建评估任务,让代理按要求实施攻击、计算得分并编写报告。通过对三个前沿模型在不同数据集和模型架构上的评估,得出各模型表现及成本等情况,部分成果已公开。

Comments 29 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14893 2026-07-16 cs.RO 版本更新 78%

STITCHER: Constrained Trajectory Planning in Complex Environments with Real-Time Motion Primitive Search

STITCHER:通过实时运动原语搜索在复杂环境中进行约束轨迹规划

Helene J. Levy, Brett T. Lopez

机构 * VECTR Laboratory, University of California, Los Angeles(VECTR实验室,加州大学洛杉矶分校)

专题命中 工具调用 :planning(title,abstract)

AI总结 研究针对自主高速穿越复杂环境的轨迹规划问题,提出无优化规划框架STITCHER,通过拼接短轨迹段和图搜索实时计算轨迹,经模拟与硬件测试验证其性能优越,能满足多种约束并高速实时规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11098 2026-07-16 cs.SE cs.AI cs.CL 版本更新 67%

AgentCheck: A Reproduce-Intervene-Mitigate Workbench for LLM Agents over MCP

AgentCheck:用于基于MCP的大型语言模型智能体的重现-干预-缓解工作台

Aritra Mazumder, Nusrat jahan Lia

机构 * University of Utah(犹他大学) University of Dhaka(达卡大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究针对工具使用型大语言模型智能体在工具出现问题时开发者难以处理故障的情况,提出AgentCheck开源工作台,通过特定运行和重放方式形成重现-干预-确认循环,能对故障模式进行评估验证,提升智能体故障处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13389 2026-07-16 cs.LG cs.CL 新提交 62%

Where Should RL Post-Training Compute Go? Model Size, Search, Learning, and Feedback

强化学习训练后计算资源应投向何处?模型大小、搜索、学习与反馈

Patrick Wilhelm, Odej Kao

机构 * Technische Universität Berlin(柏林工业大学)

专题命中 工具调用 :planning(abstract);分类 cs.CL、cs.LG

AI总结 研究强化学习训练后计算资源分配问题,引入浮点运算核算框架,通过LoRA适配的Qwen2.5策略发现条件分配前沿,揭示模型选择与训练分配关联及奖励系统对核算影响,提出RACE协议,建议相关论文报告总浮点运算及计算分配方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00830 2026-07-16 cs.LG cs.AI 版本更新 62%

Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies

在测试时学习:具有可学习适应策略的语言智能体

Zhanzhi Lou, Hui Chen, Yibo Li, Qian Wang, Bryan Hooi

机构 * National University of Singapore(新加坡国立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Meta-TTL框架,通过双层优化问题学习最优适应策略,提升语言智能体在不同分布下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13789 2026-07-16 cs.RO math.OC 新提交 50%

Dynamical Vehicle Orienteering Problem for Multi-Rotor Unmanned Aerial Vehicles

多旋翼无人机的动态车辆定向问题

František Nekovář, Matej Novosad, Martin Saska, Robert Pěnička

专题命中 工具调用 :planning(abstract)

AI总结 研究多旋翼无人机的动态车辆定向问题,提出结合非线性规划与混合整数线性规划的分支定界程序和大邻域搜索元启发式算法两种解决方案,实验表明改进显著,实际部署验证了所提质点模型解决方案轨迹。

Comments 28 pages, 10 figures, preprint submitted to European Journal of Operational Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13528 2026-07-16 cs.LO math.LO 新提交 50%

Intuitionistic Dynamic Logic

直觉主义动态逻辑

Lukas Zenger

专题命中 工具调用 :agent(abstract)

AI总结 研究直觉主义动态逻辑的数学理论,涵盖五种该逻辑。通过开发证明论工具、进行语义研究,建立相关性质与界限。主要贡献为开发演算、获有限模型性质及可判定性、给出直觉主义线性时态逻辑完备公理系统。

Comments PhD Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏