arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2934 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 231 篇

2607.26497 2026-08-03 cs.CL 版本更新 84%

BM25 Wins at Scale: A Scaling Study of Retrieval-Augmented Generation Paradigms

哪种RAG范式在规模化场景下表现最优?检索增强生成范式的规模化研究

Pengyu Wang, Benfeng Xu, Shaohan Wang, Mingxuan Du, Xin Zeng, Huarui Wu, Lei Zhang, Licheng Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(Metastone科技) Information Technology Research Center, Beijing Academy of Agriculture and Forestry Sciences(北京农林科学院信息技术研究中心)

专题命中 工具调用 :agent(summary_cn,abstract);agentic(abstract);分类 cs.CL

AI总结 本文通过28个嵌套语料层级的受控研究,对比四类RAG范式的规模化表现,发现BM25综合性能最优,Agent+BM25全规模准确率达69.4,图基RAG存在构建瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08557 2026-08-12 cs.CL cs.CV cs.LG 版本更新 84%

OpenVisTool: An Open Recipe for Synthesizing Instructive Visual Tool-Use Trajectories

OpenVisTool:用于合成具有指导性的视觉工具使用轨迹的开源方案

Changhao Xiang, Shilin Zhang, Zheng Ma, Kanzhi Cheng, Ruize Ma, Yi Feng, Jianbing Zhang, Zhi Wang, Zhen Wu, Xinyu Dai, Lewei Lu

专题命中 工具调用 :tool-use(title,abstract);tool use(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出OpenVisTool框架,构建含因果监督的视觉工具使用轨迹数据集OpenVisTool-42K,微调后模型视觉工具使用性能提升,大模型接近领先闭源系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02411 2026-08-11 cs.AI cs.IR cs.LG cs.MA 版本更新 84%

FitText: Evolving Agent Tool Ecologies via Memetic Retrieval

FitText: 通过模因检索演化智能体工具生态

Kyle Zheng, Han Zhang, Renliang Sun, Chenchen Ye, Wei Wang

机构 * UCLA(加州大学洛杉矶分校)

专题命中 工具调用 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 针对用户任务描述与工具文档间的语义鸿沟,提出FitText框架,将检索嵌入推理循环,通过自然语言伪工具描述迭代优化和模因进化选择,显著提升工具检索性能。

Comments 30 pages, including appendices. Accepted at COLM 2026 (main conference) and the COLM 2026 Workshop on Efficient Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14192 2026-07-07 cs.AI cs.CL 版本更新 84%

Toward Efficient Agents: Memory, Tool learning, and Planning

迈向高效智能体:记忆、工具学习与规划

Xiaofang Yang, Lijun Li, Heng Zhou, Tong Zhu, Xiaoye Qu, Yuchen Fan, Qianshan Wei, Rui Ye, Li Kang, Yiran Qin, Daizong Liu, Qi Li, Ning Ding, Siheng Chen, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiaotong University(上海交通大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Hong Kong Polytechnic University(香港理工大学) Wuhan University(武汉大学) Tsinghua University(清华大学)

专题命中 工具调用 :planning(title,abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 研究将大语言模型扩展到智能体系统中的效率问题,从记忆、工具学习和规划三个核心组件考虑成本,回顾多种方法并详细讨论,以两种方式刻画效率,还探讨关键挑战与未来方向。

Comments 63 pages, 244 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10913 2026-06-25 cs.AI cs.PL cs.SE 版本更新 84%

Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces

Shepherd: 一个为元代理提供形式化执行迹的运行时基座

Simon Yu, Derek Chong, Ananjan Nandi, Dilara Soylu, Jiuding Sun, Christopher D Manning, Weiyan Shi

机构 * Northeastern University(东北大学) Stanford University(斯坦福大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 提出Shepherd,一个基于函数式编程的Python运行时基座,将代理执行作为一等对象,通过类似Git的执行迹支持元代理的检查、分叉和重放,在三个用例中显著提升性能。

Comments 50 pages, 22 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18401 2026-06-16 cs.CL cs.AI 版本更新 84%

SkillsVote: Lifecycle Governance of Agent Skills from Collection, Recommendation to Evolution

SkillsVote: 代理技能的生命周期治理从收集、推荐到进化

Hongyi Liu, Haoyan Yang, Tao Jiang, Bo Tang, Feiyu Xiong, Yuyu Luo, Zhiyu Li

机构 * Harbin Institute of Technology(哈尔滨理工大学) Soochow University(苏州大学) The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))

专题命中 工具调用 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文提出SkillsVote框架,通过生命周期治理管理代理技能,从收集和推荐到进化,提升模型在终端基准和SWE-Bench Pro上的性能。

Comments 71 pages, 12 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25624 2026-07-21 cs.CR cs.AI cs.CL cs.LG 版本更新 83%

STAC: When Innocent Tools Form Dangerous Chains for LLM Agents

STAC:当无害工具形成危险链以劫持LLM代理

Jing-Jing Li, Jianfeng He, Chao Shang, Devang Kulshreshtha, Xun Xian, Yi Zhang, Hang Su, Sandesh Swamy, Yanjun Qi

机构 * AWS AI Labs(AWS人工智能实验室) UC Berkeley(伯克利大学)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);tool use(abstract);tool-use(abstract)

AI总结 STAC通过多轮工具链攻击揭示LLM代理的安全漏洞,提出基于推理的防御策略,显著降低攻击成功率。

Comments Long version with 15 pages in main draft and a total of 39 pages including references and appendix. Data and code \url{https://github.com/amazon-science/MultiTurnAgentAttack}

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10363 2026-08-14 cs.AI 版本更新 83%

Nutrition Data Infrastructure for the AI Era: Operationalizing FAIR for Agent-Mediated Research

AI时代的营养数据基础设施:为智能体介导的研究实现FAIR原则

Lin Liao, Peng Li

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究针对AI智能体介导营养研究的数据歧义问题,提出NDS基础设施,实现FAIR原则,在基准测试中表现优于现有模型,保障分析可复现,为相关研究提供新型数据支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00316 2026-08-13 cs.LG stat.ML 版本更新 83%

Agentic Bayesian Optimization through Surrogate-Augmented Autoresearch

基于代理的贝叶斯优化:通过代理增强的自动研究

Paul Brunzema, Louis Tiao, Nhat Le, Kevin De Angeli, Yao Xuan, Djordje Gligorijevic

机构 * Meta RWTH Aachen University(亚琛工业大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 该研究提出代理式贝叶斯优化范式,构建Sara代理与lenz后端,在合成及真实基准测试中,其兼具可靠性与性能,还可动态重构优化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01344 2026-08-11 cs.AI 版本更新 83%

Agentic Stage-One Stellarator Optimization: Autonomous Multi-Objective Search for Finite-Beta Equilibria

智能体阶段一仿星器优化:有限β平衡的自主多目标搜索

Tingjia Zhang, Zhuoran Meng, Runlai Xu

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出智能体阶段一仿星器优化概念,通过语言模型智能体与DESC执行配合,提升有限β平衡构型的质量与数量,生成结构化决策数据,实现可扩展的多目标优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21806 2026-08-07 cs.SE 版本更新 83%

Where Agent Frameworks Fall Short: Examining Functional Challenges and Usability Concerns

对现代LLM代理框架中缺陷的实证研究

Xinxue Zhu, Yanzhou Mu, Xiaoyu Zhang, Tianlin Li, Chao Shen, Chunrong Fang, Yang Liu, Juan Zhai

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.SE

AI总结 本文通过分析998个缺陷报告,发现现代LLM代理框架中缺陷主要源于API误用、不兼容和文档不同步,集中在自我行动阶段,导致功能错误、崩溃和构建失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20244 2026-08-05 cs.LO cs.AI cs.CL cs.LG cs.SE 版本更新 83%

Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search

Lean Refactor: 通过代理策略搜索实现多目标可控的证明优化

Jialin Lu, Soonho Kong, Rodrigo Stehling, Kaiyu Yang, Zhangyang Wang, Weiran Sun, Wuyang Chen

机构 * Simon Fraser University(西蒙弗雷泽大学) Amazon Web Services(亚马逊网络服务) MiroMind University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出Lean Refactor框架,通过检索增强的代理策略搜索,解决多目标、可控和版本鲁棒的Lean证明重构问题,主要贡献是通过预注释的多目标重构策略数据库实现高效的证明优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01788 2026-08-04 cs.SE 版本更新 83%

KRCA: An Efficient Root Cause Analysis System in Hyper-scale Microservice Systems via Agentic AI

KRCA:一种基于智能体AI的超大规模微服务系统高效根因分析系统

Jiamin Jiang, Jingfei Feng, Yu Luo, Qingliang Zhang, Yongqian Sun, Wenwei Gu, Shenglin Zhang, Tianyu Cui, Yao Wu, Jielong Huang, Nan Qi, Dan Pei

专题命中 工具调用 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 提出KRCA系统,通过多阶段流水线(API级钻取、骨架因果图、记忆增强多智能体框架)实现超大规模微服务的高效根因定位与故障分类,AC@1达0.88和0.79,诊断时间减少77.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09515 2026-07-28 cs.CL 版本更新 83%

SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams

SERM:具有代理驱动学习的自演化相关性模型

Chenglong Wang, Canjia Li, Xingzhao Zhu, Yifu Huo, Huiyu Wang, Weixiong Lin, Yun Yang, Qiaozhi He, Tianhua Zhou, Xiaojia Chang, Jingbo Zhu, Tong Xiao

机构 * Northeastern University, Shenyang, China(东北大学,沈阳,中国) ByteDance(字节跳动) Peking University(北京大学)

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract);分类 cs.CL

AI总结 针对大规模查询流中相关性模型泛化能力不足的问题,SERM通过多代理模块检测分布偏移并生成可靠标签,实现迭代自演化提升性能。

Comments Accepted by Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05462 2026-07-22 cs.CR cs.AI 版本更新 83%

BioSecBench-Refusal: A paired metric for performance and alignment in agentic biosecurity risk assessment

评估两用生物学环境中的校准拒绝和安全有用性

Edwin H. Wintermute, Harmon Bhasin, Christina M. Agapakis, Dianzhuo Wang, Evan Seeyave, Arjun Banerjee, Daniel Fulop, Matthew C. Watson, Adam J. Meyer, Sandrine Boissel, Jens H. Kuhn, Rishi Jain, Noah D. Taylor, Helena Shomar, Patrick M. Boyle, Kenny Workman

机构 * American Wetware(美国湿科公司) LatchBio

专题命中 工具调用 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究针对人工智能用于生命科学工作流可能导致滥用的问题,提出BioSecBench-Refusal基准,将常规与红队任务配对,测试16种配置下模型拒绝率,发现多数配置对常规工作拒绝率高,有推理空间的模型能识别更多威胁,为开发者提供校准工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03465 2026-07-17 cs.CL 版本更新 83%

The Tool Illusion: Rethinking Tool Use in Web Agents

工具幻觉:重新审视网络代理中的工具使用

Renze Lou, Baolin Peng, Wenlin Yao, Qianhui Wu, Hao Cheng, Suman Nath, Wenpeng Yin, Jianfeng Gao

机构 * Microsoft Research, Redmond(微软研究院,雷德蒙德) The Pennsylvania State University, University Park(宾夕法尼亚州立大学,大学园)

专题命中 工具调用 :tool use(title,abstract);tool-use(abstract);分类 cs.CL

AI总结 本文通过系统研究不同工具源、基础模型和评估基准,重新审视网络代理中的工具使用,揭示工具效果的稳定性及潜在副作用,为未来研究提供更可靠的实证基础。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29116 2026-07-14 cs.AI 版本更新 83%

Characterizing Large Language Model Agentic Workflows: A Study on N8n Ecosystem

表征大语言模型智能体工作流:基于N8n生态系统的研究

Yutian Tang, Yuming Zhou, Huaming Chen

专题命中 工具调用 :agentic(title,abstract);tool use(abstract);分类 cs.AI

AI总结 通过分析6000多个n8n工作流,揭示LLM在低代码平台中嵌入控制逻辑、外部工具和人工审核等结构,但可靠性机制不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18576 2026-07-14 cs.AI 版本更新 83%

Agentic Forecasting using Sequential Bayesian Updating of Linguistic Beliefs

基于序列贝叶斯更新的语义信念的代理预测

Kevin Murphy

机构 * Department of Computer Science(计算机科学系) University of British Columbia(不列颠哥伦比亚大学)

专题命中 工具调用 :agentic(title,abstract);tool-use(abstract);分类 cs.AI

AI总结 BLF系统通过语义信念状态、层级多试聚合和层级校准方法,在预测基准上超越了现有方法,同时具备低泄露率的回测框架。

Comments v4 adds 2 new appendices: app J evaluates a "generative" Bayesian alternative to BLF (which does worse than the "discriminative" approached used by BLF), and app K sketches how to do value of information computation to decide when to stop searching (although this idea has not been tried). v4 also adds a few more recent references

Journal ref v3 was published in ICML AI Forecasting workshop 2026 (https://forecasting-workshop.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01109 2026-07-09 cs.AI 版本更新 83%

Platonic Representations for Poverty Mapping: Unified Vision-Language Codes or Agent-Induced Novelty?

贫困地图绘制的柏拉图式表示:统一的视觉语言代码还是智能体诱导的新颖性?

Satiyabooshan Murugaboopathy, Connor T. Jerzak, Adel Daoud

机构 * AI and Global Development Lab(人工智能与全球发展实验室) Institute for Analytical Sociology(分析社会学研究所) Institute of Computer Science(计算机科学研究所) Department of Government(政府系)

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究社会经济指标在卫星图像和网络文本中的信息印记,开发多模态框架经五条管道预测家庭财富,贡献包括融合视觉与文本提升预测、发现部分表示对齐证据、发布大规模多模态数据集。

Comments ICSC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16870 2026-07-07 cs.CR cs.AI cs.OS 版本更新 83%

Governed MCP: Kernel-Level Tool Governance for AI Agents via Logit-Based Safety Primitives

受控MCP:通过基于logit的安全原语实现AI代理的内核级工具治理

Daeyeon Son

机构 * Independent Researcher(独立研究者)

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出 Governed MCP,一种基于logit的安全原语的内核级工具治理网关,通过六层管道对MCP工具调用进行安全检查,提升AI代理的安全性。

Comments 14 pages, 6 tables. Companion paper to arXiv:2604.11943 (ProbeLogits)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29682 2026-06-25 cs.CL 版本更新 83%

Scaling Laws for Agent Harnesses via Effective Feedback Compute

智能体框架的有效反馈计算缩放定律

Xuanliang Zhang, Dingzirui Wang, Keyan Xu, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨理工大学)

专题命中 工具调用 :agent(title,abstract);tool use(abstract);分类 cs.CL

AI总结 提出有效反馈计算(EFC)作为缩放坐标,通过衡量信息性、有效性、非冗余性和保留性来预测智能体框架性能,在多个任务上优于原始计算基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04883 2026-06-24 cs.CL cs.LO 版本更新 83%

Optimizing the Cost-Quality Tradeoff of Agentic Theorem Provers in Lean

优化 Lean 中智能定理证明器的成本-质量权衡

Kári Rögnvaldsson, Chenhao Sun, Jasper Dekoninck, Martin Vechev

机构 * University of Washington(华盛顿大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 提出一种包含数据平面和控制平面的动作路由智能体,通过观察失败轨迹并估计成功概率与成本来动态决定继续证明或重新分解,在 PutnamBench 子集上平均降低 25.8% 成本且保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22638 2026-06-11 cs.AI 版本更新 83%

MobilityBench: A Benchmark for Evaluating Route-Planning Agents in Real-World Mobility Scenarios

MobilityBench:用于评估真实世界移动场景中路径规划智能体的基准

Zhiheng Song, Jingshuai Zhang, Chuan Qin, Chao Wang, Chao Chen, Longfei Xu, Kaikui Liu, Xiangxiang Chu, Hengshu Zhu

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) AMAP, Alibaba Group(阿里集团AMAP) Alibaba Group(阿里集团)

专题命中 工具调用 :planning(title,abstract);tool use(abstract);分类 cs.AI

AI总结 提出MobilityBench基准,通过确定性API重放沙箱和多维评估协议,系统评估基于LLM的路径规划智能体,发现现有模型在偏好约束路径规划上表现不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08732 2026-06-08 cs.RO cs.LG 版本更新 83%

Latent Geometry Beyond Search: Amortizing Planning in World Models

超越搜索的潜在几何:在世界模型中摊销规划

Hoang Nguyen, Xiaohao Xu, Xiaonan Huang

机构 * Department of Robotics, University of Michigan, Ann Arbor(密歇根大学机器人系,安阿伯)

专题命中 工具调用 :planning(title,abstract);分类 cs.LG

AI总结 提出在正则化潜在几何下,将规划摊销为潜在逆动力学映射,以轻量级GC-IDM替代在线搜索,在七个环境协议中匹配或超越CEM,决策成本降低100-130倍。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01236 2026-08-11 cs.CL cs.AI 版本更新 82%

Safeguarding LLM Agents from Misalignment through Provenance Analysis

通过溯源分析保护LLM智能体免受失调影响

Yining She, Yiliang Liang, Eunsuk Kang

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 工具调用 :agent(summary_cn,abstract);分类 cs.AI、cs.CL

AI总结 提出基于溯源分析的ProvenanceGuard框架,通过多阶段流水线检测工具调用前的三种失调类型,在Agent-SafetyBench和WorkBench上显著降低失调错误率并减少不必要的干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05159 2026-08-05 cs.CR cs.AI cs.LG 版本更新 82%

Malice in Agentland: Down the Rabbit Hole of Backdoors in the AI Supply Chain

Agentland中的恶意行为:深入AI供应链后门问题

Léo Boisvert, Abhay Puri, Chandra Kiran Reddy Evuru, Nazanin Sepahvand, Nicolas Chapados, Quentin Cappart, Jason Stanley, Alexandre Lacoste, Krishnamurthy Dj Dvijotham, Alexandre Drouin

机构 * ServiceNow Research Mila - Qu\'ebec AI Institute

专题命中 工具调用 :agent(abstract);AI agent(abstract);tool use(abstract);agentic(abstract)

AI总结 研究探讨了在交互数据上微调AI代理时引入的安全漏洞,提出三种供应链威胁模型,证明通过污染少量演示即可使代理泄露用户信息。

Comments 27 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06716 2026-08-04 cs.AI cs.CL cs.CR 版本更新 82%

SIEVE: Selective Integrity Verification and Escalation for Defending LLM Agents against Indirect Prompt Injection

认知控制架构(CCA):一种用于鲁棒对齐AI代理的生命周期监督框架

Zhibo Liang, Tianze Hu, Zaiye Chen, Mingjie Tang

机构 * Sichuan University(四川大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);planning(abstract);agentic(abstract)

AI总结 本文提出认知控制架构(CCA),通过全生命周期认知监督框架,有效应对复杂IPI攻击,实现安全、功能与效率的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23624 2026-07-30 cs.SE cs.AI cs.CL 版本更新 82%

Where Is the Cost of Third-Party API Routers in Agentic Software Development?

代理软件开发中第三方 API 路由器的成本在哪里?

Donghao Fu, Jingxin Li, Xue Jiang, Yihong Dong

专题命中 工具调用 :agentic(title);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究第三方 API 路由器在代理软件开发中的影响,通过实证研究编码代理中路由器端注入的四个干预级别,开发 SIDEL 框架评估代理,发现路由器端干预难测,客户端缓解措施未完全恢复控制,强调需提供商端输出完整性保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04569 2026-07-29 eess.SY cs.SY 版本更新 82%

LLMs for Agentic Home Energy Management

用于智能家庭能源管理的大语言模型

Sokipriala Jonah, Queen Moses, Abiola Babatunde, Michael Ajao-Olarinoye, Daniel Bammeke

专题命中 工具调用 :agentic(title);agent(abstract);function calling(abstract)

AI总结 研究家庭能源管理系统中,大语言模型智能体能否为多设备家庭能源调度提供自然语言接口。通过工具调用ReAct智能体及相关数据,对三个商业模型进行基准测试,结果显示模型表现各异,能实现高调度成功率和接近最优性。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14306 2026-06-26 cs.IR 版本更新 82%

Towards Recursive Self-Evolving Agentic Literature Retrieval

迈向自演化代理文献检索

Yuwen Du, Tian Jin, Jing Kang, Xianghe Pang, Jingyi Chai, Tingjia Miao, Fenyi Liu, WenHao Wang, Sikai Yao, Yuzhi Zhang, Siheng Chen

专题命中 工具调用 :agentic(title,abstract);planning(abstract)

AI总结 本文提出PaSaMaster系统,通过迭代意图分析、检索和排序,实现证据支持的文献推荐,解决传统关键词检索和生成式LLM的局限性,提升文献检索的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏