arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 482 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 482 篇

2608.02569 2026-08-04 cs.AI cs.DC cs.OS 新提交 79%

AtumAI: A Principled Framework for Agentic Generation of Datacenter Control-Plane Policies

AtumAI:一种用于智能体生成数据中心控制平面策略的原则性框架

Qiushi Lin, Chaojie Zhang, Íñigo Goiri, Aditya Akella, Ricardo Bianchini, Jovan Stojkovic

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 AtumAI是一种用于智能体生成数据中心控制平面策略的框架,通过任务编译器和进化设计循环实现形式化、可迁移、系统化的策略生成,其生成的策略在三类任务上均优于专家基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29175 2026-08-03 cs.SE 新提交 79%

Execution-First Synthetic Tool-Use Trace Generation for LLM Agents

面向LLM智能体的优先执行式合成工具使用轨迹生成

Hafsa Ouajdi, Francesco Giannuzzo, Alaa Boukhary, Paolo Papotti, Gerard Conangla, Adam Elwood

专题命中 工具调用 :tool-use(title);agentic(abstract);分类 cs.SE

AI总结 针对传统数据合成的局限,提出优先执行式框架SyntheticAgentTraceQA生成工具增强型智能体的监督数据,经四工具生态系统及Qwen模型验证,该框架可提升工具执行等性能,且揭示了掩码与全监督的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25297 2026-07-29 cs.CR cs.AI 新提交 79%

Hybrid Analysis for Secure MCP Tool Use in LLM Agents

用于大语言模型智能体中安全MCP工具使用的混合分析

Ping He, Yuexiang Xie, Yaliang Li, Shouling Ji

专题命中 工具调用 :tool use(title,abstract);分类 cs.AI

AI总结 研究LLM智能体中MCP工具使用的安全问题,提出基于混合分析的MTGuard框架,利用生命周期感知的静态 - 动态协同分析,有效减轻有害工具使用,保持良性任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22761 2026-07-28 cs.AR cs.LG 新提交 79%

DRC-Aid: Design-Rule Correction via Agentic Framework utilizing Inference-Time Large Language Models

DRC-Aid:利用推理时大语言模型通过智能体框架进行设计规则校正

Anushka Mukherjee, Kang He, Kaushik Roy

专题命中 工具调用 :agentic(title,abstract);分类 cs.LG

AI总结 研究针对布局中设计规则违规问题,提出DRC-Aid闭环智能体框架,利用确定性规则引擎、大语言模型等,通过预算深度优先搜索等方法进行局部DRC修复,在相关布局评估中效果良好,基于LLM的选择优于其他策略。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23006 2026-07-28 cs.IR cond-mat.mtrl-sci cs.AI 新提交 79%

VecTree-RAG: An Agentic Retrieval-Augmented Generation Framework Combining Vector and Tree Retrieval for Efficiency and Accuracy

VecTree-RAG:一种结合向量和树检索的智能检索增强生成框架,以提高效率和准确性

Xinyan Zhong, Yuwei Shi, Yuqi Wei, Chen Shen, Tianhang Zhou, Zhenghao Wu

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 研究针对科学问答中识别相关论文及找支持证据的问题,提出VecTree-RAG框架,结合向量与树检索机制。经多组问题评估,该框架在多个基准上获高分,证据页面精度高,且完整架构所需推理令牌少,为科学文献问答提供结构感知且可追溯的架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19793 2026-07-23 cs.AI cs.CV 新提交 79%

Silent Failures in Multimodal Agentic Search:A Diagnostic Taxonomy and Cross-Judge Evaluation

多模态智能体搜索中的无声故障:一种诊断分类法与跨评判者评估

Zhengxian Wu, Junjie Gao, Kai Yang

机构 * Ant Group(蚂蚁集团)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 研究多模态智能体搜索中无声故障这一隐藏可靠性问题,引入六类分类法,构建轨迹级诊断管道,通过实验表明表面准确性高估真实正确性,且无声故障与能力相关、常转移。

Journal ref SIGIR 2026 SynthIR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18147 2026-07-21 eess.SY cs.AI cs.SY 新提交 79%

LLMs and Agentic AI Systems for Smart Grids: A Tutorial on Architectures and Applications

用于智能电网的大语言模型和智能AI系统:架构与应用教程

Daniela Rojas, Abdulwahab Albassam, Aidan G. Leung, Jett Ngo, Ryan Luo, Peter R. Quawas, Junpyung Kim, Kangkai Liang, Mansi Nanavati, Jonathan Mai, Meng-Chi Tsai, Yun-Tong Tsai, Yize Chen, Yuanyuan Shi

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣迭戈分校电气与计算机工程系) Department of Electrical and Computer Engineering, University of Alberta(阿尔伯塔大学电气与计算机工程系)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 研究智能电网中LLMs和智能AI系统,提出基于求解器的设计原则,通过提示策略等构建模块及四个案例研究实例化该原则,比较不同方案,还提出四组评估框架,明确了各部分分工。

Comments 28 pages, 11 figures, 6 tables; plus supplementary material. Review/tutorial article

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17147 2026-07-21 cs.CR cs.CL 新提交 79%

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

SlotGuard:阻止大语言模型代理转录中过度共享私有本地上下文

Haocheng Xia, Yongjoo Park

机构 * Siebel School of Computing(计算机科学系) Data Science, University of Illinois Urbana-Champaign(数据科学,伊利诺伊大学厄巴纳-香槟分校)

专题命中 工具调用 :agent(title,abstract);分类 cs.CL

AI总结 研究大语言模型代理转录本隐私泄露问题,提出SlotGuard方法,通过重写结构绑定、替换机密值、链接跨轮引用等操作隐藏敏感数据,在保持代理性能的同时大幅降低凭证泄漏率。

Comments ICML 2026 AIWILD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15593 2026-07-20 cs.DC cs.AI cs.NI 新提交 79%

Scalable LLM Agent Tool Access in the Cloud

云中可扩展的大语言模型智能体工具访问

Mingxin Li, Enge Song, Yueshang Zuo, Xiaodong Liu, Rong Wen, Qiang Fu, Gianni Antichi, Jian He, Jing Tie, Zhou Shao, Xiaobo Xue, Xiong Xiao, Luyao Zhong, Shaokai Zhang, Jiangu Zhao, Jianyuan Lu, Shize Zhang, Xiaoqing Sun, Changgang Zheng, Zihao Fan, Haonan Li, Tian Pan, Xiaomin Wu, Yang Song, Xing Li, Biao Lyu, Meng Li, Haipeng Dai, Guihai Chen, Shunmin Zhu

机构 * Nanjing University(南京大学) Alibaba Cloud(阿里云) Fudan University(复旦大学) RMIT University(皇家墨尔本理工大学) Politecnico di Milano(米兰理工学院) Zhejiang University(浙江大学)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI

AI总结 研究大语言模型智能体在云环境下工具访问问题,提出云规模网关系统,通过打破直接连接模型等整合多种功能,实现高召回率、扩展工具访问数量、提高准确性并减少时间和令牌使用量,还分享了部署经验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14155 2026-07-17 cs.SE 新提交 79%

Beyond Object Validation: Relational Conformance in Multi-Artifact Agent Releases

超越对象验证:多工件代理版本中的关系一致性

Tengjiao Liu

专题命中 工具调用 :agent(title,abstract);分类 cs.SE

AI总结 研究多工件代理版本中软件包的关系一致性问题,通过结合Schema Docs和Brand Shuttle GEO研究故障,提出候选Schema - SIP关系一致性配置文件(SIP - RC),建模版本为图,确定故障类别并证明机制可行,完整配置文件效果待实验。

Comments 10 pages, 1 figure, 5 tables. Schema Sandbox Research Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05999 2026-07-08 cs.AI 新提交 79%

AgoraSim: A Hybrid Agent-Based Modeling Framework

AgoraSim:一个基于混合智能体的建模框架

Chung-Chi Chen

机构 * Human-Agent Ally Lab (HAA Lab)(人机协作实验室(HAA实验室)) National Institute of Informatics, Japan(日本国立信息学研究所)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI

AI总结 针对大语言模型智能体模拟输出易被过度解读及难与社会动态比较的问题,提出AgoraSim框架,能将文本等解析为可编辑配置,运行混合智能体群体并比较场景,通过多种接口公开,助用户检查轨迹、比较假设及识别需验证的案例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02595 2026-07-07 cs.SE cs.PL 新提交 79%

Attributing Structured-Output Gains in Function Calling: Interface Alignment versus Procedural Transfer

函数调用中结构化输出增益的归因:接口对齐与过程转移

Wanyi Chen, Daoyuan Chen, Fang Kong

专题命中 工具调用 :function calling(title,abstract);分类 cs.SE

AI总结 研究结构化输出基准中提示诱导函数调用增益的归因,介绍四层增益归因协议,应用于相关数据集得出部分增益源于接口对齐而非过程转移的结论,并发布相关资源。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02387 2026-07-03 cs.IR cs.LG 新提交 79%

Bringing Agentic Search to Earth Observation Data Discovery

将智能搜索引入地球观测数据发现

Minghan Yu, Youran Sun, Chugang Yi, Yixin Wen, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 工具调用 :agentic(title,abstract);分类 cs.LG

AI总结 提出一个基于智能搜索的系统,利用知识图谱和大型语言模型,从自然语言查询中返回匹配的地球科学数据集和工具,显著提升检索性能。

Comments 19 pages, 1 figure, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27936 2026-06-29 cs.CR cs.AI stat.AP 新提交 79%

Agentic AI-Powered Re-Identification: An Emerging, Scalable Threat to Mobility Microdata Privacy

基于智能体AI的重识别:对移动微数据隐私的新兴可扩展威胁

Oscar Thees, Roman Müller, Matthias Templ

机构 * University of Applied Sciences and Arts Northwestern Switzerland (FHNW)(西北瑞士应用科学和艺术大学(FHNW))

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 研究利用智能体AI自动从公开网络搜索并交叉引用数据,实现从时空轨迹中重识别个体,实验成功率达72%,揭示了大规模重识别威胁。

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24446 2026-06-24 cs.SE 新提交 79%

Agentic Generation of AST Transformation Rules for Fixing Breaking Updates

用于修复破坏性更新的AST转换规则的智能体生成

Frank Reyes, Benoit Baudry, Martin Monperrus

专题命中 工具调用 :agentic(title,abstract);分类 cs.SE

AI总结 提出BigBag框架,通过智能体生成可复用的API级AST转换规则,修复依赖更新导致的编译错误,在BUMP基准上实现78.6%的修复率和跨项目33.3%的修复率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20510 2026-06-19 cs.CR cs.AI 新提交 79%

Efficient and Sound Probabilistic Verification for AI Agents

高效且可靠的AI智能体概率验证

Alaia Solko-Breslin, Pramod Kaushik Mudrakarta, Mihai Christodorescu, Somesh Jha, Krishnamurthy Dj Dvijotham

机构 * Google DeepMind(谷歌DeepMind) Google(谷歌) University of Pennsylvania(宾夕法尼亚大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 工具调用 :AI agent(title,abstract);分类 cs.AI

AI总结 提出基于分布鲁棒优化的框架,为AI智能体在复杂数字环境中的概率策略违规提供可靠上界,无需独立性假设,在终端和工具调用智能体基准上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20487 2026-06-19 cs.CL 新提交 79%

Beyond Global Replanning: Hierarchical Recovery for Cross-Device Agent Systems

超越全局重规划:跨设备智能体系统的分层恢复

Shu Yao, Yuhua Luo, Qian Long, Jingru Fan, Zhuoyuan Yu, Yuheng Wang, Lin Wu, Yufan Dang, Huatao Li, Chen Qian

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Shanghai Innovation Institute(上海创新研究院) Southeast University(东南大学) Tsinghua University(清华大学)

专题命中 工具调用 :agent(title,abstract);分类 cs.CL

AI总结 提出分层重规划框架H-RePlan,通过统一API-CLI-GUI执行和跨层失败抽象,区分设备本地策略恢复与全局重规划,在HeraBench基准上显著提升跨设备任务完成率和指令遵循度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18000 2026-06-17 cs.NI cs.AI 新提交 79%

A T-API-Compliant ReAct Agentic Loop for Optical Networks: Generic vs. Domain-Specific Tool Abstractions

一种符合T-API规范的ReAct智能循环用于光网络:通用与领域特定工具抽象

Seyed Morteza Ahmadian, Paolo Monti, Carlos Natalino

机构 * Department of Electrical Engineering, Chalmers University of Technology(查尔姆斯理工大学电子工程系)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 提出首个符合T-API规范的推理与行动(ReAct)循环,通过领域特定复合工具实现90%的oracle验证正确性,并节省三倍令牌。

Comments 4 pages, 2 figures, accepted for presentation at the 52nd European Conference on Optical Communications (ECOC), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17209 2026-06-17 cs.AI cs.IR 新提交 79%

Beyond Parallel Sampling: Diverse Query Initialization for Agentic Search

超越并行采样:面向智能搜索的多样化查询初始化

Sidhaarth Murali, João Coelho, Jingjie Ning, João Magalhães, Bruno Martins, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Instituto Superior Técnico and INESC-ID, University of Lisbon(里斯本大学高等技术学院和INESC-ID) NOVA LINCS, NOVA School of Science and Technology(新里斯本大学科学与技术学院NOVA LINCS)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 针对智能搜索中的广度缩放,提出DivInit方法,通过在第一轮生成多样化查询而非独立采样,缓解查询冗余问题,在多跳问答任务中平均提升5-7个点。

Comments 15 pages, 8 figures; under review at EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16409 2026-06-16 cs.CL 新提交 79%

PathRouter: Aligning Rewards with Retrieval Quality in Agentic Graph Retrieval-Augmented Generation

PathRouter: 在智能体图检索增强生成中对齐奖励与检索质量

Bo Wang, Heyan Huang, Yaolin Li, Wei Tang, Yuan Zhang, Wenbo Li, Mingze Gao, Ge Shi, Chong Feng

机构 * Beijing Institute of Technology(北京理工大学) Joy Future Academy(京东探索研究院)

专题命中 工具调用 :agentic(title,abstract);分类 cs.CL

AI总结 针对智能体图RAG中答案路径奖励混淆和搜索更新模糊问题,提出PathRouter框架,通过路径感知训练联合评估答案正确性与证据路径重叠,并引入冻结金证据教师提供token级KL指导,在六个QA基准上显著提升F1和证据路径重叠。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16329 2026-06-16 cs.AI 新提交 79%

Exploiting Search in Symbolic Numeric Planning with Patterns

利用模式在符号数值规划中进行搜索

Matteo Cardellini, Enrico Giunchiglia

机构 * DIBRIS, University of Genoa(热那亚大学DIBRIS)

专题命中 工具调用 :planning(title,abstract);分类 cs.AI

AI总结 提出基于符号模式规划(SPP)的数值规划过程,通过动态重计算模式并利用中间状态引导搜索,提高规划效率。

Comments Under Review at the Journal of Artificial Intelligence Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15911 2026-06-16 cs.CL cs.IR 新提交 79%

Interactor: Agentic RL oriented Iterative Creation for Ad Description Generation in Sponsored Search

Interactor: 面向赞助搜索中广告描述生成的智能体强化学习迭代创建框架

Penghui Wei, Jiayu Wu, Chao Ye, Zhi Guo, Shuanglong Li, Lin Liu

机构 * Baidu Inc.(百度公司)

专题命中 工具调用 :agentic(title,abstract);分类 cs.CL

AI总结 提出Interactor框架,利用智能体强化学习多轮迭代生成广告描述,通过多个生成奖励模型评估知识容量和落地页一致性,显著提升广告描述的知识丰富度和忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15231 2026-06-16 cs.AI 新提交 79%

Visual-Seeker: Towards Visual-Native Multimodal Agentic Search via Active Visual Reasoning

Visual-Seeker:通过主动视觉推理实现视觉原生多模态智能搜索

Zhengbo Zhang, Changtao Miao, Jinbo Su, Zhaowen Zhou, Chunxia Zhang, Xukai Wang, Ruiqi Liu, Kaiyuan Zheng, Jiansheng Cai, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * School of Artificial Intelligence UCAS(中国科学院大学人工智能学院) Institute of Automation CAS(中国科学院自动化研究所) Ant Digital Technologies Ant Group(蚂蚁数字科技蚂蚁集团) RUC(中国人民大学) BIT(北京理工大学)

专题命中 工具调用 :agentic(title);agent(abstract);分类 cs.AI

AI总结 提出Visual-Seeker,一种通过主动视觉推理进行视觉原生多模态深度搜索的智能体,在五个基准上达到最先进性能,甚至超越专有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09071 2026-06-09 cs.AI 新提交 79%

REFLECT: Intervention-Supported Error Attribution for Silent Failures in LLM Agent Traces

REFLECT: 针对LLM智能体轨迹中静默失败的干预支持错误归因

Xiaofeng Lin, Yingxu Wang, Tung Sum Thomas Kwok, Daniel Guo, Sahil Arun Nale, Charles Fleming, Guang Cheng

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工具调用 :agent(title);tool-use(abstract);分类 cs.AI

AI总结 提出REFLECT方法,通过诊断候选错误步骤、使用诊断特定补丁进行受控重放测试,并利用验证结果作为对比证据来细化归因,在四个基准上取得最高定位准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08539 2026-06-09 cs.AI 新提交 79%

AgentTrust: A Self-Improving Trust Layer for AI-Agent Actions

AgentTrust: AI代理行为的自改进信任层

Chenglin Yang

机构 * Independent Researcher(独立研究员)

专题命中 工具调用 :agent(title);AI agent(abstract);分类 cs.AI

AI总结 提出AgentTrust v2,通过威胁类型分类(词汇/语义)和自学习机制,在代理行为中实现自改进信任决策,显著提升语义威胁检测准确率并降低误拦。

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13622 2026-08-17 cs.AI cs.CL 新提交 79%

ARC: Fair Relative Advantage Comparison in Open-Ended Real-World Interaction

ARC:开放式真实世界交互中的公平相对优势比较

Yongqi Tong, Tan Li Hui Faith, Choy Zhen Wen Marcus, Zhou Jin, Kewei Fu, Jiang-Ming Yang, Jianshe Li, Xin Zhang

机构 * Ant International(蚂蚁国际)

专题命中 工具调用 :agent(abstract);tool use(abstract);tool-use(abstract);分类 cs.AI、cs.CL

AI总结 针对开放式真实世界交互中基于组的RL轨迹行为不可比导致的奖励公平问题,提出ARC训练方案,结合\textit{inter}范式与\textit{inter-86K}语料库,提升工具使用基准并缩短首次token时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07321 2026-07-09 cs.AI cs.CL cs.MA 新提交 79%

From Atomic Actions to Standard Operating Procedures: Iterative Tool Optimization for Self-Evolving LLM Agents

从原子动作到标准操作程序:自进化语言模型智能体的迭代工具优化

Haipeng Ding, Yuexiang Xie, Zhewei Wei, Yaliang Li, Bolin Ding

机构 * Renmin University of China(中国人民大学) Alibaba Group(阿里巴巴集团)

专题命中 工具调用 :agent(abstract);tool-use(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 研究针对现有LLM智能体框架问题,提出将原子动作合成SOP实现自进化,介绍EvoSOP框架,经实验验证该框架能显著提升任务成功率、减少交互轮数,为自进化智能体开发提供可扩展路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31648 2026-07-01 cs.AI cs.LG 新提交 79%

Think in English, Answer in Korean: Efficient Adaptation of Multilingual Tool-Using Agents

用英语思考,用韩语回答:多语言工具使用智能体的高效适配

Utsav Garg, Sungjin Hong, Jason Jung, Justin Lee, Shaan Desai, Joon Hee Kim, Anirudh Shrinivason, Edmond Wen, Susie Park

机构 * Cohere LG CNS

专题命中 工具调用 :tool-use(abstract);function calling(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出LuckyStar 111B混合推理模型,通过多语言监督微调、可验证奖励强化学习、语言一致性奖励和4-bit量化,高效适配多语言工具使用智能体,提升数学推理、函数调用和NL2SQL性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04788 2026-08-06 cs.LG cs.AI cs.CL 新提交 78%

Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation

带有观测校准自蒸馏的智能体强化学习

Yi Yang, Cong Qin, Xiaodan Liu, Chishui Chen, Qing Dong, Yan Zhang, Cao Liu, Zhao Yang, Lu Pan, Jiaye Lin, Yi Feng

机构 * Meituan(美团)

专题命中 工具调用 :agentic(title);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究针对智能体强化学习的混淆问题,提出OCSD方法,通过对比两类回放视图推导观测残差,在高不确定步骤调制GRPO更新,在三类任务和多模型规模上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03741 2026-08-05 cs.DC 新提交 78%

When Does Disaggregation Pay? Simulating Prefill--Decode--Attention--FFN Specialization for Agentic LLM Inference

拆分何时划算?智能体大语言模型推理的预填-解码-注意力-前馈网络专业化模拟

Przemyslaw Forys, Haoran Wu, Can Xiao, Jiayi Nie, Tony Liu, Rika Antonova, Timothy Jones, Robert Mullins, Wayne Luk, Aaron Zhao, George A. Constantinides

专题命中 工具调用 :agentic(title,abstract)

AI总结 该研究提出HeteroPanacea模拟框架,针对智能体LLM推理的预填-解码-注意力-前馈网络拆分,验证其可提升吞吐量,为异构智能体服务系统提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏