arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 92539 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5014 篇

2608.00969 2026-08-04 cs.AI 新提交 83%

PROGRESS: Coverage-guided RL to Train Search-augmented LLM Agent

PROGRESS:基于覆盖引导的强化学习训练搜索增强型大语言模型智能体

Sudipta Paul, Vijay Srinivasan, Vivek Kulkarni, Aounon Kumar, Yashas Malur Saidutta, Wenbo Li, Srinivas Chappidi

机构 * AI Center-Mountain View, Samsung Electronics(三星电子山景城人工智能中心)

专题命中 工具调用 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 针对搜索增强型大语言模型智能体结果级奖励监督不足的问题,提出PROGRESS方法,通过教师引导的覆盖奖励结合R1框架训练,提升了智能体任务性能,凸显了搜索策略监督的重要性。

Comments Accepted in Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01788 2026-08-04 cs.SE 版本更新 83%

KRCA: An Efficient Root Cause Analysis System in Hyper-scale Microservice Systems via Agentic AI

KRCA:一种基于智能体AI的超大规模微服务系统高效根因分析系统

Jiamin Jiang, Jingfei Feng, Yu Luo, Qingliang Zhang, Yongqian Sun, Wenwei Gu, Shenglin Zhang, Tianyu Cui, Yao Wu, Jielong Huang, Nan Qi, Dan Pei

专题命中 工具调用 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 提出KRCA系统,通过多阶段流水线(API级钻取、骨架因果图、记忆增强多智能体框架)实现超大规模微服务的高效根因定位与故障分类,AC@1达0.88和0.79,诊断时间减少77.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29254 2026-08-03 cs.AI 新提交 83%

Tool Specifications Matter: Uncovering and Mitigating Safety Risks in AI Agents

工具规格很重要:揭示和缓解AI智能体中的安全风险

Minghui Pan, Jiayuxuan Yang, Yuanyuan Yuan, Yu Jiang, Zhenpeng Chen

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beihang University(北京航空航天大学) Tsinghua University(清华大学)

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本研究发现模式格式工具规格是AI智能体安全下降的主因,提出SafeKeep防护措施,可提升有害请求弃权率、降低攻击成功率,性能优于现有防护且保留任务处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27235 2026-07-31 cs.AI cs.CV 新提交 83%

RadHarmony: Radiological Data Handling in the Era of Agentic AI

RadHarmony:智能体AI时代的放射数据处理方案

Frank Li, Bardia Khosravi, Mohammadreza Chavoshi, Theo Dapamede, YoungSeok Jeon, Janice Newsome, Hari Trivedi, Judy Gichoya

机构 * Emory University(埃默里大学) Yale University(耶鲁大学)

专题命中 工具调用 :agentic(title);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 RadHarmony是一款开源Python库,用于统一处理异构放射数据集,引入AI智能体技能简化数据集整合,可预训练视觉Transformer基线并提供相关代码与模型权重。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26070 2026-07-30 cs.IR cs.AI 新提交 83%

SimpleWikiSearch: A Clean Offline Wikipedia Environment for Agentic Search

SimpleWikiSearch:用于智能体搜索的简洁离线维基百科环境

Guanming Xiong, Penghui Zhang

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 SimpleWikiSearch是一套明确可运行的离线维基百科环境,用于智能体搜索的可复现评估,提供基线结果及对比闭源模型的子集,而非提出新智能体算法。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09515 2026-07-28 cs.CL 版本更新 83%

SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams

SERM:具有代理驱动学习的自演化相关性模型

Chenglong Wang, Canjia Li, Xingzhao Zhu, Yifu Huo, Huiyu Wang, Weixiong Lin, Yun Yang, Qiaozhi He, Tianhua Zhou, Xiaojia Chang, Jingbo Zhu, Tong Xiao

机构 * Northeastern University, Shenyang, China(东北大学,沈阳,中国) ByteDance(字节跳动) Peking University(北京大学)

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract);分类 cs.CL

AI总结 针对大规模查询流中相关性模型泛化能力不足的问题,SERM通过多代理模块检测分布偏移并生成可靠标签,实现迭代自演化提升性能。

Comments Accepted by Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18847 2026-07-22 cs.CR cs.AI 新提交 83%

Data Leakage Prevention in Agentic Applications via Preemptive Hardening

通过先发制硬化防止智能应用中的数据泄露

Akansha Shukla, Emily Bellov, Parth Atulbhai Gandhi, Yuval Elovici, Asaf Shabtai

机构 * Faculty of Computer and Information Science(计算机与信息科学系) Ben-Gurion University of the Negev(内盖夫本· Gurion大学)

专题命中 工具调用 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究智能应用数据泄露问题,提出预部署管道,通过分析提示模板等识别泄露模式并生成补丁,经硬化和验证确保应用功能不受影响,评估显示能有效减少数据泄露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18816 2026-07-22 cs.DB cs.AI 新提交 83%

AgentTrails: Towards Trust and Reuse for Agentic Tasks

AgentTrails:迈向代理任务的信任与重用

Eden Wu, Sonia Castelo, Yurong Liu, Cláudio T. Silva, Juliana Freire

机构 * New York University(纽约大学)

专题命中 工具调用 :agentic(title);agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 针对大语言模型驱动代理轨迹掩盖数据依赖限制开发人员理解等问题,提出AgentTrails系统,将原始轨迹转换为结构化溯源图,支持执行比较、模式提取等,能揭示隐藏依赖、对齐不同执行并展现重复工具使用模式。

Comments 4 pages, 4 figures. Short paper accepted at the Workshop on Systems for Data-centric Agents with Human-in-the-loop (DASHSys 2026), co-located with VLDB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05462 2026-07-22 cs.CR cs.AI 版本更新 83%

BioSecBench-Refusal: A paired metric for performance and alignment in agentic biosecurity risk assessment

评估两用生物学环境中的校准拒绝和安全有用性

Edwin H. Wintermute, Harmon Bhasin, Christina M. Agapakis, Dianzhuo Wang, Evan Seeyave, Arjun Banerjee, Daniel Fulop, Matthew C. Watson, Adam J. Meyer, Sandrine Boissel, Jens H. Kuhn, Rishi Jain, Noah D. Taylor, Helena Shomar, Patrick M. Boyle, Kenny Workman

机构 * American Wetware(美国湿科公司) LatchBio

专题命中 工具调用 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究针对人工智能用于生命科学工作流可能导致滥用的问题,提出BioSecBench-Refusal基准,将常规与红队任务配对,测试16种配置下模型拒绝率,发现多数配置对常规工作拒绝率高,有推理空间的模型能识别更多威胁,为开发者提供校准工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16355 2026-07-21 cs.CV cs.AI 新提交 83%

PhysAgent: Reflective Agentic Physics Control for Physically Plausible Video Generation

PhysAgent:用于物理上合理的视频生成的反射式智能体物理控制

Qirui Li, Jinkun Hao, Yibo Li, Ran Yi, Paul L. Rosin, Yu-Kun Lai

机构 * Shanghai Jiao Tong University(上海交通大学) Cardiff University(卡迪夫大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究物理上合理的视频生成问题,提出PhysAgent反射式智能体框架,通过闭环设计及物理控制API,改善参数控制,实现复杂轨迹等,实验证明其能生成更合理视频,有更好提示对齐及泛化效果。

Comments For project page, see https://iapple233.github.io/PhysAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15253 2026-07-17 cs.IR cs.CL 新提交 83%

Bridge Evidence: Static Retrieval Utility Does Not Predict Causal Utility in Multi-Step Agentic Search

桥梁证据:静态检索效用无法预测多步智能体搜索中的因果效用

Debayan Mukhopadhyay, Utshab Kumar Ghosh, Shubham Chatterjee

机构 * University of Calcutta(卡塔克大学) Missouri University of Science and Technology(密苏里科技大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 研究智能体检索中静态检索效用与因果效用的差异,通过在HotpotQA上用ReAct风格智能体实验,比较原始与反事实运行得CTU分数,发现两者近乎独立,约三分之一文档为桥梁文档,还确定了相关机制,指出优化静态相关性无法带来因果有用性。

Comments Preprint; extended version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03465 2026-07-17 cs.CL 版本更新 83%

The Tool Illusion: Rethinking Tool Use in Web Agents

工具幻觉:重新审视网络代理中的工具使用

Renze Lou, Baolin Peng, Wenlin Yao, Qianhui Wu, Hao Cheng, Suman Nath, Wenpeng Yin, Jianfeng Gao

机构 * Microsoft Research, Redmond(微软研究院,雷德蒙德) The Pennsylvania State University, University Park(宾夕法尼亚州立大学,大学园)

专题命中 工具调用 :tool use(title,abstract);tool-use(abstract);分类 cs.CL

AI总结 本文通过系统研究不同工具源、基础模型和评估基准,重新审视网络代理中的工具使用,揭示工具效果的稳定性及潜在副作用,为未来研究提供更可靠的实证基础。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13474 2026-07-16 cs.CL 新提交 83%

MyAG: A Graph-Based Framework for Designing and Analyzing Composable LLM Agent Systems

MyAG:一种用于设计和分析可组合大语言模型智能体系统的基于图的框架

Zhisong Zhang

机构 * City University of Hong Kong(香港城市大学)

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.CL

AI总结 介绍用于设计和分析可组合大语言模型智能体系统的MyAG框架,它将构建分为三个图抽象,支持分层组合,提供监控和可视化工具,实验表明其能支持灵活设计并助于分析性能-效率权衡,且已开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13411 2026-07-16 cs.CR cs.LG 新提交 83%

Evaluating Frontier AI Agents as Autonomous Clinical Security Auditors

评估前沿人工智能代理作为自主临床安全审计员

Michael O. Eniolade

机构 * University of the Cumberlands(坎伯兰大学)

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究旨在评估前沿人工智能代理能否自主进行临床人工智能安全审计。基于METR任务标准构建评估任务,让代理按要求实施攻击、计算得分并编写报告。通过对三个前沿模型在不同数据集和模型架构上的评估,得出各模型表现及成本等情况,部分成果已公开。

Comments 29 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11308 2026-07-14 cs.SE cs.CR 新提交 83%

FlowArk: Boosting Agentic Data-flow Analysis for Android Apps via Context-Aware Knowledge Reuse

FlowArk:通过上下文感知知识重用提升安卓应用的智能数据流分析

Yiming Zhang, Jiangrong Wu, Yuhong Nan

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.SE

AI总结 研究安卓应用数据流分析中批量任务重复分析成本高的问题,提出FlowArk系统,通过提炼、打包和注入知识条目降低成本,实验表明其在保持分析质量的同时,能降低API成本并增加任务完成量。

Comments 12 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29116 2026-07-14 cs.AI 版本更新 83%

Characterizing Large Language Model Agentic Workflows: A Study on N8n Ecosystem

表征大语言模型智能体工作流:基于N8n生态系统的研究

Yutian Tang, Yuming Zhou, Huaming Chen

专题命中 工具调用 :agentic(title,abstract);tool use(abstract);分类 cs.AI

AI总结 通过分析6000多个n8n工作流,揭示LLM在低代码平台中嵌入控制逻辑、外部工具和人工审核等结构,但可靠性机制不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18576 2026-07-14 cs.AI 版本更新 83%

Agentic Forecasting using Sequential Bayesian Updating of Linguistic Beliefs

基于序列贝叶斯更新的语义信念的代理预测

Kevin Murphy

机构 * Department of Computer Science(计算机科学系) University of British Columbia(不列颠哥伦比亚大学)

专题命中 工具调用 :agentic(title,abstract);tool-use(abstract);分类 cs.AI

AI总结 BLF系统通过语义信念状态、层级多试聚合和层级校准方法,在预测基准上超越了现有方法,同时具备低泄露率的回测框架。

Comments v4 adds 2 new appendices: app J evaluates a "generative" Bayesian alternative to BLF (which does worse than the "discriminative" approached used by BLF), and app K sketches how to do value of information computation to decide when to stop searching (although this idea has not been tried). v4 also adds a few more recent references

Journal ref v3 was published in ICML AI Forecasting workshop 2026 (https://forecasting-workshop.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24978 2026-07-09 cs.AI cond-mat.quant-gas quant-ph 83%

Agentic Exploration of Physics Models

物理模型的智能体探索

Maximilian Nägele, Florian Marquardt

机构 * Max Planck Institute for the Science of Light(马克斯·普朗克光科学研究所)

专题命中 工具调用 :agentic(title);agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 提出 SciExplorer 智能体,利用大语言模型工具使用能力,无需领域特定蓝图即可探索未知物理系统,通过实验和观测恢复运动方程和哈密顿量。

Journal ref Maximilian Nägele and Florian Marquardt, 2026 Phys. Rev. X 16, 031002

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01109 2026-07-09 cs.AI 版本更新 83%

Platonic Representations for Poverty Mapping: Unified Vision-Language Codes or Agent-Induced Novelty?

贫困地图绘制的柏拉图式表示:统一的视觉语言代码还是智能体诱导的新颖性?

Satiyabooshan Murugaboopathy, Connor T. Jerzak, Adel Daoud

机构 * AI and Global Development Lab(人工智能与全球发展实验室) Institute for Analytical Sociology(分析社会学研究所) Institute of Computer Science(计算机科学研究所) Department of Government(政府系)

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究社会经济指标在卫星图像和网络文本中的信息印记,开发多模态框架经五条管道预测家庭财富,贡献包括融合视觉与文本提升预测、发现部分表示对齐证据、发布大规模多模态数据集。

Comments ICSC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05790 2026-07-08 cs.AI 新提交 83%

Controlling Tool Use with Heading-Specific Activation Steering

通过特定标题激活控制工具使用

Yuqi Chen, Vincent Siu, Yang Liu, Dawn Song, Chenguang Wang

专题命中 工具调用 :tool use(title,abstract);tool-use(abstract);分类 cs.AI

AI总结 研究工具增强大语言模型中工具使用决策的稳定内部表示,通过从标题锚点位置提取引导向量对工具调用行为进行双向因果控制,发现其因果有效性与线性结构不符,还区分了工具使用引导向量与参数化概念的引导向量,二者关系待解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05518 2026-07-08 cs.CR cs.AI 新提交 83%

aiAuthZ: Off-Host, Identity-Bound Authorization for AI Agents

aiAuthZ:人工智能代理的远程、身份绑定授权

Sai Varun Kodathala

机构 * SportsVision AI

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究人工智能代理授权问题,提出aiAuthZ授权网关,通过消息签名验证身份、评估策略,加入审计日志并生成认证收据,有效降低攻击成功率,保障代理调用安全,减少决策延迟。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04124 2026-07-07 cs.RO cs.AI 新提交 83%

Conflict-Based Lazy Search for Fast Multi-Manipulator Planning

基于冲突的懒搜索用于快速多机器人规划

Dongliang Zheng, Zhipeng Wang, Siqi Wang, Yuxi Lu, Bin He, Hesheng Wang, Panagiotis Tsiotras

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Shanghai Institute of Intelligent Science and Technology, the State Key Laboratory of Autonomous Intelligent Unmanned Systems, and Frontiers Science Center for Intelligent Autonomous Systems of Ministry of Education, Tongji University(上海智能无人系统科学中心,上海智能科学与技术研究院,自主智能无人系统国家重点实验室,同济大学智能自主系统前沿科学中心) Department of Automation, Shanghai Jiao Tong University(上海交通大学自动化系) School of Aerospace Engineering and Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(佐治亚理工学院航空航天工程学院和机器人与智能机器研究所)

专题命中 工具调用 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对多机器人在杂乱工作空间的实时规划难题,提出基于冲突的懒搜索(CBLS)算法。该算法基于CBS,通过预计算和懒搜索改进,采用懒评估图与LEA*算法,应用于多机器人规划问题,性能优于CBS和RRT-Connect。

Journal ref IEEE/ASME Transactions on Mechatronics(TMECH) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16870 2026-07-07 cs.CR cs.AI cs.OS 版本更新 83%

Governed MCP: Kernel-Level Tool Governance for AI Agents via Logit-Based Safety Primitives

受控MCP:通过基于logit的安全原语实现AI代理的内核级工具治理

Daeyeon Son

机构 * Independent Researcher(独立研究者)

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出 Governed MCP,一种基于logit的安全原语的内核级工具治理网关,通过六层管道对MCP工具调用进行安全检查,提升AI代理的安全性。

Comments 14 pages, 6 tables. Companion paper to arXiv:2604.11943 (ProbeLogits)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01510 2026-07-03 cs.AI cs.CR 新提交 83%

Janus: a Playground for User-Involved Agentic Permission Management

Janus:用户参与的智能体权限管理实验平台

Natalie Grace Brigham, Eugene Bagdasarian, Tadayoshi Kohno, Franziska Roesner

机构 * University of Washington(华盛顿大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Georgetown University(乔治城大学)

专题命中 工具调用 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 提出Janus系统,通过模块化框架和自动化评估工具,研究用户参与AI智能体权限管理的设计空间,发现用户输入可增强隐私安全,AI辅助可降低认知负担,但需考虑权限疲劳等现实行为。

Comments Code and data released on GitHub: https://github.com/GraceBrigham/Janus

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01366 2026-07-03 cs.AI 新提交 83%

Auto-FL-Research: Agentic Search for Federated Learning Algorithms

Auto-FL-Research: 联邦学习算法的智能搜索

Holger R. Roth, Ziyue Xu, Chester Chen, Daguang Xu, Peter Cnudde, Andrew Feng

机构 * NVIDIA, Santa Clara, USA(英伟达,美国圣克拉拉)

专题命中 工具调用 :agentic(title);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Auto-FL-Research (AFR),一种约束编码代理工作流,用于自动搜索联邦学习算法,在五个医疗和六个LEAF任务上验证了有效性,并分析了搜索结果的机制。

Comments 8 pages; 5 figures; 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01084 2026-07-02 cs.AI 新提交 83%

Can Agents Generalize to the Open World? Unveiling the Fragility of Static Training in Tool Use

智能体能否泛化到开放世界?揭示工具使用中静态训练的脆弱性

Song-Lin Lv, Weiming Wu, Rui Zhu, Zi-Jian Cheng, Lan-Zhe Guo

专题命中 工具调用 :tool use(title);agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 针对LLM智能体在真实场景中因查询、工具集和交互动态变化而性能下降的问题,形式化定义了开放世界工具使用问题,构建了四层层次的环境偏移框架,并通过实验揭示了监督微调和强化学习训练智能体在面对开放环境偏移时的脆弱性,提出了扰动增强微调策略以提升鲁棒性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27996 2026-06-30 cs.AI cs.GR cs.HC 83%

Exploring LLM Agent Designs and Interaction Modalities for Scientific Visualization

探索LLM代理在科学可视化中的交互范式

Jackson Vonderhorst, Kuangshi Ai, Haichao Miao, Shusen Liu, Chaoli Wang

机构 * Univ. Notre Dame(诺特难大学) LLNL(劳伦斯利弗莫尔国家实验室)

专题命中 工具调用 :agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 本文研究不同类型的LLM代理在科学可视化任务中的表现,通过评估八种代表性代理在15个基准任务中的可视化质量、效率、鲁棒性和计算成本,发现通用编程代理任务成功率最高但计算成本高,领域专用代理更高效稳定但灵活性差,计算机使用代理在单步任务表现良好但多步流程受限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04996 2026-06-29 cs.CY cs.CE cs.CL cs.HC cs.RO 83%

Agentic Vehicles for Human-Centered Mobility: Definition, Prospects, and Synergistic Co-Development with Vehicle Autonomy

面向人类中心的移动性:定义、前景以及与车辆自主性的协同发展

Jiangbo Yu, Raphael Frank, Luis Miranda-Moreno, Sasan Jafarnejad, Jonatas Augusto Manzolli, Fuqiang Liu, Jiyao Wang, Pavel Chernakov, Ali Eslami

机构 * Interdisciplinary Centre for Security, Reliability and Trust(跨学科安全、可靠与信任中心) University of Luxembourg(卢森堡大学)

专题命中 工具调用 :agentic(title,abstract);tool use(abstract);分类 cs.CL

AI总结 本文探讨了面向人类中心的移动性,提出了代理车辆的概念,指出自主性和代理性是相互关联但概念上不同的维度,并强调了协同发展的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25960 2026-06-25 cs.AI 新提交 83%

Agentic System as Compressor: Quantifying System Intelligence in Bits

智能体系统作为压缩器:用比特数衡量系统智能

Zihan Qin, Hongrui Zhang

机构 * Peking University(北京大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出将智能体系统视为压缩器,通过算术编码等方法以比特数衡量系统智能,在五个任务中验证智能体组件能减少编码长度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25876 2026-06-25 cs.SE cs.CR 新提交 83%

The Web4 Agent Economy: A Large-Scale Empirical Study of the Landscape, Challenges, and Opportunities

Web4 代理经济:景观、挑战与机遇的大规模实证研究

Yuhan Jin, Shuohan Wu, Chong Chen, Lingfeng Bao, Xiaohu Yang, Jiachi Chen

专题命中 工具调用 :agent(title,abstract);autonomous agent(abstract);分类 cs.SE

AI总结 通过分析99,448个多链身份注册、3.17亿交易日志、341个MCP项目源码和349个GitHub问题,首次大规模实证研究Web4代理生态,发现自主代理已建立活跃的机器对机器支付经济,但基础设施不成熟,支付互操作性是主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏