arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-25 至 2026-06-25 共收录 33 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 4 篇

2606.05872 2026-06-25 cs.AI cs.CV 版本更新 89%

Entropy-Based Observability for AI Agent Behavior

基于熵的AI智能体评估:一种测量行为模式的轻量级框架

Olasimbo Ayodeji Arigbabu

机构 * Olasimbo Ayodeji Arigbabu(奥拉西姆波·阿里加布)

专题命中 工具调用 :agent(title,abstract);AI agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 提出一种基于熵的轻量级评估框架(EEA),通过动作熵、轨迹熵、工具熵、信息增益、探索效率和鲁棒性熵等指标,从决策过程结构角度补充传统任务成功率等评估方法。

Comments 6 pages, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10913 2026-06-25 cs.AI cs.PL cs.SE 版本更新 84%

Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces

Shepherd: 一个为元代理提供形式化执行迹的运行时基座

Simon Yu, Derek Chong, Ananjan Nandi, Dilara Soylu, Jiuding Sun, Christopher D Manning, Weiyan Shi

机构 * Northeastern University(东北大学) Stanford University(斯坦福大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 提出Shepherd,一个基于函数式编程的Python运行时基座,将代理执行作为一等对象,通过类似Git的执行迹支持元代理的检查、分叉和重放,在三个用例中显著提升性能。

Comments 50 pages, 22 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29682 2026-06-25 cs.CL 版本更新 83%

Scaling Laws for Agent Harnesses via Effective Feedback Compute

智能体框架的有效反馈计算缩放定律

Xuanliang Zhang, Dingzirui Wang, Keyan Xu, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨理工大学)

专题命中 工具调用 :agent(title,abstract);tool use(abstract);分类 cs.CL

AI总结 提出有效反馈计算(EFC)作为缩放坐标,通过衡量信息性、有效性、非冗余性和保留性来预测智能体框架性能,在多个任务上优于原始计算基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23132 2026-06-25 cs.CR cs.AI 版本更新 77%

Verifiable Manifest Signing and Transparency Enforcement for Secure MCP-Based LLM Pipelines

可验证的清单签名与透明度强制:面向基于MCP的安全LLM流水线

Saeid Jamshidi, Kawser Wazed Nafi, Arghavan Moradi Dakhel, Foutse Khomh, Mohammad Hamdaqa

机构 * SWAT Laboratory, Polytechnique Montréal(SWAT实验室,蒙特利尔理工学院) SæT Laboratory, Polytechnique Montréal(SæT实验室,蒙特利尔理工学院)

专题命中 工具调用 :agent(abstract);tool-use(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对MCP协议缺乏工具清单认证的问题,提出清单级强制层,通过策略验证、新鲜度检查、数字签名、执行前验证和Merkle透明度日志,实现低开销、可追溯的LLM工具调用安全控制。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 5 篇

2604.25345 2026-06-25 cs.AI astro-ph.IM 版本更新 85%

Plausible but Wrong: A case study on Agentic Failures in Astrophysical Workflows

可能但错误:天体物理工作流中代理失败的案例研究

Shivam Rawat, Lucie Flek

机构 * Bonn-Aachen International Center for Information Technology, University of Bonn, Germany(波恩-阿森国际信息科技中心,波恩大学,德国) Lamarr Institute for Machine Learning and Artificial Intelligence, Germany(拉马尔机器学习与人工智能研究所,德国)

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract);workflow(abstract);分类 cs.AI

AI总结 研究评估了CMBAgent在两种工作流范式和十八个天体物理任务中的表现,发现代理在缺乏上下文时性能提升显著,但常出现静默错误,产生看似合理却不准确的结果,揭示了代理科学工作流中最危险的失败模式是自信生成错误结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23129 2026-06-25 cs.LG 版本更新 79%

Polaris: A Gödel Agent Framework for Small Language Models through Experience-Abstracted Policy Repair

Polaris:通过经验抽象策略修复实现小型语言模型的Gödel代理框架

Aditya Kakade, Vivek Srivastava, Shirish Karande

机构 * TCS Research, India(印度TCS研究)

专题命中 规划决策 :agent(title,abstract);分类 cs.LG

AI总结 Polaris通过经验抽象策略修复实现小型语言模型的Gödel代理框架,通过分析、策略形成、抽象和最小代码修补实现策略更新,提升模型在多个基准测试中的表现。

Comments Accepted to ACL 2026 (Findings). 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17059 2026-06-25 cs.LG 版本更新 57%

Consistent Zero-Shot Imitation with Contrastive Goal Inference

基于对比目标推理的零样本模仿一致性方法

Kathryn Wantlin, Chongyi Zheng, Benjamin Eysenbach

机构 * Department of Computer Science, Princeton University, Princeton, NJ, USA(普林斯顿大学计算机科学系)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 提出对比逆强化学习(CIRL),通过将多任务逆RL转化为目标推理问题,利用对比RL、自动目标提议和变分推断实现零样本模仿,理论证明其能一致恢复演示者意图,实验优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00287 2026-06-25 eess.SY cs.SY 版本更新 50%

From Net Load Modifiers to Firm Capacity: The Role of Distributed Energy Resources in Resource Adequacy

从净负荷调节器到可靠容量:分布式能源在资源充足性中的作用

Yujia Li, Alexandre Moreira, Miguel Heleno

专题命中 规划决策 :planning(abstract)

AI总结 本文综述了分布式能源(如屋顶光伏、电池、需求响应和电动汽车)在资源充足性框架中的容量认定路径,分析了加州、PJM等地区的规则耦合问题,并提出协调改革建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09036 2026-06-25 cs.RO 版本更新 50%

RoDyn: Taming Interactive Robot-Dynamic 2.5D World Model for Robotic Manipulation

RoDyn: 驯服交互式机器人动态2.5D世界模型用于机器人操作

Chuanrui Zhang, Zhengxian Wu, Guanxing Lu, Yansong Tang, Ziwei Wang

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Tsinghua University, Beijing, China(清华大学,北京,中国)

专题命中 规划决策 :agent(abstract)

AI总结 提出RoDyn,一种几何感知的2.5D世界模型,通过机器人动态分词器和掩码引导自回归架构,在高效潜在空间中建模环境动态,提升生成保真度并显著改善下游强化学习和模仿学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 4 篇

2602.12024 2026-06-25 cs.RO 版本更新 89%

Adaptive-Horizon Conflict-Based Search for Closed-Loop Multi-Agent Path Finding

自适应视界冲突搜索用于闭环多智能体路径规划

Jiarui Li, Federico Pecora, Runyu Zhang, Gioele Zardini

机构 * Laboratory for Information and Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院) Schwarzman College of Computing(施瓦茨曼计算学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 提出ACCBS算法,通过动态调整规划视界和重用约束树,在有限计算预算下快速生成高质量可行解,兼具渐近最优性和扰动适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20133 2026-06-25 cs.AI 版本更新 86%

EvoAgent: An Evolvable Agent Framework with Skill Learning and Multi-Agent Delegation

EvoAgent:一种具备技能学习和多智能体委托的可进化代理框架

Aimin Zhang, Jiajing Guo, Fuwei Jia, Chen Lv, Boyu Wang, Fangzheng Li

机构 * Focus AI Center, Focus Technology Co., Ltd.(Focus技术有限公司人工智能中心) Engineering Research Center of Digital Forensics, Ministry of Education, Nanjing University of Information Science and Technology(信息科学技术大学南京教育部长数字取证工程研究中心) Nanjing University of Science and Technology(南京理工大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI

AI总结 本文提出EvoAgent框架,通过结构化技能学习与分层子代理委托机制,实现技能的持续生成与优化,并通过实验展示其在外贸场景中的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00288 2026-06-25 cs.AI 版本更新 57%

Model-Native Computing Architecture: Envisioning Future System Architecture Through the Lens of Computer Architecture

模型原生计算架构:通过计算机架构的视角展望未来系统架构

Hai Lin, Hoilam Pao, Shaoxiong Zhan, Hai-Tao Zheng

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Pengcheng Laboratory, Shenzhen, China(深圳鹏城实验室)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 本文通过类比计算机架构,提出模型原生计算的概念,并设计了一个六层智能计算架构模型(ICAM),以统一解决大语言模型在系统层面面临的缓存、上下文、调度等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03719 2026-06-25 math.OC cs.SY eess.SY 版本更新 50%

Accelerated Decentralized Constraint-Coupled Optimization: A Dual$^2$ Approach

加速去中心化约束耦合优化:一种双对偶方法

Jingwang Li, Vincent Lau

专题命中 多智能体 :agent(abstract)

AI总结 针对去中心化约束耦合优化问题,提出基于双对偶方法的两种加速算法,在更宽松条件下保证渐近收敛,并实现更低的通信与计算复杂度。

Journal ref IEEE Transactions on Signal Processing, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 工作流自动化 8 篇

2603.25645 2026-06-25 eess.IV cs.CV cs.HC 版本更新 88%

Colon-Bench: An Agentic Workflow for Scalable Dense Lesion Annotation in Full-Procedure Colonoscopy Videos

Colon-Bench:一种用于全流程结肠镜视频中可扩展密集病变标注的智能工作流

Abdullah Hamdi, Changchun Yang, Xin Gao

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒·阿齐兹科学与技术大学)

专题命中 工作流自动化 :workflow(title,abstract);agentic(title,abstract)

AI总结 提出Colon-Bench,通过多阶段智能工作流实现全流程结肠镜视频的密集病变标注,包含528个视频、14类病变、30万+边界框等,并评估多模态大模型在病变分类、开放词汇视频目标分割和视频视觉问答上的性能。

Comments published at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29129 2026-06-25 cs.AI cs.CY econ.GN q-fin.EC 版本更新 83%

Governing Technical Debt in Agentic AI Systems

代理型AI系统中的技术债务治理

Muhammad Zia Hydari, Raja Iqbal, Narayan Ramasubbu

机构 * School of Business, University of Pittsburgh(匹兹堡大学商学院)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文定义了代理型AI系统中的技术债务和随机税概念,并提出通过轻量级仪表盘和治理控制来管理这些负债和运营成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14556 2026-06-25 stat.ME stat.AP 版本更新 82%

Design-Life Levels for Environmental Extremes: A Dependence-Aware Block-Maxima Workflow for Severity and Persistence

环境极值的设计寿命水平:一种考虑依赖性的严重性与持续性块最大值工作流

Tuoyuan Cheng, Xiao Peng, Achmad Choiruddin, Xiaogang He, Kan Chen

专题命中 工作流自动化 :workflow(title,abstract);planning(abstract)

AI总结 提出一种依赖感知的块最大值工作流,统一估计极端严重性、聚类持续性及设计寿命水平,通过滑动块最大值分位数缩放和稳定块窗口池化方法,在短记录依赖数据中改善区间校准,应用于水文和保险损失数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02080 2026-06-25 cs.AI cs.FL cs.LG cs.SE 版本更新 67%

The 4/$δ$ Bound: Designing Predictable LLM-Verifier Systems for Formal Method Guarantee

4/δ 界:设计具有形式方法保证的可预测 LLM-验证器系统

Pierre Dantas, Lucas Cordeiro, Youcheng Sun, Waldir Junior

专题命中 工作流自动化 :planning(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 提出 LLM-验证器收敛定理,将多阶段验证建模为顺序吸收马尔可夫链,证明成功概率 δ>0 时系统几乎必然验证,并导出精确延迟上界 4/δ,经 90000+ 试验验证。

Comments 36 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09661 2026-06-25 physics.ao-ph nlin.AO physics.data-an stat.ME 版本更新 50%

Alternate states and intermingledness in complex high-dimensional systems

复杂高维系统中的交替态与交织性

George Datseris, Johannes Lohmann, Oisín Hamilton, Jacob Haqq-Misra

专题命中 工作流自动化 :workflow(abstract)

AI总结 利用计算非线性动力学方法,提出一种工作流自动识别高维模拟数据中的交替态,并定义交织性指标量化其差异与相似性,应用于气候系统分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29591 2026-06-25 cs.CV 版本更新 50%

FlowID : Enhancing Forensic Identification with Latent Flow-Matching Models

FlowID: 利用潜在流匹配模型增强法医鉴定

Jules Ripoll, David Bertoin, Alasdair Newson, Charles Dossal, Jose Pablo Baraybar

机构 * INSA Toulouse(图卢兹理工学院) La Sorbonne Université(索邦大学) International Committee of the Red Cross(国际红十字委员会)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出FlowID方法,结合单图像微调与注意力掩码,修复暴力死亡面部损伤并保留身份特征,在InjuredFaces基准上优于现有开源方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05354 2026-06-25 cs.CV cs.GR 版本更新 50%

SplatPainter: Interactive Authoring of 3D Gaussians from 2D Edits via Test-Time Training

SplatPainter: 通过测试时训练从2D编辑交互式创作3D高斯

Yang Zheng, Hao Tan, Kai Zhang, Peng Wang, Leonidas Guibas, Gordon Wetzstein, Wang Yifan

机构 * Stanford University(斯坦福大学) Adobe

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出SplatPainter,一种状态感知的前馈模型,通过测试时训练实现从用户2D视图连续编辑3D高斯资产,支持局部细节优化、涂改和全局重着色,达到交互速度。

Comments project page https://y-zheng18.github.io/SplatPainter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07920 2026-06-25 eess.IV cs.CV 版本更新 50%

ArteryX: A Reliable End-to-End Toolbox for Standardized Intracranial Artery Feature Extraction from 3D TOF-MRA

ArteryX:用于从3D TOF-MRA中标准化颅内动脉特征提取的可靠端到端工具箱

Abrar Faiyaz, Nhat Hoang, Giovanni Schifitto, Md Nasir Uddin

机构 * Department of Neurology, University of Rochester(罗切斯特大学神经科部) Department of Physics, University of Rochester(罗切斯特大学物理系) Department of Imaging Sciences, University of Rochester(罗切斯特大学影像科学系) Department of Electrical & Computer Engineering, University of Rochester(罗切斯特大学电气与计算机工程系) Department of Biomedical Engineering, University of Rochester(罗切斯特大学生物医学工程系)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出ArteryX工具箱,通过标准化动脉分类、集成分割处理和图构建,提取形态、拓扑和复杂性特征,在三个数据集上验证其优于iCafe,并降低人工校正负担。

Comments 26 Pages, 6 Figures, Preliminary version of the toolbox was presented at the ISMRM 2025 Conference in Hawaii at the "Software Tools" Session

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 软件智能体 4 篇

2509.06216 2026-06-25 cs.SE cs.AI 版本更新 84%

Agentic Software Engineering: Foundational Pillars and a Research Roadmap

代理软件工程:基础支柱与研究路线图

Ahmed E. Hassan, Hao Li, Dayi Lin, Bram Adams, Tse-Hsun Chen, Yutaro Kashiwa, Dong Qiu

机构 * Queen's University(女王大学) Concordia University(Concordia大学) Nara Institute of Science and Technology(奈ara科学和技术研究院) Huawei Canada(华为加拿大)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 提出代理软件工程(SE 3.0)时代,以“面向人类的SE”和“面向代理的SE”双重模式为基础,重新定义软件工程支柱,并设计代理命令环境(ACE)和代理执行环境(AEE)两种工作台,实现双向人机协作,推动从代理编码到真正代理软件工程的演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29919 2026-06-25 cs.SE 版本更新 79%

SkillReducer: Optimizing LLM Agent Skills for Token Efficiency

SkillReducer: 优化LLM代理技能的令牌效率

Yudong Gao, Zongjie Li, Yuanyuan Yuan, Zimo Ji, Pingchuan Ma, Shuai Wang

专题命中 软件智能体 :agent(title,abstract);分类 cs.SE

AI总结 针对LLM代理技能中令牌浪费问题,提出SkillReducer两阶段优化框架,通过压缩路由描述和重构技能主体,实现48%描述压缩和39%主体压缩,同时提升功能质量2.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01708 2026-06-25 cs.DC cs.AI cs.LG 版本更新 62%

SplitZip: Ultra Fast Lossless KV Compression for Disaggregated LLM Serving

SplitZip:超快无损KV压缩用于解耦的大语言模型服务

Yipin Guo, Siddharth Joshi

机构 * University of Notre Dame IN, USA(诺丁汉大学)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 SplitZip通过GPU友好的无损压缩技术,提升大规模LLM服务中KV缓存的传输效率,实现快速压缩和解压,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11988 2026-06-25 cs.SE cs.AI 版本更新 62%

Evaluating AGENTS.md: Are Repository-Level Context Files Helpful for Coding Agents?

评估 AGENTS.md:仓库级上下文文件对编码助手有帮助吗?

Thibaud Gloaguen, Niels Mündler, Mark Müller, Veselin Raychev, Martin Vechev

机构 * Department of Computer Science(计算机科学系) ETH Zurich(苏黎世联邦理工学院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 通过SWE-bench任务和开发者提交的上下文文件,评估发现上下文文件并未普遍提升编码助手的任务成功率,反而平均增加20%以上的推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. GUI与网页智能体 1 篇

2602.04109 2026-06-25 cs.HC cs.AI 版本更新 70%

Tinker Tales: A Tangible Dialogue System for Child-AI Co-Creative Storytelling

Tinker Tales:一个用于儿童与AI共同创意故事讲述的有形对话系统

Nayoung Choi, Jiseung Hong, Peace Cyebukayire, Ikseon Choi, Jinho D. Choi

机构 * Department of Computer Science, Emory University(埃默里大学计算机科学系) Department of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) School of Nursing, Emory University(埃默里大学护理学院)

专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 提出Tinker Tales有形对话系统,通过结合物理故事板、NFC玩具和移动应用,支持儿童与AI在四个叙事阶段进行协作故事创作,并发现提示框架影响儿童叙事贡献的形式和一致性。

Comments Accepted to SIGDIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 记忆与上下文管理 3 篇

2505.19532 2026-06-25 cs.LG 版本更新 70%

Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning

狐狸进鸡窝:针对强化学习的供应链后门攻击

Shijie Liu, Andrew C. Cullen, Paul Montague, Sarah Erfani, Benjamin I. P. Rubinstein

机构 * School of Computing and Information Systems, University of Melbourne, Parkville, Australia(墨尔本大学计算机与信息系统学院,墨尔本,澳大利亚)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);分类 cs.LG

AI总结 提出SCAB攻击,通过污染仅3%的训练经验即可激活超过90%的触发动作,使受害者平均每轮回报降低80%,揭示了强化学习供应链中的后门攻击风险。

Comments Forty-Third International Conference on Machine Learning (ICML2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03785 2026-06-25 cs.CL cs.AI 版本更新 62%

Membox: Weaving Topic Continuity into Long-Range Memory for LLM Agents

Membox: 将主题连续性编织到LLM智能体的长期记忆中

Dehao Tao, Guoliang Ma, Yongfeng Huang, Minghu Jiang

机构 * Tsinghua University(清华大学) Xinjiang University(新疆大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出Membox层次记忆架构,通过主题织机按局部主题组织对话,并通过轨迹织机跨会话链接宏主题轨迹,在LoCoMo和DialSim上显著提升长程记忆检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20025 2026-06-25 physics.soc-ph cs.CY 版本更新 50%

When Networks Substitute for Outcome Surveillance? A Substitution-Complementarity Framework for Behavioral Signals in Predictive Monitoring

当网络替代结果监测时?预测性监测中行为信号的替代-互补框架

Sepehr Ilami, Qingtao Cao, Babak Heydari

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 提出替代-互补框架,通过Frisch-Waugh-Lovell方差分解分析移动网络在疫情预测中是否提供独立于结果监测的预测信号,发现网络特征在监测退化时显著提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

8. Agent评测 3 篇

2602.00585 2026-06-25 cs.AI 版本更新 79%

Exploring Information Seeking Agent Consolidation

探索信息寻求智能体整合

Guochen Yan, Jialong Wu, Zhengwei Tao, Bo Li, Qintong Zhang, Jiahao Xu, Haitao Mi, Yuejian Fang, Qingni Shen, Wentao Zhang, Zhonghai Wu

机构 * Peking University(北京大学) Tencent(腾讯)

专题命中 Agent评测 :agent(title);agentic(abstract);分类 cs.AI

AI总结 通过系统实证研究,比较数据级混合与参数级合并两种范式,发现参数级合并能以更低成本达到数据混合的性能,并保留跨域能力。

详情

展开后加载摘要…

URL PDF HTML 收藏