arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-01 至 2026-06-01 共收录 187 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 14 篇

2605.31097 2026-06-01 cs.DB cs.AI 57%

SpecDB: LLM-Generated Customized Databases via Feature-Oriented Decomposition

SpecDB: 通过面向特征的分解生成LLM定制的数据库

Yunkai Lou, Longbin Lai, Shunyang Li, Zhengping Qian, Ying Zhang

机构 * Alibaba Group(阿里巴巴集团) Zhejiang Gongshang University(浙江工商大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 提出SpecDB系统,利用大语言模型通过面向特征的分解和依赖图DBGraph,从自然语言工作负载描述自动生成定制化关系数据库,在TPC-C测试中达到与PostgreSQL和MySQL相当的性能,代码量仅为它们的3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30699 2026-06-01 cs.LG cs.CV 57%

A Context-Aware Middleware for Medical Image Based Reports: An approach based on image feature extraction and association rules

基于医学图像报告的情境感知中间件:一种基于图像特征提取和关联规则的方法

Erick O. Rodrigues, Jose Viterbo, Aura Conci, Trueman Mac Henry

机构 * Department of Computer Science(计算机科学系) Departament of Mathematics & Statistics(数学与统计学系) Universidade Federal Fluminense(联邦Fluminense大学) York University(约克大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 提出一种情境感知中间件,通过图像特征提取和关联规则,自动将医学图像分派给最合适的医疗人员,以提高医疗工作流程效率。

Journal ref 2015 IEEE/ACS 12th International Conference of Computer Systems and Applications (AICCSA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18730 2026-06-01 cs.LG cs.AR 57%

Beyond Tokens: Enhancing RTL Quality Estimation via Structural Graph Learning

超越令牌:通过结构图学习增强RTL质量估计

Yi Liu, Hongji Zhang, Yiwen Wang, Dimitris Tsaras, Lei Chen, Mingxuan Yuan, Qiang Xu

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong SAR(香港中文大学计算机科学与工程系) Noah's Ark Lab, Huawei, Hong Kong SAR(华为诺亚实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 提出StructRTL框架,利用控制数据流图的结构语义和自监督学习,结合知识蒸馏,显著提升寄存器传输级设计质量估计的准确性。

Comments Forty-Third International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31093 2026-06-01 cs.CV 50%

Cross-Modal Clinical Knowledge Integration for Mammography Report Generation

跨模态临床知识整合用于乳腺X线报告生成

Jiayi Zhu, Fuxiang Huang, Yu Xie, Xi Wang, Zhixuan Chen, Yuan Guo, Qingcong Kong, Zhenhui Li, Qiong Luo, Hao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Lingnan University(岭南大学) The Third Affiliated Hospital of Kunming Medical University, Yunnan Cancer Hospital, Peking University Cancer Hospital Yunnan(昆明医科大学第三附属医院、云南癌症医院、北京大学肿瘤医院云南分院) Guangzhou First People's Hospital, South China University of Technology(广州第一人民医院、华南理工大学) The Third Affiliated Hospital, Sun Yat-Sen University(中山大学第三附属医院) HKUST Shenzhen-Hong Kong Collaborative Innovation Research Institute(香港科技大学深圳-香港协同创新研究院)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出MammoRG框架,通过两阶段训练模拟临床报告流程,整合BI-RADS指南和先验知识,提升报告生成的临床一致性。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30955 2026-06-01 cs.CE cs.NA math.NA 50%

A non-intrusive approach to index-aware learning

一种非侵入式的索引感知学习方法

Peter Förster, Idoia Cortes Garcia, Wil Schilders, Sebastian Schöps

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种非侵入式索引感知学习框架,用于学习微分代数方程(尤其是电路方程)的时间与参数依赖解,通过解耦微分和代数部分确保物理一致性(如基尔霍夫定律),并以降压转换器为例比较了非侵入式与侵入式版本。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30718 2026-06-01 econ.EM stat.ME stat.ML 50%

Moment-Based Inference for Regression with Latent Dirichlet Covariates

基于矩的潜狄利克雷协变量回归推断

Ziyu Jiang

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对回归前使用主题模型降维导致的推断困难,提出一种基于校正谱矩的方法,直接识别回归系数β,避免估计文档级主题份额,并通过可交换性条件估计未知总浓度α0,实现有效推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30659 2026-06-01 physics.flu-dyn 50%

Neural-Network-based Viscosity Closure for Non-Newtonian Multiphase Flows

基于神经网络的非牛顿多相流黏度闭合模型

Suresh Murugaiyan, Claire L. Nelson, Dhruv Gamdha, Austin Cunniff, Cheng-Hau Yang, Abraham Wiletsky, Kaitlyn W. Dilley, Patrick Babb, Andrew Rhode, Christopher M. Bates, Angela A. Pitenis, Michael L. Chabinyc, Adarsh Krishnamurthy, Baskar Ganapathysubramanian

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种将实验流变数据训练的神经网络作为黏度闭合模型,集成到Cahn-Hilliard-Navier-Stokes有限元求解器中的工作流程,用于非牛顿多相流模拟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25361 2026-06-01 physics.chem-ph 50%

An Efficient On-the-Fly Nonadiabatic Coupling Framework Integrated into CP2K

集成到CP2K中的高效即时非绝热耦合框架

Xiaoke He, Hsiao-Yi Tsai, Ziwei Chai, Junwen Yin, Zhongfei Xu, Li-Min Liu

专题命中 工作流自动化 :workflow(abstract)

AI总结 通过在CP2K中直接实现非绝热耦合模块,结合高斯与平面波方法和相位校正方案,实现了大规模体系的高效非绝热分子动力学模拟。

Comments 16 pages of main text, 4 figures. Includes 5 pages of Supporting Information

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07295 2026-06-01 cond-mat.mtrl-sci cond-mat.mes-hall 50%

The impact of spurious imaginary phonon modes on thermal properties of Metal-organic Frameworks

虚假虚声子模式对金属有机框架热性质的影响

Prathami Divakar Kamath, Kristin A. Persson

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文系统展示了虚假虚声子模式会显著引入热容估计误差,导致基于热性质的MOF筛选排序错误,并提出了一种简单快速的后处理工作流来校正热容估计。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 11 篇

2605.30248 2026-06-01 cs.CV 85%

GenClaw: Code-Driven Agentic Image Generation

GenClaw: 代码驱动的智能体图像生成

Junyan Ye, Jun He, Zilong Huang, Dongzhi Jiang, Xuan Yang, Rui Chen, Weijia Li

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);workflow(abstract)

AI总结 提出GenClaw,一种代码驱动的智能体图像生成范式,通过概念构思、代码草图绘制和纹理补充三个阶段,将黑盒图像生成转变为可控、可解释的分阶段过程。

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30677 2026-06-01 cs.CR cs.AI cs.SE 81%

Investigating Detection and Obfuscation of Prompt Injection Attacks Against Software Reverse Engineering AI Agents

针对软件逆向工程AI代理的提示注入攻击的检测与混淆研究

Brian Crawford, Patrick McClure

机构 * Dept. of Computer Science(计算机科学系) Naval Postgraduate School(海军学院)

专题命中 软件智能体 :AI agent(title);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本研究针对软件逆向工程AI代理面临的提示注入攻击,提出了检测反编译器输出中提示注入字符串的防御策略,并探索了攻击混淆及相应防御方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28916 2026-06-01 astro-ph.IM cs.AI cs.HC 80%

First head-to-head comparison of agentic AI applied to the analysis of simulated data of the Einstein Telescope

应用于爱因斯坦望远镜模拟数据分析的智能体AI首次头对头比较

Gianluca Inguglia

机构 * Anthropic OpenAI

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI

AI总结 本文首次直接比较了Claude Code和Codex两种智能体AI系统在无人干预下自主执行引力波数据分析管线的行为、科学结果和计算成本,揭示了速度与可审计性、指令解释差异等关键问题。

Comments Version 2; includes the report autonomoulsy written in PRD style by agentic AI systems as supplemental material

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16187 2026-06-01 cs.SE cs.LG 73%

MatchFixAgent: Language-Agnostic Autonomous Repository-Level Code Translation Validation and Repair

MatchFixAgent: 语言无关的自主仓库级代码翻译验证与修复

Ali Reza Ibrahimzada, Brandon Paulsen, Reyhaneh Jabbarvand, Joey Dodds, Daniel Kroening

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign, Urbana, IL, USA(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Amazon, Arlington, VA, USA(亚马逊公司,阿灵顿,弗吉尼亚州,美国) University of Oxford, Oxford, UK(牛津大学,牛津,英国)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG、cs.SE

AI总结 提出基于大语言模型的多智能体框架MatchFixAgent,实现语言无关的仓库级代码翻译等价性验证与修复,在验证覆盖率和修复成功率上显著优于现有方法。

Comments Published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30680 2026-06-01 cs.AI cs.MA 70%

Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response

战略提供者响应下的策略即代码搜索中的医疗机制

Zihan Wang, Xiang Xu, Hongyuan Zha, Wenhao Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Tongji University(同济大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 将医疗机制设计转化为语言模型的程序合成,通过多智能体模拟器Medi-Sim评估策略提供者响应下的均衡,并利用LLM引导的进化代码搜索合成可检查的混合目标程序。

Comments 32 pages, 18 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31445 2026-06-01 cs.GT cs.AI cs.CL cs.LG 67%

Used Car Salesbots? Honesty and Credulity of LLMs as Bargaining Agents under Partial Information

二手车销售机器人?作为讨价还价代理的LLM在部分信息下的诚实与轻信

Antonio Valerio Miceli-Barone, Vaishak Belle, Shay B. Cohen

机构 * University of Edinburgh(爱丁堡大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究LLM代理在模拟讨价还价场景中的表现,发现它们偏离博弈论均衡,尝试撒谎但无法有效利用信息不对称,且优化财务效用会增强谈判能力但增加不诚实行为。

Comments 18 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07457 2026-06-01 cs.SE cs.AI cs.CL 67%

Pull Requests as a Training Signal for Repo-Level Code Editing

拉取请求作为仓库级代码编辑的训练信号

Qinglin Zhu, Tianyu Chen, Shuai Lu, Lei Ji, Runcong Zhao, Murong Ma, Xiangxiang Dai, Yulan He, Lin Gui, Peng cheng, Yeyun Gong

机构 * King's College London, UK(伦敦国王学院) Chinese University of Hong Kong, HK(香港中文大学) National University of Singapore, SG(新加坡国立大学) Microsoft Research Asia, CN(微软亚洲研究院) The Alan Turing Institute, UK(艾伦·图灵研究所)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 提出Clean-PR方法,利用真实GitHub拉取请求作为训练信号,通过重建和验证转换为搜索/替换编辑块,结合无代理对齐的监督微调,在SWE-bench上显著提升仓库级代码编辑性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31040 2026-06-01 cs.LG 57%

UniRTL: Unifying Code and Graph for Robust RTL Representation Learning

UniRTL:统一代码和图以实现稳健的RTL表示学习

Yi Liu, Hongji Zhang, Lei Chen, Mingxuan Yuan, Qiang Xu

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong SAR(计算机科学与工程系,香港中文大学,香港特别行政区) Noah's Ark Lab, Huawei, Hong Kong SAR(华为诺亚实验室,香港特别行政区)

专题命中 软件智能体 :workflow(abstract);分类 cs.LG

AI总结 提出UniRTL多模态预训练框架,通过互掩码建模和分层训练策略联合利用RTL代码与控制数据流图,实现细粒度对齐,在性能预测和代码检索任务上优于现有方法。

Comments Forty-Third International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22967 2026-06-01 cs.LG 57%

Learned Relay Representations for Forward-Thinking Discrete Diffusion Models

学习的中继表示用于前向思考的离散扩散模型

Benjamin Rozonoyer, Jacopo Minniti, Dhruvesh Patel, Neil Band, Avishek Joey Bose, Tim G. J. Rudner, Andrew McCallum

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of Toronto(多伦多大学) Stanford University(斯坦福大学) Imperial College London(伦敦帝国学院) Mila Vijil

专题命中 软件智能体 :planning(abstract);分类 cs.LG

AI总结 提出Learned Relay Representations (Relay)方法,通过可微通道传递潜在信息,使掩码扩散模型在去噪步骤间前向思考,减少推理延迟并提升性能。

Comments 16 pages, 3 figures. Equal contribution: Benjamin Rozonoyer, Jacopo Minniti, and Dhruvesh Patel. Code: https://github.com/jacopo-minniti/relay

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14842 2026-06-01 cs.CV cs.AI 57%

PictSure: Pretraining Embeddings Matters for In-Context Learning Image Classifiers

PictSure:预训练嵌入对上下文学习图像分类器至关重要

Lukas Schiesser, Cornelius Wolff, Sophie Haas, Simon Pukrop

机构 * German Research Center for AI (DFKI)(德国人工智能研究中心(DFKI)) Centrum Wiskunde & Informatica (CWI)(数学与信息学研究中心(CWI))

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 本文提出PictSure视觉上下文学习模型,发现预训练嵌入质量是下游性能的关键瓶颈,而融合层训练数据的多样性影响有限。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08503 2026-06-01 q-fin.MF 50%

Optimal Contract Design with Quadratic Effort Cost

具有二次努力成本的最优契约设计

Xinfu Chen, Shuaijie Qian, Guan Qiao

专题命中 软件智能体 :agent(abstract)

AI总结 本文通过证明相应HJB方程经典解的存在性,解决了二次努力成本下委托代理问题中最优契约的存在性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 5 篇

2605.31365 2026-06-01 cs.AI 83%

Learning to Adapt: Self-Improving Web Agent via Cognitive-Aware Exploration

学习适应:通过认知感知探索实现自我改进的网络智能体

Weile Chen, Bingchen Miao, Qifan Yu, Wendong Bu, Guoming Wang, Wenqiao Zhang, Shengyu Zhang, Juncheng Li, Siliang Tang

机构 * Zhejiang University(浙江大学)

专题命中 GUI与网页智能体 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 提出SCALE框架,利用选择器、预测器和评判器三个对抗角色,通过环境探索自主发现智能体局限性并扩展认知边界,结合SCALE-Hop图探索策略和SCALE-20k数据集,显著提升多模态大语言模型在多种网络环境中的性能和泛化能力。

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31224 2026-06-01 cs.CY cs.AI cs.HC 57%

Comparing LLM-Based Conversational and Graphical Interfaces for Industrial Decision Tasks: An Exploratory Mixed-Methods Study

基于LLM的对话式与图形化界面在工业决策任务中的比较:一项探索性混合方法研究

Roberto Figliè, Simone Caputo, Alan Serrano, Tommaso Turchi, Daniele Mazzei

机构 * Department of Computer Science(计算机科学系) University of Pisa(比萨大学) Department(部门) San Matteo Hospital(圣玛泰奥医院) Brunel University of London(伦敦布鲁内尔大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 通过混合方法研究,比较了基于LLM的对话式界面与图形化仪表盘在工业决策任务中的表现,发现对话式界面可减少交互努力,但仪表盘在概览和验证方面仍有价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19452 2026-06-01 cs.RO cs.CV cs.LG 57%

HUNT: High-Speed UAV Navigation and Tracking in Unstructured Environments via Instantaneous Relative Frames

HUNT:通过瞬时相对帧在非结构化环境中进行高速无人机导航与跟踪

Alessandro Saviolo, Jeffrey Mao, Giuseppe Loianno

机构 * New York University(纽约大学) University of California Berkeley(加州大学伯克利分校)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.LG

AI总结 提出HUNT框架,利用瞬时相对帧统一搜索与跟踪,实现高速飞行和鲁棒自主性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30884 2026-06-01 cs.CV 50%

GUI-C$^2$: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning

GUI-C$^2$:基于难度感知强化学习的由粗到细GUI定位

Junlong Li, Chao Hao, Lap-Pui Chau, Yi Wang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 GUI与网页智能体 :agentic(abstract)

AI总结 提出GUI-C$^2$框架,通过难度感知数据筛选和由粗到细的强化学习机制,解决GUI定位中训练样本难度不均和视觉区域裁剪权衡问题,实现最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30468 2026-06-01 cs.RO 50%

Learning-Based Navigation for Indoor Mobile Robots

基于学习的室内移动机器人导航

Tri-Tin Nguyen, Tien-Dat Nguyen, Gia-Uy Le, Vinh Nguyen, Vinh-Hao Nguyen

机构 * Faculty of Electrical Electronic Engineering, Ho Chi Minh City University of Technology, VNU-HCM Ho Chi Minh City, Vietnam

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 提出一种结合监督学习全局规划器与基于学习的DWA局部规划器的导航框架,通过行为克隆和PPO优化实现安全避障导航。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 14 篇

2605.31468 2026-06-01 cs.AI 85%

AutoSci: A Memory-Centric Agentic System for the Full Scientific Research Lifecycle

AutoSci: 面向完整科学生命周期的以记忆为中心的智能体系统

Weitong Qian, Beicheng Xu, Zhongao Xie, Bowen Fan, Guozheng Tang, Jiale Chen, Xinzhe Wu, Mingtian Yang, Chenyang Di, Jiajun Li, Lingching Tung, Peichao Lai, Yifei Xia, Ziyi Guo, Yanwei Xu, Yanzhao Qin, Shaoduo Gan, Xupeng Miao, Bin Cui

机构 * Peking University(北京大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出AutoSci,一个以记忆为中心、支持完整科学生命周期的智能体系统,通过结构化记忆、多阶段流程、有向无环图增强和演化机制实现自动化科研。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30858 2026-06-01 cs.LG 83%

ForecastCompass: Guiding Agentic Forecasting with Adaptive Factor Memory

ForecastCompass: 自适应因子记忆引导的智能预测

Yurui Chang, Yongkang Du, Yuanpu Cao, Jinghui Chen, Lu Lin

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 提出ForecastCompass框架,通过分层预测任务分类和双组件记忆(因子记忆与推理记忆),结合回顾分析迭代修正,提升智能体在动态环境中的概率预测准确性和校准性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31042 2026-06-01 cs.CR cs.AI cs.CL 81%

From Prompt Injection to Persistent Control: Defending Agentic Harness Against Trojan Backdoors

从提示注入到持久控制:防御智能体框架中的木马后门

Jiejun Tan, Zhicheng Dou, Xinyu Yang, Yuyang Hu, Yiruo Cheng, Xiaoxi Li, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院 Gallagher 学院)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出ClawTrojan基准测试揭示本地智能体框架中的多步木马攻击,并设计DASGuard防御方法,通过扫描控制文本、追溯来源并清除不可信控制内容,实现动态防御。

Comments Code and data are available at https://github.com/RUC-NLPIR/ClawTrojan

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30771 2026-06-01 cs.CL 79%

Eywa: Provenance-Grounded Long-Term Memory for AI Agents

Eywa:基于溯源的人工智能智能体长期记忆

Resham Joshi

机构 * Eywa

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.CL

AI总结 提出Eywa架构,通过先存储证据再推导事实、验证记忆并采用确定性多路径读取(零LLM调用)实现可审计的长期记忆,在多个基准测试中取得高准确率。

Comments 29 pages, 3 figures, 16 tables. Benchmark artifacts available at https://eywa.to/research

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30842 2026-06-01 cs.LG 77%

CoMem: Context Management with A Decoupled Long-Context Model

CoMem: 基于解耦长上下文模型的上下文管理

Yuwei Zhang, Chengyu Dong, Shuowei Jin, Changlong Yu, Hejie Cui, Hongye Jin, Xinyang Zhang, Hamed Bonab, Colin Lockard, Jianshu Chen, Zhenyu Shi, Jingbo Shang, Xian Li, Bing Yin

机构 * Halıcıoğlu Data Science Institute, University of California, San Diego(哈里卡卢斯数据科学研究所,加州大学圣地亚哥分校) Amazon(亚马逊)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.LG

AI总结 提出CoMem框架,通过将记忆管理与智能体工作流解耦并采用k步偏移异步流水线,利用奖励驱动训练策略,在SWE-Bench-Verified上实现1.4倍延迟改进且保持大部分性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏