arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 566 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 566 篇

2606.07721 2026-06-09 cs.AI 新提交 92%

Automatic Extraction of Structured Information from Brain MRI Reports Using an Open-Weight Large Language Model

使用开源大语言模型从脑MRI报告中自动提取结构化信息

Kaouther Mouheb, Amos Pomp, Antoine Manenti, Romy de Haan, Farog Faghir, Joy Martens, Harro Seelaar, Francesco Mattace-Raso, Meike W. Vernooij, Frank J. Wolters, Stefan Klein, Esther E. Bron

机构 * Department of Radiology & Nuclear Medicine, Erasmus MC(埃因霍温麦斯特大学放射科与核医学部) Department of Epidemiology, Erasmus MC(埃因霍温麦斯特大学流行病学部) Department of Electrical and Electronics Engineering, ENSEEIHT(ENSEEIHT电子与电气工程系) Alzheimer Centre Erasmus MC(埃因霍温麦斯特大学阿尔茨海默病中心) Department of Neurology, Erasmus MC(埃因霍温麦斯特大学神经医学部) Department of Internal Medicine, Erasmus MC(埃因霍温麦斯特大学内科部)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);prompting(abstract)

AI总结 本研究评估了开源LLM LLaMA 3.1从荷兰语脑MRI报告中自动提取结构化信息的能力,通过零样本和少样本提示策略,在视觉评分、病变检测等任务上取得高准确率,少样本提示进一步提升了数值变量的提取性能。

Comments Submitted to European Radiology

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19857 2026-06-19 cs.CL cs.AI 新提交 92%

Large Language Models Do Not Always Need Readable Language

大型语言模型并不总是需要可读语言

Jiayi Zhu, Haoxuan Peng, Junxi Wang, Liang Ke, Chen Zhang, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Sydney(悉尼大学) Hefei University of Technology(合肥工业大学) Xi’an Jiaotong University(西安交通大学) Nanjing University(南京大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究提出BabelTele表示法,将语义编码为紧凑、非标准文本,牺牲人类可读性但保持LLM可恢复性,实验表明可压缩至27.9%长度并保持99.5%语义保真度,降低上下文开销。

Comments 23 pages, 10 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11215 2026-08-13 cs.AI cond-mat.stat-mech cs.CL cs.LG cs.MA physics.soc-ph 新提交 92%

Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop

简易智能体建模:在笔记本电脑上模拟大型大语言模型(LLM)智能体群体

Igor Itkin

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出用低成本拟合的低参数模型替代LLM智能体,可在笔记本电脑上模拟任意数量的LLM智能体群体,通过「交互顺序×记忆」分类法验证了该方法在多个LLM模拟上的有效性。

Comments 25 pages, 12 figures. Code and data at github.com/YehudaItkin/poor-mans-agentic-modeling; systematic review and pre-registration archived at Zenodo (doi:10.5281/zenodo.21198322, doi:10.5281/zenodo.21340310)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00007 2026-08-04 cs.CL cs.AI cs.LG 新提交 92%

MemoryForge: Synthesize Lifelong Memory for Human-Like LLM Agents

MemoryForge:为类人LLM智能体合成终身记忆

Bohan Tang, Yiwen Guo

机构 * Tencent(腾讯)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MemoryForge是从简短目标画像合成终身记忆的框架,通过记忆条件让冻结LLM动态检索相关记忆,在两类任务实验中使其表现更类人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13177 2026-06-12 cs.CL cs.AI cs.LG 新提交 92%

MemRefine: LLM-Guided Compression for Long-Term Agent Memory

MemRefine: 基于LLM引导的压缩用于长期智能体记忆

Minjae Kim, Jinheon Baek, Soyeong Jeong, Sung Ju Hwang

机构 * Korea University(韩国大学) KAIST(韩国科学技术院)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出MemRefine框架,利用LLM判断事实内容,通过删除、合并和保留操作将记忆库压缩到固定预算内,在多个基准上保持下游性能并优于基于规则的基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08944 2026-06-09 cs.AR cs.PL 新提交 92%

LongRTL: Graph-Similarity-Guided LLM-driven Long Context RTL Optimization

LongRTL:基于图相似性的LLM驱动的长上下文RTL优化

Yuyang Ye, Che-Kuan Shen, Xiangfei Hu, Yuchen Liu, Shuo Yin, Xufeng Yao, Bei Yu, Tsung-Yi Ho

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 提出一种基于图相似性的LLM驱动RTL优化框架,通过分区、优化和重构三个智能体解决长上下文RTL代码的优化问题。

Comments 7 pages, 6 figures, 5 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29032 2026-08-03 cs.MA cs.CL 新提交 92%

TransMem: Transforming Hidden States into Memory for Large Language Models

TransMem:将隐藏状态转换为大语言模型的记忆

Haodong Lei, Junming Liu, Yirong Chen, Pinlong Cai, Botian Shi, Ding Wang, Hongsong Wang

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 针对长上下文LLM智能体的历史信息未充分利用问题,提出轻量级记忆模块TransMem,结合证据条件自蒸馏,在多基准测试中显著提升性能。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28979 2026-08-03 cs.CL 新提交 92%

Mixture-of-Translators: Translating KV Caches Across Heterogeneous Large Language Models

混合翻译器:跨异构大语言模型的KV缓存转换

Jin-woo Lee, Minkyung Song, Junghyun Oh, Seunghoon Han, Soyoung Park, Gwangseon Jang, Sungsu Lim

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 提出MoT框架解决异构LLM间KV缓存无法复用问题,通过多翻译器模块和上下文校正损失实现缓存转换,在多模型转换和实际场景中验证了性能与复用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27797 2026-07-31 cs.LG 新提交 92%

Revisiting Predictive Process Monitoring in the Age of Foundation Models: A Comparative Study of Sequence, Tabular, and LLM Approaches

基础模型时代的预测过程监控再审视:序列、表格与大语言模型方法的对比研究

Lennart Fertig, Lukas Kirchdorfer, Tobias Sesterhenn

机构 * University of Mannheim(曼海姆大学) SAP Signavio(思爱普 Signavio) Technical University of Clausthal(克劳斯塔尔工业大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 该研究对比序列、表格基础模型与LLM在PPM任务的表现,发现序列模型下一个活动预测最优,表格模型在时间任务具竞争力,LLM性能滞后且成本更高。

Comments Accepted at ECML PKDD 2026 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25380 2026-07-29 cs.CL 新提交 92%

Memory for Large Language Models

大语言模型的记忆

Sining Zhoubian, Dan Zhang, Evgeny Kharlamov, Jie Tang

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Bosch AI(博世人工智能)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 综述对大语言模型中记忆这一基础架构维度进行系统分类,沿表示、更新动态、持久性三个正交轴表征记忆,形式化相关机制,阐明不同内存概念界限,分析混合架构等,为以记忆为中心的LLM设计及未来创新提供基础。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01248 2026-07-03 cs.CY cs.AI 新提交 92%

A Practice Auditing Framework for Large Language Model Use: Collective Empiricism, Pseudo-Rational Cognition, and Governance of AI-Generated Content

大型语言模型使用的实践审计框架:集体经验主义、伪理性认知与AI生成内容治理

Yang Zhao, Yingshuo Li, Zeyu Zhang

机构 * School of Information and Electronics, Beijing Institute of Technology(信息与电子学院,北京理工大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出实践审计框架,通过集体经验主义和伪理性认知概念分析LLM使用中的认知风险,并设计基于需求定义、证据审计等步骤的治理流程。

Comments English manuscript. 2 tables, 17 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15609 2026-06-16 cs.CR cs.AI 新提交 92%

FragFuse: Bypassing Access Control of Large Language Model Agents via Memory-Based Query Fragmentation and Fusion

FragFuse:通过基于记忆的查询碎片化与融合绕过大型语言模型智能体的访问控制

Zixin Rao, Wentian Zhu, Chan Aristella Lu, Zhaorun Chen, Wei Niu, Le Guan, Bo Li, Zhen Xiang

机构 * University of Georgia(佐治亚大学) University of Chicago(芝加哥大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出FragFuse攻击,利用LLM智能体的长期记忆机制,将违禁内容碎片化存储后融合重构,绕过访问控制,平均绕过成功率达86.3%。

Comments 33 pages, 4 figures. Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04095 2026-08-06 cs.AI cs.CL 新提交 92%

FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents

FinPerMA:一种基于理论、事件驱动的LLM智能体个性化记忆基准

Ben Wang, Kang Zhou, Lifan Guo, Feng Chen, Chi Zhang

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究针对LLM智能体个性化记忆的现有基准不足,提出FinPerMA基准,在276个角色的2994个问题上测试7种LLM,发现其记忆配置远未饱和,简单检索优于专用记忆系统且冲击后差距扩大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21144 2026-06-23 cs.CL cs.AI 新提交 92%

AdaMem: Learning What to Remember for Personalized Long-Horizon LLM Agents

AdaMem: 学习为个性化长时程LLM代理记住什么

Xingyu Chen, Rui Wang, Zhaopeng Tu, Liefeng Bo

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent(腾讯)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对长时程LLM代理中记忆膨胀导致QA准确率下降的问题,提出AdaMem方法,通过角色特定的记忆策略和基于反馈的轻量级自反思步骤,学习为每个用户记住重要信息,在减少9%记忆量的同时提升QA准确率最高9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01657 2026-08-04 cs.DC 新提交 92%

Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches

在多租户大语言模型前缀缓存中保留准入责任

Zhiyu Wang, Rajkumar Buyya

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 针对多租户LLM前缀缓存的准入责任缺口,提出PrefixShield方法,在vLLM中实现后可显著提升受害者缓存命中率,恢复良性行为并优化资源利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14882 2026-06-16 cs.RO 新提交 92%

DynaHMRC: Decentralized Heterogeneous Multi-Robot Collaboration for Dynamic Tasks with Large Language Models

DynaHMRC: 基于大语言模型的动态任务去中心化异构多机器人协作

Wenhao Yu, Yu'ang Xie, Yifan Duan, Jie Peng, Guanting Ye, Ka-Veng Yuen, Yanyong Zhang, Jianmin Ji

机构 * University of Science and Technology of China (USTC)(中国科学技术大学) University of Macau (UM)(澳门大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 提出DynaHMRC去中心化框架,每个机器人作为角色感知的LLM智能体,通过四阶段闭环流程(自我描述、任务分配与领导竞标、领导者选举、反思执行)实现动态异构多机器人协作,并构建基准测试验证其高效性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08131 2026-08-11 cs.CR cs.AI cs.MA 新提交 92%

Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario

LLM智能体系统中潜在入侵的组合式威胁分析:66号指令场景

Satoshi Matsuoka

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文以66号指令为场景,提出组合模型分析LLM智能体系统的潜在入侵威胁,分离三类传播路径,指出现有防御无法封闭所有路径,最强防御为能力调解等四项措施,暂未发现完整场景的公开观测。

Comments Version 11.3, 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02113 2026-08-04 cs.AI 新提交 92%

MemArbiter: Decision-Time Memory Arbitration for Long-Horizon LLM Agents

MemArbiter:面向长 horizon LLM 智能体的决策时内存仲裁

Jiajun Dong, Yutao Hu, Fengrui Fan, Shihan Dou, Yueming Wu, Deqing Zou

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对长 horizon LLM 智能体的内存-行动差距,提出感知功能的内存仲裁框架 MemArbiter,在 ALFWorld 上大幅提升行动成功率,减少失败行动相关问题。

Comments 9 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31046 2026-07-01 cs.AI 新提交 92%

OpenLife: Toward Open-World Artificial Life with Autonomous LLM Agents

OpenLife:迈向基于自主LLM代理的开放世界人工生命

Atsushi Masumori, Itsuki Doi, Norihiro Maruyama, Ryosuke Takata, Takashi Ikegami

机构 * Alternative Machine Inc.(Alternative Machine公司) Their Inc.(Their公司) Atomi University(迹见学园女子大学) The University of Tokyo(东京大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出开放世界人工生命范式,通过将无状态LLM与异步进程(记忆、感知、评估、预算代谢)结合,使代理在开放世界中涌现自发活动、个体化、社会结构和自创收入。

Comments Accepted at ALIFE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23759 2026-06-24 cs.AR cs.AI cs.SE 新提交 92%

VeriPilot: An LLM-Powered Verilog Debugging Framework

VeriPilot:一个基于LLM的Verilog调试框架

Yihan Wang, Cheng Liu, Jiazheng Zhang, Lei Zhang, Long Cheng, Xiaowei Li, Huawei Li

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所国家专用集成电路设计实验室) University of Chinese Academy of Sciences(中国科学院大学) North China Electric Power University(华北电力大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出VeriPilot框架,利用黄金参考模型和LLM实现细粒度Verilog调试,通过内部变量语义对齐和CDFG信号追踪定位并修复错误,在CVDP基准上将GPT-4o修复成功率从54.3%提升至85.71%。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19149 2026-06-19 cs.CR cs.LG 新提交 92%

OpenAnt: LLM-Powered Vulnerability Discovery Through Code Decomposition, Adversarial Verification, and Dynamic Testing

OpenAnt:通过代码分解、对抗性验证和动态测试实现LLM驱动的漏洞发现

Nahum Korda, Gadi Evron

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出OpenAnt系统,结合静态分析与LLM推理,通过代码分解、对抗性验证和动态测试三阶段流水线,在降低误报率的同时发现未知漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08151 2026-06-16 cs.AI 新提交 92%

Decision-Aware Memory Cards: Counterfactual-Inspired Context Selection and Compression for Tool-Using LLM Agents

决策感知记忆卡:用于工具使用LLM智能体的反事实启发式上下文选择与压缩

Xinyu Guan, Qianyang Zhao, Yuming Deng

机构 * Alibaba Group(阿里巴巴集团)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出CICL决策感知上下文层,通过构建上下文图、评分单元效用并打包为记忆卡,提升工具使用LLM智能体在行动时的证据选择与压缩能力,在SWE-bench验证集上实现检索命中率提升。

Comments 15 pages, 2 figures, 8 tables. Code is available at https://github.com/stephen-guan-researcher/CICL; Qwen-QLoRA adapter is available at https://huggingface.co/XinyuGuan/CICL

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12311 2026-08-13 cs.SE 新提交 91%

The Role Specialization Model (RSM): Coordinating LLM-Based Tools in Agentic Software Development - An Exploratory Case Study

角色专业化模型(RSM):在智能体软件开发中协调基于大语言模型(LLM)的工具——一项探索性案例研究

Carlos Alberto Fernández-y-Fernández, Jorge R. Aguilar-Cisneros

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过探索性案例研究提出角色专业化模型(RSM),协调Antigravity、Gemini CLI等三种LLM工具开发Python气候可视化应用,发现明确角色协调可优化开发质量但需配套策略与人工验证。

Comments 28 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04020 2026-08-06 cs.CY cs.GT 新提交 91%

Artificial Institutions: How Institutional Design Shapes LLM Simulations

人工制度:制度设计如何塑造大语言模型(LLM)模拟

Maxim Chupilkin

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文研究LLM智能体构建的人工社会,通过控制变量实验发现,五种市场制度的规则差异会显著改变市场结果,证明制度架构对人工社会模拟的重要影响。

Comments 19 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28824 2026-08-03 cs.AR cs.DC cs.PF 新提交 91%

Characterizing LLM Kernel Access and Memory Interaction in Multi-Partition NUMA GPUs

表征多分区NUMA GPU中的LLM内核访问与内存交互

Donghyeon Joo, Sooraj Puthoor, Nuwan Jayasena, Bahar Asgari

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文针对多分区NUMA GPU中LLM内核访问与内存交互问题,通过分析三类LLM内核实现,提出内存追踪与周期级模拟方法,划分操作数共享模式并给出对应优化策略,强调需针对性内核编程与架构支持。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08162 2026-06-09 cs.MA 新提交 91%

Silent Failure in LLM Agent Systems: The Entropy Principle and the Inevitable Disorder of Autonomous Agents

LLM Agent系统中的静默故障:熵原理与自主智能体的不可避免的无序性

Dexing Liu

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 通过分析4万次受控试验和10万次生产交互,发现LLM agent系统存在无外部触发的静默故障,提出熵原理S(t)=S0*e^(αt)描述无序累积,并设计PIG引擎与ADE协议套件作为工程对策。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22556 2026-07-28 cs.AI 新提交 91%

MIITA: Memory-Induced Inference-Time Adaptation for Continual Learning with Small Language Models

MIITA:用于小语言模型持续学习的内存诱导推理时间自适应

Dong Li, Yanchi Liu, Xujiang Zhao, Wei Cheng, Zhengzhang Chen, Xintao Wu, Zhong Chen, Chen Zhao, Haifeng Chen

机构 * Baylor University(贝勒大学) NEC Laboratories America(美国 NEC 实验室) University of Arkansas(阿肯色大学) Southern Illinois University(南伊利诺伊大学)

专题命中 长上下文与记忆 :language model(title,abstract);small language model(title,abstract);LLM(abstract_cn);large language model(abstract)

AI总结 针对小语言模型持续学习中参数更新致灾难性遗忘及内存不足问题,提出MIITA框架,它通过存储校正方向原型并在推理时检索应用,结合理论分析,在多种设置实验中提升性能并减轻遗忘。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23459 2026-06-23 cs.CL 新提交 91%

TriggerBench: Investigating Prospective Memory for Large Language Models

TriggerBench: 探究大型语言模型的前瞻记忆

Tianhua Zhang, Xinjiang Wang, Qianxi Zhang, Qi Chen, Kun Li, Yaoqi Chen, Dingdong Wang, Helen Meng, Yan Lu

机构 * The Chinese University of Hong Kong(香港中文大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 提出TriggerBench基准,系统评估LLM的前瞻记忆能力,发现其存在精度-召回权衡、注意力脆弱性,且比回溯记忆更难,可作为推理能力的指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13591 2026-07-16 cs.CL cs.AI 新提交 91%

Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents

作为受控过程的记忆:为大语言模型智能体学习自适应内存管理

Eric Hanchen Jiang, Zhi Zhang, Yuchen Wu, Levina Li, Dong Liu, Xiao Liang, Rui Sun, Yubei Li, Edward Sun, Haozheng Luo, Zhaolu Kang, Aylin Caliskan, Kai-Wei Chang, Ying Nian Wu

机构 * University of California Los Angeles(加利福尼亚大学洛杉矶分校) University of Washington(华盛顿大学) Northwestern University(西北大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 研究LLM智能体内存管理问题,提出MemCon框架将内存操作建模为马尔可夫决策过程,通过在线策略自适应管理内存,该框架与后端无关,实验表明其在多基准测试中优于基线,提升任务成功率并减少令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15778 2026-06-16 cs.CL cs.AI cs.LG cs.SI 新提交 91%

DYNA : Dynamic Episodic Memory Networks for Augmenting Large Language Models with Temporal Knowledge Graphs in Continuous Learning

DYNA:用于在持续学习中通过时间知识图谱增强大语言模型的动态情景记忆网络

Ali Sarabadani, Mahtab Tajvidiyan

机构 * Department of Computer Engineering and Information Technology, University of Qom(卡姆大学计算机工程与信息科技系)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 提出DYNA框架,通过时间知识图谱作为外部可更新记忆,增强冻结的大语言模型,在三个时间召回任务上减少约7%的灾难性遗忘并提升约5%的时间排序能力。

详情

展开后加载摘要…

URL PDF HTML 收藏