arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-24 至 2026-04-24 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 12 篇

2604.21083 2026-04-24 cs.CR cs.AI cs.NI cs.SE 92%

Behavioral Consistency and Transparency Analysis on Large Language Model API Gateways

大型语言模型API网关的行为一致性与透明度分析

Guanjie Lin, Yinxin Wan, Shichao Pei, Ting Xu, Kuai Xu, Guoliang Xue

机构 * University of Massachusetts Boston(马萨诸塞大学波士顿分校) Arizona State University(亚利桑那州立大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出GateScope框架,用于评估LLM网关的行为一致性和操作透明度,发现多个网关存在模型降级、响应不一致、计费不准确等问题。

Comments 11 pages. Initially submitted to IMC 2026 Cycle 1 on November 20, 2025; accepted on March 13, 2026. To appear in Proceedings of the 2026 ACM Internet Measurement Conference (IMC '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21284 2026-04-24 cs.AI cs.CL cs.IR 92%

Spatial Metaphors for LLM Memory: A Critical Analysis of the MemPalace Architecture

基于LLM记忆的空间隐喻:MemPalace架构的批判性分析

Robin Dey, Panyanon Viradecha

机构 * OpenHub Research(开放枢纽研究)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 MemPalace通过空间隐喻组织大语言模型的长期记忆,其高召回率源于直接存储哲学与ChromaDB嵌入模型的结合,而非空间结构本身,同时提出了低唤醒成本和零LLM写入路径等创新。

Comments 20 pages, 10 tables. Code and data at https://github.com/web3guru888/mempalace-scientific-analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10708 2026-04-24 cs.CR cs.SE 91%

SafeTrans: LLM-assisted Transpilation from C to Rust

SafeTrans: 借助LLM从C到Rust的转换

Muhammad Farrukh, Baris Coskun, Tapti Palit, Michalis Polychronakis

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出SafeTrans框架,利用LLM自动将C代码转换为Rust代码并修复错误,通过引导修复技术提升转换成功率,并评估转换过程中的安全影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20943 2026-04-24 cs.LG 90%

SCM: Sleep-Consolidated Memory with Algorithmic Forgetting for Large Language Models

SCM:基于算法遗忘的睡眠巩固记忆用于大语言模型

Saish Sachin Shinde

机构 * Clyrai IP Studio(Clyrai IP实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.LG

AI总结 SCM通过引入睡眠巩固机制和算法遗忘,解决大语言模型缺乏持久、结构化和生物合理记忆的问题,实现高效记忆管理和检索。

Comments 5 figures. Submitted April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20911 2026-04-24 cs.CR cs.AI 90%

Omission Constraints Decay While Commission Constraints Persist in Long-Context LLM Agents

在长上下文LLM代理中,遗漏约束衰减而执行约束持续存在

Yeran Gamage

机构 * University of South Florida(佛罗里达州立大学) Independent AI Security Researcher(独立人工智能安全研究员)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 研究发现,在长上下文LLM代理中,遗漏约束随上下文压力衰减,而执行约束持续存在,这种不对称性称为安全回忆分歧(SRD)。

Comments 19 pages, 5 figures. Includes evaluation framework for replication and 4,416-trial dataset

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20948 2026-04-24 cs.HC 89%

Can Virtual Agents Care? Designing an Empathetic and Personalized LLM-Driven Conversational Agent

虚拟代理能关心吗?设计一个具有同理心和个性化的LLM驱动对话代理

Truong Le Minh Toan, Dieu Bang Mach, Tan Duy Le, Nguyen Tan Viet Tuyen

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种框架,通过检索增强架构、结构化记忆和多模态交互,设计出具有同理心和个性化支持的虚拟代理,以提升心理健康支持的质量和可靠性。

Comments Accepted manuscript version to be presented at the SCI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20915 2026-04-24 cs.LG cs.AI cs.CL cs.SE math.OC 88%

Absorber LLM: Harnessing Causal Synchronization for Test-Time Training

吸收式大语言模型:利用因果同步进行测试时训练

Zhixin Zhang, Shabo Zhang, Chengcan Wu, Zeming Wei, Meng Sun

机构 * Peking University(北京大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Absorber LLM,通过自监督因果同步解决长上下文保留问题,优化模型在测试时的内存和准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21229 2026-04-24 cs.CL cs.AI 79%

EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval

EngramaBench:基于结构化图检索评估长期对话记忆

Julian Acuna

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出EngramaBench基准测试,评估长期对话记忆系统在事实回忆、跨空间整合等任务中的表现,对比Engrama与GPT-4o和Mem0的性能差异。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20487 2026-04-24 cs.CL cs.AI 73%

Knowledge Capsules: Structured Nonparametric Memory Units for LLMs

知识胶囊:用于大语言模型的结构非参数记忆单元

Bin Ju, Shenfeng Weng, Danying Zhou, Rongkai Xu, Kunkai Su

机构 * Zhejiang Angel Medical AI Technology Co., Ltd.(浙江天使医疗人工智能科技有限公司) Miti AI Technology Co., Ltd.(米蒂人工智能科技有限公司) China-Singapore Belt and Road Joint Laboratory on Translational Infection Biology for Diagnostics and Therapies(中英一带一路联合实验室(转化感染生物学诊断与治疗)) State Key Laboratory for Diagnosis and Treatment of Infectious Diseases(传染病诊断与治疗国家重点实验室) The First Affiliated Hospital(第一附属医院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出知识胶囊,一种结构化的非参数记忆单元,通过冻结基础模型直接从文档语料构建,采用外部键值注入框架提升外部知识在注意力计算中的参与度,提升长上下文和多跳推理的稳定性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20874 2026-04-24 cs.CC cs.CL cs.HC cs.IT math.IT 70%

The Root Theorem of Context Engineering

上下文工程的根定理

Borja Odriozola Schick

机构 * Independent Researcher(独立研究者)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出上下文工程的根定理,通过形式化约束推导出信号-token比最大化原则,揭示了连续对话系统中信息质量退化与上下文窗口限制的本质规律。

Comments 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20300 2026-04-24 cs.AI 70%

FSFM: A Biologically-Inspired Framework for Selective Forgetting of Agent Memory

FSFM:一种生物启发的智能体记忆选择性遗忘框架

Yingjie Gu, Wenjian Xiong, Liqiang Wang, Pengcheng Ren, Chao Li, Xiaojing Zhang, Yijuan Guo, Qi Sun, Jingyao Ma, Shidang Shi

机构 * China Mobile Digital Intelligence Business Unit(中国移动数字智能业务部) China Mobile Jiutian Company(中国移动蓟田公司) China Mobile Jiutian Research Institute(中国移动蓟田研究院)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出FSFM框架,通过生物启发机制实现智能体记忆的选择性遗忘,提升效率、质量和安全性,经实验验证在访问效率、内容质量和安全性能上均有显著提升。

Comments 28 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21100 2026-04-24 cs.LG 57%

Preconditioned DeltaNet: Curvature-aware Sequence Modeling for Linear Recurrences

预条件DeltaNet:用于线性递归的曲率感知序列建模

Neehal Tumma, Noel Loo, Daniela Rus

机构 * MIT(麻省理工学院)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.LG

AI总结 本文提出预条件DeltaNet,通过引入预条件技术改进线性递归模型,提升序列建模性能,在合成回忆基准和大规模语言模型中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏