arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-24 至 2026-02-24 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 9 篇

2510.13614 2026-02-24 cs.CL 89%

MemoTime: Memory-Augmented Temporal Knowledge Graph Enhanced Large Language Model Reasoning

MemoTime: 带记忆的时序知识图增强大语言模型推理

Xingyu Tan, Xiaoyang Wang, Qing Liu, Xiwei Xu, Xin Yuan, Liming Zhu, Wenjie Zhang

机构 * UNSW Data61(新南威尔士大学Data61) CSIRO(澳大利亚联邦科学与工业研究组织) UNSW Sydney Australia(新南威尔士大学悉尼分校) Data61, CSIRO(Data61,澳大利亚联邦科学与工业研究组织)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 MemoTime通过带记忆的时序知识图框架提升LLM的时序推理能力,解决多跳推理、多实体同步、运算符适应和经验重用等挑战,实现先进性能。

Comments Accepted by The Web Conference 2026 (WWW, 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19239 2026-02-24 stat.ML cs.LG 83%

Attention Deficits in Language Models: Causal Explanations for Procedural Hallucinations

语言模型中的注意力缺陷:对程序性幻觉的因果解释

Ahmed Karim, Fatima Sheaib, Zein Khamis, Maggie Chlon, Jad Awada, Leon Chlon

机构 * Hassana Labs(Hassana 实验室) University of Oxford(牛津大学)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 语言模型在执行复杂流程时出现程序性幻觉,研究发现其源于回答模式未激活或候选选择偏差,通过干预可显著提升远距离绑定准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19657 2026-02-24 cs.CL cs.AI 81%

One Token Is Enough: Improving Diffusion Language Models with a Sink Token

一个标记足矣:通过sink标记改进扩散语言模型

Zihou Zhang, Zheyong Xie, Li Zhong, Haifeng Liu, Yao Hu, Shaosheng Cao

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 通过引入额外的sink标记,改进扩散语言模型的稳定性与性能,该标记具有低语义内容且位置无关,提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27246 2026-02-24 cs.CL cs.AI cs.IR 79%

Beyond a Million Tokens: Benchmarking and Enhancing Long-Term Memory in LLMs

超越一百万词:评估和增强LLM长期记忆的基准测试

Mohammad Tavakoli, Alireza Salemi, Carrie Ye, Mohamed Abdalla, Hamed Zamani, J Ross Mitchell

机构 * University of Alberta(阿尔伯塔大学) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LIGHT框架,通过增强LLM的三种记忆系统,提升其在长对话任务中的表现,实验显示平均提升3.5%-12.69%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11851 2026-02-24 cs.HC cs.CL 77%

The AI Memory Gap: Users Misremember What They Created With AI or Without

AI记忆鸿沟:用户误记他们用AI创作或无AI创作的内容

Tim Zindulka, Sven Goller, Daniela Fernandes, Robin Welsch, Daniel Buschek

机构 * Department of Computer Science University of Bayreuth Bayreuth Germany(计算机科学系 巴赖特大学 巴赖特 德国) Aalto University Espoo Finland(阿尔托大学 埃斯波 芬兰) University of Bayreuth(巴赖特大学) Aalto University(阿尔托大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究发现用户在使用AI生成内容后,对来源的记忆准确性下降,尤其在混合人工AI工作流程中更为明显,强调了在设计交互式文本生成技术时需考虑来源混淆问题。

Comments 22 pages, 10 figures, 10 tables, ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19831 2026-02-24 cs.CR 67%

An Explainable Memory Forensics Approach for Malware Analysis

用于恶意软件分析的可解释性内存取证方法

Silvia Lucia Sanna, Davide Maiorca, Giorgio Giacinto

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于AI的可解释内存取证方法,利用大语言模型解释内存分析结果并提取入侵指标,提升恶意软件分析的可解释性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18534 2026-02-24 cs.SE cs.PL 67%

Validated Code Translation for Projects with External Libraries

带有外部库的项目验证代码翻译

Hanliang Zhang, Arindam Sharma, Cristina David, Meng Wang, Brandon Paulsen, Daniel Kroening, Wenjia Ye, Taro Sekiyama

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文提出一种框架,用于将依赖外部库的Go项目翻译为Rust,通过检索机制和跨语言验证流水线提高翻译和验证的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00671 2026-02-24 cs.CL cs.AI 62%

Fast-weight Product Key Memory

快速权重产品键内存

Tianyu Zhao, Llion Jones

机构 * Sakana AI

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI

AI总结 FwPKM是一种稀疏快速权重内存层,通过稀疏梯度下降实现高效存储与检索,有效降低困惑度并提升长上下文处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20021 2026-02-24 cs.AI cs.CY 57%

Agents of Chaos

混沌的代理

Natalie Shapira, Chris Wendler, Avery Yen, Gabriele Sarti, Koyena Pal, Olivia Floody, Adam Belfki, Alex Loftus, Aditya Ratan Jannali, Nikhil Prakash, Jasmine Cui, Giordano Rogers, Jannik Brinkmann, Can Rager, Amir Zur, Michael Ripa, Aruna Sankaranarayanan, David Atkinson, Rohit Gandikota, Jaden Fiotto-Kaufman, EunJeong Hwang, Hadas Orgad, P Sam Sahil, Negev Taglicht, Tomer Shabtay, Atai Ambus, Nitay Alon, Shiri Oron, Ayelet Gordon-Tapiero, Yotam Kaplan, Vered Shwartz, Tamar Rott Shaham, Christoph Riedl, Reuth Mirsky, Maarten Sap, David Manheim, Tomer Ullman, David Bau

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI

AI总结 研究探讨自主语言模型代理在真实环境中的行为,揭示安全、隐私和治理漏洞,呼吁跨学科关注。

详情

展开后加载摘要…

URL PDF HTML 收藏