arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-23 至 2026-03-23 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 7 篇

2603.19935 2026-03-23 cs.LG 85%

Memori: A Persistent Memory Layer for Efficient, Context-Aware LLM Agents

Memori:一种高效的、基于上下文的LLM代理持久内存层

Luiz C. Borro, Luiz A. B. Macarini, Gordon Tindall, Michael Montero, Adam B. Struck

机构 * Memori Labs Inc.(Memori实验室)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Memori通过结构化表示替代大上下文窗口,实现高效、低成本的LLM代理部署,准确率达81.95%。

Comments 9 pages; 2 figures; white paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19584 2026-03-23 cs.AI cs.SY eess.SY 85%

PowerLens: Taming LLM Agents for Safe and Personalized Mobile Power Management

PowerLens:利用大语言模型安全且个性化地管理移动设备电源

Xingyu Feng, Chang Sun, Yuzhu Wang, Zhangbing Zhou, Chengwen Luo, Zhuangzhuang Chen, Xiaomin Ouyang, Huanqi Yang

机构 * China University of Geosciences (Beijing)(中国地质大学(北京)) Shenzhen University(深圳大学) Hong Kong University of Science and Technology(香港科学与技术大学) City University of Hong Kong(香港城市大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PowerLens通过利用大语言模型的常识推理,实现安全且个性化的移动电源管理。系统通过用户活动与系统参数之间的语义桥梁,生成适应个人偏好的零样本策略,通过隐式反馈学习用户偏好,无需显式配置,3-5天内收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19469 2026-03-23 cs.CR cs.AI 79%

A Framework for Formalizing LLM Agent Security

一个形式化大语言模型代理安全性的框架

Vincent Siu, Jingxuan He, Kyle Montgomery, Zhun Wang, Neil Gong, Chenguang Wang, Dawn Song

机构 * UC Santa Cruz(加州大学圣克ruz分校) UC Berkeley(加州大学伯克利分校) Duke University(杜克大学)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出一个框架,从情境安全角度系统化现有攻击与防御,定义四个安全属性并引入Oracle函数验证,重新定义攻击和防御,为未来研究提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19272 2026-03-23 cs.CL cs.AI cs.CV cs.LG 75%

Transformers are Stateless Differentiable Neural Computers

Transformer 是无状态可微神经计算机

Bo Tang, Weiwei Xie

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Worcester Polytechnic Institute(沃斯特理工学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文证明因果Transformer层等同于无状态可微神经计算机(sDNC),并扩展到交叉注意力,为Transformer提供统一的记忆中心解释。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20105 2026-03-23 cs.LG cs.AI 73%

The $\mathbf{Y}$-Combinator for LLMs: Solving Long-Context Rot with $λ$-Calculus

LLMs的Y-组合子:解决长上下文旋转问题的λ演算

Amartya Roy, Rasul Tutunov, Xiaotong Ji, Matthieu Zimmer, Haitham Bou-Ammar

机构 * The School of Interdisciplinary Research(跨学科研究学院) Indian Institute of Technology (IIT) Delhi(印度理工学院德里分校) Robert Bosch GmbH, India(德国罗伯特·博世有限公司,印度) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Huawei Noah’s Ark UCL Centre for Artificial Intelligence(华为诺亚方舟大学伦敦人工智能中心)

专题命中 长上下文与记忆 :LLM(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出λ-RLM框架,通过类型化的功能运行时替代自由递归代码生成,提升长上下文推理的可靠性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19571 2026-03-23 cs.CV 67%

CurveStream: Boosting Streaming Video Understanding in MLLMs via Curvature-Aware Hierarchical Visual Memory Management

CurveStream: 通过曲率感知的层次视觉记忆管理提升MLLMs在流媒体视频理解中的性能

Chao Wang, Xudong Tan, Jianjian Cao, Kangcong Li, Tao Chen

机构 * College of Future Information Technology, Fudan University(未来信息科技学院,复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 CurveStream通过曲率感知的层次视觉记忆管理框架,在流媒体视频理解中实现显著性能提升,实验表明其在多个基准测试中均优于现有方法,达到新状态-of-the-art结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19481 2026-03-23 cs.CV 67%

Narrative Aligned Long Form Video Question Answering

叙事对齐的长视频问答

Rahul Jain, Keval Doshi, Burak Uzkent, Garin Kessler

机构 * Purdue University(普渡大学) Amazon(亚马逊)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文提出NA-VQA基准,评估长视频中的深度时间与叙事推理能力,通过88部完整电影和4.4K开放性问题测试模型整合分散叙事信息的能力,提出Video-NaRA框架提升远距离推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏