arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-31 至 2026-03-31 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 9 篇

2510.04618 2026-03-31 cs.LG cs.AI cs.CL 87%

Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models

代理情境工程:为自我改进语言模型演化情境

Qizheng Zhang, Changran Hu, Shubhangi Upasani, Boyuan Ma, Fenglu Hong, Vamsidhar Kamanuru, Jay Rainton, Chen Wu, Mengmeng Ji, Hanchen Li, Urmish Thakker, James Zou, Kunle Olukotun

机构 * Stanford University(斯坦福大学) SambaNova Systems, Inc.(SambaNova Systems公司) UC Berkeley(加州大学伯克利分校)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ACE框架,通过生成、反思和整理的模块化过程,使情境持续进化,提升语言模型在代理和领域推理中的性能,减少适应延迟和成本。

Comments ICLR 2026; 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27277 2026-03-31 cs.SE cs.AI cs.PL 85%

Codebase-Memory: Tree-Sitter-Based Knowledge Graphs for LLM Code Exploration via MCP

基于MCP的代码库记忆:通过Tree-Sitter构建的知识图谱用于LLM代码探索

Martin Vogel, Falk Meyer-Eschenbach, Severin Kohler, Elias Grünewald, Felix Balzer

机构 * Independent Researcher, Berlin, Germany(独立研究者,柏林,德国) Institute of Medical Informatics, Charité – Universitätsmedizin Berlin, Berlin, Germany(柏林夏里特医学院医学信息学研究所,柏林,德国) Clinical Study Center, Berlin Institute of Health, Berlin, Germany(柏林健康研究所临床研究中心,柏林,德国) Institute of Informatics, Humboldt University, Berlin, Germany(柏林洪堡大学信息学研究所,柏林,德国) Institute of Informatics, Freie Universität Berlin, Berlin, Germany(柏林自由大学信息学研究所,柏林,德国) Health Data Science Unit, University Hospital Heidelberg, Heidelberg, Germany(海德堡大学医院健康数据科学部,海德堡,德国)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Codebase-Memory通过MCP协议构建Tree-Sitter知识图谱,提升LLM代码探索效率,实现更高准确性与更低资源消耗。

Comments 10 pages, 5 authors, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28686 2026-03-31 cs.SE 85%

C2RustXW: Program-Structure-Aware C-to-Rust Translation via Program Analysis and LLM

C2RustXW: 通过程序分析和LLM实现的程序结构感知的C到Rust翻译

Yanyan Yan, Yang Feng, Jiangshan Liu, Di Liu, Zixi Liu, Hao Teng, Baowen Xu

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出C2RustXW工具,通过程序分析与LLM结合,实现结构感知的C到Rust翻译,提高代码正确性和可维护性,实验显示在CodeNet和GitHub上达到高语法正确率和代码压缩效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24257 2026-03-31 cs.CV 82%

Memory-Augmented Vision-Language Agents for Persistent and Semantically Consistent Object Captioning

具有记忆增强的视觉-语言代理用于持久且语义一致的对象描述

Tommaso Galliena, Stefano Rosa, Tommaso Apicella, Pietro Morerio, Alessio Del Bue, Lorenzo Natale

机构 * Italian Institute of Technology, Genoa, Italy(意大利理工学院,热那亚,意大利) University of Genoa, Genoa, Italy(热那亚大学,热那亚,意大利)

专题命中 长上下文与记忆 :language agent(title,abstract);language model(abstract)

AI总结 本文提出一种统一的记忆增强视觉-语言代理,通过单一自回归框架同时处理数据关联、对象描述和探索策略,提升持久且语义一致的对象描述能力。

Comments 24 pages, 7 figures, 7 tables (including Supplementary Materials)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26707 2026-03-31 cs.CL cs.AI cs.CY cs.HC q-bio.NC 79%

The Cognitive Divergence: AI Context Windows, Human Attention Decline, and the Delegation Feedback Loop

认知分歧:人工智能上下文窗口、人类注意力下降与委托反馈循环

Netanel Eliav

机构 * Machine Human Intelligence Lab (MHIL)(机器人类智能实验室 (MHIL))

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了人工智能上下文窗口扩展与人类持续注意力能力下降之间的自我强化动态,提出认知分歧概念,并探讨委托反馈循环对人类认知能力的影响。

Comments 28 pages, 1 figure, 5 tables. Preprint, not peer reviewed

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22751 2026-03-31 cs.CR 78%

Observable Channels, Not Just Storage: Evaluating Privacy Leakage in LLM Agent Pipelines

可观察通道而非仅存储:评估LLM代理流水线中的隐私泄露

Tao Huang, Chen Hou, Guosen Wu, Jiayang Meng

专题命中 长上下文与记忆 :LLM(title,abstract)

AI总结 本文提出CIPL框架,通过统一的通道导向接口评估LLM代理流水线中的隐私泄露,揭示内存、检索和工具中介目标的泄露特性,强调通道条件而非单一攻击方法的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27490 2026-03-31 cs.CL cs.AI cs.MA 73%

AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents

AgentSwing: 面向长时域网络代理的自适应并行上下文管理路由

Zhaopeng Feng, Liangcai Su, Zhen Zhang, Xinyu Wang, Xiaotian Zhang, Xiaobin Wang, Runnan Fang, Qi Zhang, Baixuan Li, Shihao Cai, Rui Ye, Hui Chen, Jiang Yong, Joey Tianyi Zhou, Chenxiong Qian, Pengjun Xie, Bryan Hooi, Zuozhu Liu, Jingren Zhou

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出AgentSwing框架,通过搜索效率与终端精度两个维度优化长时域网络代理的上下文管理,实验证明其在交互次数更少的情况下性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28696 2026-03-31 cs.CV cs.AI 70%

AdaptToken: Entropy-based Adaptive Token Selection for MLLM Long Video Understanding

AdaptToken: 基于熵的自适应令牌选择用于多模态大语言模型长视频理解

Haozhe Qi, Kevin Qu, Mahdi Rad, Rui Wang, Alexander Mathis, Marc Pollefeys

机构 * Microsoft Spatial AI Lab(微软空间人工智能实验室) EPFL(瑞士联邦理工学院洛桑) ETH Zurich(苏黎世联邦理工学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AdaptToken通过利用模型自不确定性实现全局控制信号,提升多模态大语言模型对长视频的理解能力,通过熵信号分配令牌预算并支持提前停止,提升准确率并减少推理时间。

Comments Project page: https://haozheqi.github.io/adapt-token

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04427 2026-03-31 cs.LG cs.AI 62%

Thin Keys, Full Values: Reducing KV Cache via Low-Dimensional Attention Selection

细键,全值:通过低维注意力选择减少KV缓存

Hengshuai Yao, Xing Chen, Ahmed Murtadha, Guan Wang

机构 * Sapient Intelligence Department of Computing Science, University of Alberta(阿尔伯塔大学计算机科学系)

专题命中 长上下文与记忆 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过低维注意力选择减少KV缓存,展示选择仅需O(logN)维度即可区分N个相关token类别,相比传统Transformer注意力节省参数和训练时间。

详情

展开后加载摘要…

URL PDF HTML 收藏