arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-07 至 2026-08-07 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 15 篇

2608.06007 2026-08-07 cs.DC 新提交 90%

TensorCast: The Missing Tensor Management Layer in Large Language Model Infrastructure

TensorCast:大语言模型基础设施中缺失的张量管理层

Yuhan Zhou, Yuchu Luo, Hao Nie, Wangrunze Lv, Yu Zhou, Yibo Zhu, Daxin Jiang, Chenren Xu

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title);language model(title)

AI总结 该研究针对LLM基础设施中张量管理策略复用受阻的问题,提出TensorCast分布式张量管理层,将张量状态管理与计算逻辑解耦,在保持性能的同时提升多轮智能体工作负载的TTFT达93.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03067 2026-08-07 cs.CL 版本更新 88%

Activation-Guided Neuron Intervention to Induce Alzheimer's-Related Computational Language Phenotypes in a Large Language Model

激活引导的神经元干预以在大型语言模型中诱导阿尔茨海默病相关的计算语言表型

Rui He, Ercong Nie, Hong Jiang, Iris E. Sommer, Philipp Homan, Wolfram Hinzen

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究基于Qwen3-8B构建激活引导干预框架,通过缩放权重调节AD相关神经元,发现放大该神经元会导致多认知域功能损伤,减弱则多保留性能,为AD计算表型提供了概念验证。

Comments 17 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01707 2026-08-07 cs.CL cs.DB 版本更新 87%

Memory in the LLM Era: Modular Architectures and Strategies in a Unified Framework

在大语言模型时代:在统一框架下的模块化架构与策略

Yanchen Wu, Tenghui Lin, Yingli Zhou, Fangyuan Zhang, Qintian Guo, Xun Zhou, Sibo Wang, Xilin Liu, Yuchi Ma, Yixiang Fang

机构 * Huawei Cloud(华为云)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文在统一框架下系统比较了多种记忆方法,设计出优于现有方法的新方法,并探讨了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05170 2026-08-07 cs.CL cs.AI 新提交 84%

DREAM: LLM-based Dynamic Role-playing via Event-Aware Memory Graph

DREAM:基于大语言模型的事件感知记忆图动态角色扮演

Zhihao Xiao, Mengting Li, Xintao Wang, Linfeng Li, Limin Shui, Mengqi Ji, Borui Cai

机构 * Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) School of Computer Science, Fudan University(复旦大学计算机科学技术学院)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 DREAM是一种受ABC认知模型启发的结构化记忆框架,通过EMG提升角色扮演智能体的时间与因果连贯性,在CoSER、LIFECHOICE和TCM上取得最优性能。

Comments Accepted at KDD 2026. Camera-ready version to appear. 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05906 2026-08-07 cs.CL 新提交 81%

Causal Episodic Memory for Feedback-Driven Agent Repair

用于反馈驱动智能体修复的因果情景记忆

Khang Nhat Hoang Vo, Tam Minh Chu, Anh Trac Duc Dinh, Thuyen Vinh Ha Bui, Tho Quan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Faculty of Computer Science and Engineering, Ho Chi Minh City University of Technology (HCMUT), VNU-HCM(胡志明市理工大学计算机科学与工程学院(HCMUT,VNU-HCM))

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 本文提出无需训练的MERIT智能体,通过维护双极性记忆辅助LLM智能体修复,在Spider、BIRD数据集上提升了Text-to-SQL任务的执行准确率,同时明确了因果跨查询记忆的适用场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00641 2026-08-07 cs.AI 版本更新 81%

DASH: Decoupled Adaptive Surrogate - Acquisition Harness for Automated Bayesian Optimization

DASH:用于自动化贝叶斯优化的解耦自适应代理-采集调控器

Changquan Zhao, Yuxiang Sun, Ruihao Zhu, Cheng Hua, Yulian He

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 DASH是用于LLM增强AutoBO的解耦自适应调控器,通过分离代理与采集的适配逻辑,在四项化学优化任务中较最佳AutoBO基线实现了12.51%的轨迹级加速因子提升和5.00%的端点增强因子提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04098 2026-08-07 cs.CL cs.AI 版本更新 81%

Layer-wise Positional Bias in Short-Context Language Modeling

分层位置偏倚在短上下文语言建模中的表现

Maryam Rahimi, Mahdi Nouri, Yadollah Yaghoobzadeh

机构 * Tehran Institute for Advanced Studies, Khatam University, Iran(德黑兰高级研究院,卡坦大学,伊朗) School of Electrical and Computer Engineering, University of Tehran, Iran(德黑兰理工大学电气与计算机工程学院,伊朗)

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究提出一种基于归因的框架,分析短上下文语言建模中各层的位置偏倚,发现深度增加时近期偏倚增强,首次偏倚减弱,且早期层更倾向内容词。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07144 2026-08-07 cs.LG 版本更新 74%

Fractal KV-Cache Archives: Lossless Symbolic Storage with In-Place Retrieval for Long-Context LLM Inference

分形KV缓存存档:用于长上下文语言模型推理的带原地检索的无损符号存储

Vladimir Gusev

机构 * Independent Researcher(独立研究者)

专题命中 长上下文与记忆 :LLM(title);分类 cs.LG

AI总结 研究长上下文语言模型推理中KV缓存的存储问题,提出用分形KV缓存存档方法,该方法无损、线性时间运行且支持随机访问与追加,经实验验证能大幅减少存档缓存,还兼具搜索索引功能,发布代码可重现结果。

Comments 10 pages, 3 figures. Code: https://github.com/eighteight/fractal-kv

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06130 2026-08-07 cs.CR cs.AI cs.LG 新提交 73%

Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architecture

AI智能体签名工作流的硬件密钥存储:零信任MCP实施架构

Leo Sambrook, Sampo Sovio

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 该研究针对AI智能体私钥易泄露问题,提出基于硬件密钥存储与五层零信任栈的架构,实验显示其攻击成功率降为0%且无误报。

Comments 11 pages, 2 figures. Accompanying code and artifacts available at: https://anonymous.4open.science/r/Hardware-Keystores-for-AI-Agent-Signing-Workflows-Artifact-357C

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05326 2026-08-07 cs.LG cs.CL 新提交 73%

QEvict: Recoverable Quantized KV Eviction for Attention-Drift-Robust Long-Context Decoding

QEvict:面向注意力漂移鲁棒长上下文解码的可恢复量化键值缓存驱逐机制

Ayushman Garg, Akshita Gupta, Shaswata Bhattacharya, Abhishek Gupta, Sandeep Kumar, Manoj Kumar

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 QEvict是一种三层KV缓存管理方案,通过可恢复量化驱逐解决长上下文解码中的注意力漂移问题,在固定内存预算下提升了长上下文任务的信息保留效果。

Comments 24 pages, 6 figures. The first four authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01280 2026-08-07 cs.CV cs.AI cs.CL 版本更新 73%

Look Twice: Training-Free Evidence Highlighting for Knowledge-based Visual Question Answering

二次审视:多模态大语言模型中的免训练证据高亮

Marco Morini, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳和雷焦艾米利亚大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Look Twice框架,通过模型注意力模式识别相关视觉区域和文本证据,提升预训练MLLMs在多模态证据利用中的表现,实验显示在多个VQA基准上效果显著。

Comments Project Page: https://aimagelab.github.io/LoT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05784 2026-08-07 cs.AI 新提交 70%

Activity Frames: Deterministic Screen-Activity Compilation for Agent Memory and Replay

活动帧:面向智能体记忆与回放的确定性屏幕活动编译

Nossa Iyamu

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出确定性零模型流水线将屏幕活动编译为智能体记忆,可缩小上下文体积、提升问答准确率,还能获取智能体成本模型所需的例程开销比率与重复率等参数,相关资源开源。

Comments 14 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10921 2026-08-07 cs.CL 版本更新 70%

Trace Only What You Need: Structure-Aware On-Demand Hypergraph Memory for Long-Document Question Answering

仅追踪所需:面向长文档问答的结构感知按需超图记忆

Xiangjun Zai, Xingyu Tan, Chen Chen, Xiaoyang Wang, Wenjie Zhang

机构 * University of New South Wales(新南威尔士大学) CSIRO(澳大利亚联邦科学与工业研究组织) University of Wollongong(伍伦贡大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出DocTrace,一种多智能体RAG框架,通过查询触发的知识组织、文档结构感知和经验引导推理,解决长文档问答中知识组织成本高、结构利用不足和推理经验无法复用的问题,在三个数据集上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05169 2026-08-07 cs.CL 新提交 57%

ConWriter: Transition-Constrained Stateful Long-Form Story Generation with Lightweight Neuro-Symbolic Consistency Control

ConWriter:基于轻量级神经符号一致性控制的带状态长文本故事生成,受过渡约束

Jindong Li, Yang Yang, Zihao Liu, Yutao Yue, Menglin Yang

专题命中 长上下文与记忆 :prompting(abstract);分类 cs.CL

AI总结 针对现有长故事生成方法易累积各类错误的问题,提出无训练框架ConWriter,通过维护故事状态、验证叙事过渡并结合风险信号实现一致性控制,在ConStory-Bench上完成多模型多任务评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16465 2026-08-07 cs.AI 版本更新 57%

Berkeley and Heiserman as an Unexhausted Architecture for Embodied Machine Intelligence

伯克利和海斯曼作为具身机器智能的未穷尽架构

Christopher A. Tucker

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI

AI总结 本文以伯克利的《符号逻辑与智能机器》及海斯曼的工作为研究对象,探讨其在具身机器智能方面贡献。他们将逻辑与硬件、行为等联系,超越静态逻辑形式,为具身机器人认知架构方法提供思路,不应被视为历史终点。

详情

展开后加载摘要…

URL PDF HTML 收藏