arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-03 至 2026-08-03 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 18 篇

2606.05976 2026-08-03 cs.AI cs.CL 版本更新 93%

The Self-Correction Illusion: Role Relabeling Gates Explicit Error Flagging in Large Language Models

自我修正错觉:LLM 纠正他人但不纠正自己

Kuan-Yen Chen, Fang-Yi Su, Shih-Yen Lin, Bao Li, Jung-Hsien Chiang

机构 * National Taiwan University(国立台湾大学)

专题命中 长上下文与记忆 :LLM(title_cn,summary_cn);large language model(title);language model(title);instruction tuning(abstract)

AI总结 本文通过保持错误声明字节一致仅改变角色标签,发现 LLM 无法自我修正并非能力缺陷,而是聊天模板角色标签的人为产物,并提出无需训练或模型修改的提示结构干预方法。

Comments 15 pages, 3 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29032 2026-08-03 cs.MA cs.CL 新提交 92%

TransMem: Transforming Hidden States into Memory for Large Language Models

TransMem:将隐藏状态转换为大语言模型的记忆

Haodong Lei, Junming Liu, Yirong Chen, Pinlong Cai, Botian Shi, Ding Wang, Hongsong Wang

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 针对长上下文LLM智能体的历史信息未充分利用问题,提出轻量级记忆模块TransMem,结合证据条件自蒸馏,在多基准测试中显著提升性能。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28979 2026-08-03 cs.CL 新提交 92%

Mixture-of-Translators: Translating KV Caches Across Heterogeneous Large Language Models

混合翻译器:跨异构大语言模型的KV缓存转换

Jin-woo Lee, Minkyung Song, Junghyun Oh, Seunghoon Han, Soyoung Park, Gwangseon Jang, Sungsu Lim

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 提出MoT框架解决异构LLM间KV缓存无法复用问题,通过多翻译器模块和上下文校正损失实现缓存转换,在多模型转换和实际场景中验证了性能与复用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28824 2026-08-03 cs.AR cs.DC cs.PF 新提交 91%

Characterizing LLM Kernel Access and Memory Interaction in Multi-Partition NUMA GPUs

表征多分区NUMA GPU中的LLM内核访问与内存交互

Donghyeon Joo, Sooraj Puthoor, Nuwan Jayasena, Bahar Asgari

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文针对多分区NUMA GPU中LLM内核访问与内存交互问题,通过分析三类LLM内核实现,提出内存追踪与周期级模拟方法,划分操作数共享模式并给出对应优化策略,强调需针对性内核编程与架构支持。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29433 2026-08-03 cs.CL 新提交 90%

Know It, Act on It: Investigating Memory Utilization in LLM Personalization

了解它,执行它:研究大语言模型个性化中的记忆利用

Zhaoxin Feng, Jianfei Ma, Emmanuele Chersoni

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究针对LLM个性化中记忆利用的问题,提出解耦评估范式,发现智能体常能回忆用户偏好却未在行为中体现,健康相关偏好的利用薄弱且风险最高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29167 2026-08-03 cs.CR cs.AI 新提交 90%

Memory Provenance Laundering in LLM Agents: A Non-Amplification Firewall for Persistent Memory

大语言模型智能体中的内存来源洗白:用于持久内存的非放大防火墙

Jinghan Xu, Yiyong Xiao, Wanru Shao, Hankai Liu, Xinjin Li

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对LLM智能体内存来源洗白的安全问题,提出PPMF防火墙,通过匹配行动风险与记忆权限,成功阻止高风险未授权行动,保障智能体内存安全。

Comments EMNLP2026 submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30005 2026-08-03 cs.CL 版本更新 89%

LLM Agents Are Latent Context Managers: Eliciting Self-Managed Context via State Proprioception

LLM 智能体是潜在上下文管理者:通过本体感觉仪表盘引发自我管理上下文

Binyan Xu, Haitao Li, Kehuan Zhang

机构 * Tencent(腾讯)

专题命中 长上下文与记忆 :LLM(title,title_cn);language model(abstract);分类 cs.CL

AI总结 提出 VISTA 框架,通过为 LLM 智能体提供上下文状态仪表盘(令牌使用量、时效性、访问历史),无需训练即可实现自我上下文管理,在多个基准上显著提升性能。

Comments 27 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29377 2026-08-03 cs.CL 新提交 87%

Zero-Mem: Zero-Token Memory Operations for LLM Agents

Zero-Mem:面向大语言模型智能体的零令牌内存操作

Yilin Xiao, Zhehan Zhu, Yujing Zhang, Jin Chen, Zijin Hong, Luyao Zhuang, Qinggang Zhang, Shengyuan Chen, Xiaocao Ouyang, Lingfei Ren, Xiao Huang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL

AI总结 Zero-Mem提出零令牌内存操作,以原始交互轨迹为记录来源,通过实体-上下文图与时间层次结构组织信息,仅在最终问答时调用LLM,在长记忆问答基准中实现性能与效率的平衡,降低内存操作时间成本57.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29076 2026-08-03 cs.AR 新提交 87%

Selective KV Cache Protection for Noise-Resilient LLM Inference on Analog Compute-In-Memory Systems

面向模拟存算一体系统上抗噪声大语言模型推理的选择性键值缓存保护

Yuannuo Feng, Wenyong Zhou, Yuang Ma, Yizhe Chen, Wenshuai Yao, Yuxin Xie, Ngai Wong, Wang Kang

专题命中 长上下文与记忆 :LLM(title,summary_cn)

AI总结 针对模拟存算一体系统上LLM推理的KV缓存易受硬件噪声影响的问题,本文首次开展相关系统研究,提出分层token保护策略,大幅降低噪声下的困惑度并提升编程行利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29279 2026-08-03 cs.SD 新提交 82%

ParaASR: Multi-Token Prediction for Fast and Long-Context LLM-Based Speech Recognition

ParaASR:面向快速长上下文基于大语言模型的语音识别的多令牌预测

Qingjian Lin, Yuxin Li, Haoyang Zhang, Jun Chen, Yechang Huang, Feng Tian, Xie Li, Xiangyu Tony Zhang, Daijiao Liu, Yuxin Zhang, Jinglan Gong, Bo Zhao, Fei Tian, Xuerui Yang, Gang Yu, Xiangyu Zhang, Daxin Jiang

机构 * StepFun(阶跃星辰) NTU(南洋理工大学) PKU(北京大学) UNSW(新南威尔士大学) SJTU(上海交通大学) USTC(中国科学技术大学)

专题命中 长上下文与记忆 :LLM(title,abstract);language model(abstract)

AI总结 ParaASR是一款基于大语言模型的ASR系统,通过多令牌预测技术,在保持低错误率、低延迟的同时,支持32K长上下文及30分钟音频的快速转录,兼顾识别质量、速度与上下文长度。

Comments 14 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29422 2026-08-03 cs.SE cs.AI cs.CR 新提交 81%

AgenticRepair: Multi-Faceted Program Context Engineering for Agentic Vulnerability Repair

AgenticRepair:面向智能体漏洞修复的多维度程序上下文工程

Michael Fu, Qiyue Mei, Patanamon Thongtanunam, Kla Tantithamthavorn

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对现有智能体漏洞修复方法缺乏多维度程序上下文工程的问题,提出AgenticRepair框架,协调三个LLM子智能体构建三类上下文,在SEC-Bench上取得73%的修复成功率,显著优于基线。

Comments Under Review at IEEE TSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23986 2026-08-03 cs.DB cs.AI cs.MA 版本更新 81%

MemForest: An Efficient Agent Memory System with Hierarchical Temporal Indexing

MemForest: 一种具有层次化时间索引的高效智能体记忆系统

Han Chen, Zining Zhang, Wenqi Pei, Bingsheng He, Ming Wu, Jason Zeng, Michael Heinrich, Wei Wu, Hongbao Zhang

机构 * National University of Singapore(新加坡国立大学) Zero Gravity Labs(零重力实验室)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对长上下文LLM智能体记忆系统中粗粒度状态管理和顺序更新导致的维护开销问题,提出MemForest框架,通过并行块提取和层次化时间索引树MemTree实现高效写入和局部更新,在LongMemEval-S上达到79.8% pass@1准确率,吞吐量比现有方法高约6倍。

Comments 12 pages. Extended version with appendix as supplemental material. Submitted to VLDB

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19957 2026-08-03 cs.CR cs.AI cs.LG 版本更新 73%

HijackKV: New Threat in Position-Independent KV Cache Reuse

HijackKV:位置无关的键值缓存重用中的新威胁

Yichi Zhang, Zhiqi Wang, Huan Zhang, Yuchen Yang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究位置无关的KV缓存重用中的新威胁KV缓存劫持,介绍HIJACKKV攻击框架,该框架可优化攻击者控制的前缀,使受污染的KV在特定条件下劫持模型行为,单次尝试成功率达94%,还为构建安全KV重用系统提供设计见解。

Comments 20 pages, accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19345 2026-08-03 cs.CL cs.AI 版本更新 73%

Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning

少复制,多扎根:通过证据感知强化学习克服长上下文推理中的重复复制

Lizhe Fang, Weizhou Shen, Tianyi Tang, Yisen Wang

机构 * Peking University(北京大学) Alibaba Group(阿里巴巴集团)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究长上下文推理中语言模型的重复复制问题,提出GEAR奖励塑造方法,通过区分关键证据和干扰上下文来增强奖励信号,经实验验证该方法能提升模型性能,减少重复复制,凸显准确扎根证据对长上下文推理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06274 2026-08-03 cs.LG cs.AI 版本更新 73%

Stem: Rethinking Causal Information Flow in Sparse Attention

Stem: 重新思考稀疏注意力中的因果信息流

Lin Niu, Xin Luo, Linchuan Xie, Yifu Sun, Guanghua Yu, Jianchen Zhu, S Kevin Zhou

机构 * tencent(腾讯) ustc(中国科学技术大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Stem通过位置依赖的top-k和输出感知度量,优化稀疏注意力机制,提升LLMs在长上下文处理中的效率与准确性。

Comments Accepted at ICML 2026. Lin Niu and Xin Luo contributed equally to this work. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10429 2026-08-03 cs.MA cs.AI 版本更新 70%

AIvilization v0: Toward Large-Scale Artificial Social Simulation with a Unified Agent Architecture and Adaptive Agent Profiles

AIvilization v0:迈向大规模人工社会模拟的统一代理架构与自适应代理档案

Wenkai Fan, Shurui Zhang, Xiaolong Wang, Haowei Yang, Tsz Wai Chan, Xingyan Chen, Junquan Bi, Zirui Zhou, Jia Liu, Kani Chen

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Bauhinia AI

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 AIvilization v0通过统一代理架构和自适应代理档案,实现大规模人工社会模拟,解决目标稳定性与反应正确性矛盾,支持长周期自主性和多目标环境下的稳健性。

Comments v2: major revision. Agent architecture and environment consolidated into self-contained sections; new problem-setting section formalizing the asynchronous event model; evaluation reorganized by experiment with results reported alongside each protocol; added action-simulator audit, and human-steering analyses; other sections rewritten

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29600 2026-08-03 cs.RO 新提交 67%

HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation

HAM-VLN:利用分层智能体记忆实现零样本视觉与语言导航

An Liu, Bingxi Liu, Hongyu Ding, Yixuan Jiang, Yaran Chen, Fulin Tang, Cong Leng, Hong Zhang, Jian Cheng

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 本研究提出HAM-VLN零样本VLN方法,通过分层智能体记忆缓解长程导航的记忆与推理瓶颈,提升导航指标并缩短上下文长度,在多个基准数据集上取得优异零样本性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29459 2026-08-03 cs.LG cs.AI 新提交 62%

TFGformer: Multivariate Time Series Forecasting via Time-Frequency Graph Learning and Covariate Fusion

TFGformer:基于时频图学习与协变量融合的多变量时间序列预测

Yu Sun, Yuan Chang, Xiaohou Shi, Yan Sun

专题命中 长上下文与记忆 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 针对异构IoT传感器多变量时间序列预测问题,提出CrossRAG框架,结合SAM、FCC学习与CATF,在7个基准上性能优于仅参数化基线及现有检索增强预测方法。

详情

展开后加载摘要…

URL PDF HTML 收藏