arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-30 至 2026-07-30 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 18 篇

2604.12250 2026-07-30 cs.AI cs.CL cs.GT cs.MA 版本更新 92%

How memory can affect collective and cooperative behaviors in an LLM-Based Social Particle Swarm

记忆如何影响基于LLM的社会粒子群中的集体和合作行为

Taisei Hishiki, Takaya Arita, Reiji Suzuki

机构 * Graduate School of Informatics(信息学研究生院)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了大型语言模型代理的内部对齐特性如何影响记忆对其集体和合作动态的影响。通过将社会粒子群模型中的规则代理替换为具有大五人格特质和不同记忆长度的LLM代理,发现记忆长度是决定集体行为的关键参数,且不同模型对记忆的解读影响合作结果。

Comments 11 pages, 4 figures and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16986 2026-07-30 cs.CL cs.AI 版本更新 91%

Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents

Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents

Jingxing Wang, Chenyu Zhou, Zhihui Fu, Jun Wang, Weiwen Liu, Weinan Zhang, Jianghao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 长上下文与记忆 :LLM(title,title_cn);prompting(abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出了一种在测试时自适应的技能合成方法SkillTTA,通过检索与当前任务相关的少量训练轨迹并将其合成成为任务特定的文本技能,以提高LLM代理在SpreadsheetBench、ALFWorld和BigCodeBench等任务上的性能。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26637 2026-07-30 cs.CL cs.AI 新提交 90%

Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability

面向LLM智能体的基于文件系统的内存:组织、演化与可持续性

Sizhe Zhou, Sheldon Yu, Hui Wei, Junda Wu, Siru Ouyang, Yizhu Jiao, Shijia Pan, Julian McAuley, Yu Zhang, Tong Yu, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, San Diego(加利福尼亚大学圣迭戈分校) University of California, Merced(加利福尼亚大学默塞德分校) Adobe Research(奥多比研究院) Texas A&M University(德克萨斯农工大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 本研究首次系统探索面向LLM智能体的基于文件系统的内存,定义三个智能体角色开展实验,发现有组织存储可减半检索成本,但多数智能体组织会退化,工具集对存储形态的影响与更换模型相当,将文件系统设为智能体内存的设计空间。

Comments 59 pages, 12 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26072 2026-07-30 cs.IR cs.AI 新提交 90%

IFCMemoryBench: Evaluating Long-Term Memory of LLM-Based Agents in BIM Information Retrieval

IFCMemoryBench:评估基于大语言模型(LLM)的智能体在建筑信息模型(BIM)信息检索中的长期记忆能力

Changyu Du, Alexander Vosseler, Filippo Mazza, André Borrmann

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 本文推出IFCMemoryBench基准,评估基于LLM的智能体在BIM信息检索中的长期记忆,发现现有通用记忆系统在该场景下表现差,存在领域迁移差距。

Comments KDD 2026 Workshop on Evaluation and Trustworthiness of Agentic AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26490 2026-07-30 cs.AI cs.LG cs.NE 新提交 90%

EvoPINN: Agentic Discovery of Executable Algorithms for Physics-Informed Neural Networks

EvoPINN:面向物理信息神经网络可执行算法的智能体式发现框架

Peng Yin, Kai Li, Yifan Zhang, Jian Cheng

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉科学学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 EvoPINN是智能体式框架,将PINN开发转化为基于执行的算法发现,通过LLM智能体迭代优化,自主发明SLRC-PINN,可显著降低PDE求解的相对L₂误差,为科学计算提供新机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27187 2026-07-30 cs.PF 新提交 89%

A Photonic-CXL Memory Appliance for Scalable KV Cache Management in LLM Inference

用于LLM推理中可扩展KV缓存管理的光子-CXL存储设备

Jing Ding, Yash Nishant, Chandrish Ambati, Jyothsna Kamati, Trung Diep

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 该研究针对LLM推理的存储墙问题,提出Marvell光子-CXL混合存储设备,实现32 TB共享内存,延迟降超50%,多轮对话首token时间提升6.6倍,解决了电气CXL池的部署痛点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26473 2026-07-30 cs.LG cs.CL 新提交 85%

Learning Dynamic User Personas from Implicit Interaction Streams via Iterative Refinement

通过迭代优化从隐式交互流中学习动态用户画像

Haifeng Wu

机构 * PayPal(贝宝)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 针对现有个性化LLM依赖显式偏好监督的局限,提出IRIS框架,通过隐式交互流迭代优化用户画像,在Reddit AITA数据上的100位作者测试中,其决策预测准确率达61.0%,优于多种基线方法。

Comments 23 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26455 2026-07-30 cs.CL cs.AI 新提交 84%

ForgetBench: Benchmarking Forgetting Dynamics of Long-Term Parametric Memory in Language Models

ForgetBench:语言模型中长期参数记忆的遗忘动态基准测试

Ruxi Gu, Zhenliang Zhang, Wei Wang

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出ForgetBench基准测试,通过两种评估范式与统一分析框架,揭示现有LLMs在长期知识保留与泛化间难以平衡的问题,为未来模型记忆机制优化提供方向。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26075 2026-07-30 cs.IR cs.AI 新提交 81%

IDP AutoOpt: Agent-Driven Optimization of Document Processing Pipeline Configurations

IDP AutoOpt:智能文档处理流水线配置的智能体驱动优化

David Kaleko, Sergey Ivanov, Md Mofijul Islam

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 IDP AutoOpt是自主LLM智能体,通过闭环流程优化IDP流水线配置,在多领域任务上性能优于人类专家且成本更低,还可扩展至RAG等其他企业AI系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26448 2026-07-30 cs.CL cs.AI 新提交 81%

Mergeable Model-Side Aggregation States for Long-Context Language Models

面向长上下文语言模型的可合并模型侧聚合状态

Dachuan Song, Junyu Yin, Zechen Hu, Xuan Wang

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 针对长上下文语言模型在非加性集合聚合任务中的性能缺陷,提出带HLL草图状态的模型侧聚合接口,该接口可合并跨段状态,在多任务上较基线方法实现显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26335 2026-07-30 cs.DC 新提交 80%

The Fabric Is the Cluster Driver: Cross-Layer eBPF Policies for GPU-CXL Fabrics

Fabric 是集群驱动:面向 GPU-CXL Fabric 的跨层 eBPF 策略

Yiwei Yang, Andi Quinn

专题命中 长上下文与记忆 :LLM(summary_cn,abstract)

AI总结 该研究提出 fabric_ext 中间件编译器与运行时,通过语义移动图实现跨 GPU-CXL Fabric 多层的 eBPF 策略,以处理 LLM 预填充等场景下的跨岛数据流需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02259 2026-07-30 cs.CL cs.AI cs.LG 版本更新 78%

MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent

MemAgent:基于多轮对话强化学习的记忆智能体重构长上下文大语言模型

Hongli Yu, Tinghong Chen, Jiangtao Feng, Jiangjie Chen, Weinan Dai, Qiying Yu, Ya-Qin Zhang, Wei-Ying Ma, Jingjing Liu, Mingxuan Wang, Hao Zhou

机构 * ByteDance Seed(字节跳动种子期) Institute for AI Industry Research (AIR)(人工智能产业研究院) Tsinghua University(清华大学)

专题命中 长上下文与记忆 :LLM(title);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出MemAgent智能体工作流,结合扩展的DAPO算法优化长文本任务,实现从8K到3.5M上下文的高效外推,在RULER测试中表现优异。

Comments Accepted to ICLR 2026 as an Oral presentation. OpenReview: https://openreview.net/forum?id=k5nIOvYGCL Project page: https://memagent-sialab.github.io/

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27080 2026-07-30 cs.CR cs.AI 新提交 70%

MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair

MemSecBench:追踪智能体内存中毒从持久性到后果及修复的全生命周期

Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究提出MemSecBench基准测试,通过24种配置的实验发现不同内存系统栈在智能体内存中毒的持久性、后果及选择性修复上存在显著差异,为智能体内存安全评估提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13097 2026-07-30 cs.PL cs.AI 版本更新 70%

Functional Cache Grafting: Robust and Rapid Code-Policy Synthesis for Embodied Agents

功能缓存嫁接:具身智能体的鲁棒且快速代码策略合成

Saehun Chun, Wonje Choi, Sera Choi, Sanghyun Ahn, Honguk Woo

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出FCGraft框架,通过维护函数级验证代码骨架及其键值缓存,对新任务进行缓存嫁接(拼接和修补),减少预填充计算并复用验证结构,实现更鲁棒和快速的策略合成。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23254 2026-07-30 cs.SE 版本更新 67%

Better Call Grep: Evaluating and Improving Grep-Like Lexical Retrieval for Repository-Level Code Completion

更好地调用Grep:评估和改进用于仓库级代码补全的类Grep词汇检索方法

Baoyi Wang, Xingliang Wang, Guochang Li, Chen Zhi, Junxiao Han, Xinkui Zhao, Nan Wang, Shuiguang Deng, Jianwei Yin

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文评估改进类Grep词汇检索,提出Naive GrepRAG基线,又结合后处理流水线的GrepRAG在代码补全任务上优于SOTA,为轻量检索支撑仓库级代码补全提供方案。

Comments ISSTA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26523 2026-07-30 cs.LG cs.AI 新提交 62%

The Art of Not Forgetting A Local Learning Architecture for Continual Learning

不遗忘的艺术:面向持续学习的局部学习架构

Ashmith Atmuri, Yashaswini Rao Bhogarajula

机构 * Arkadhi Research(阿卡迪研究机构)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出持续学习架构CMP,采用稀疏关系编码、两层竞争记忆与局部更新,在语言建模实验中较参数匹配的Transformer基线表现出更低的灾难性遗忘,为持续学习提供了新方向。

Comments 28 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25379 2026-07-30 cs.CL 版本更新 57%

StateRAG: Typed State Contracts for Complex Retrieval-Augmented Generation

EfficientGraph-RAG:面向跨任务检索增强生成的结构化检索状态管理

Miaohe Niu, Pengxiang Li, Jingbo Zhu, Tong Xiao

机构 * School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院) Tsinghua University, China(清华大学) Kunming University of Science and Technology, China(昆明理工大学) NiuTrans Research, Shenyang, China(沈阳NiuTrans研究院)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL

AI总结 提出EfficientGraph-RAG框架,通过显式定义检索状态(TAM、MARS、SMP三个机制)实现结构化状态管理,在多个基准上提升答案质量并降低大模型token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15548 2026-07-30 cs.LG 版本更新 57%

Dense Local Dependencies Induce Attention-Logit Explosion and Training Instability During Long-Sequence Transformer Training

密集局部依赖会在长序列Transformer训练期间引发注意力对数爆炸和训练不稳定性

Suvadeep Hajra

专题命中 长上下文与记忆 :language model(abstract);分类 cs.LG

AI总结 本研究揭示长序列Transformer训练中注意力对数爆炸的主因是密集局部依赖,经实验验证该增长由依赖密度驱动,提出显式建模密集局部依赖的长上下文Transformer设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏