arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4771 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4771 篇

2605.04400 2026-05-08 cs.IT cs.LG math.IT 81%

Contextual Memory-Enhanced Source Coding for Low-SNR Communications

上下文记忆增强的信源编码用于低信噪比通信

Ziqiong Wang, Rongpeng Li

机构 * College of Information Science and Electronic Engineering(信息科学与电子工程学院)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种内存增强的信源编码方案,通过内部化上下文模式提升信源编码的鲁棒性,减少残余信道错误对解码的影响,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16496 2026-04-30 cs.CL 81%

AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents

AdaMem:面向长时对话代理的自适应用户导向记忆

Shannan Yan, Jingchen Ni, Leqi Zheng, Jiajun Zhang, Peixi Wu, Dacheng Yin, Jing Lyu, Chun Yuan, Fengyun Rao

机构 * Tsinghua University(清华大学) WeChat Vision, Tencent Inc.(腾讯微信视觉实验室)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AdaMem通过自适应用户导向记忆框架提升长时对话代理的长时推理与用户建模能力,采用统一框架整合工作记忆、事件记忆、人格记忆和图记忆,实现高效信息组织与推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24905 2026-04-29 cs.MA cs.AI 81%

MultiHedge: Adaptive Coordination via Retrieval-Augmented Control

MultiHedge:通过检索增强控制实现自适应协调

Feliks Bańka, Jarosław A. Chudziak

机构 * The Faculty of Electronics and Information Technology(电子与信息技术学院)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文提出MultiHedge框架,通过检索增强的LLM协调提升模块化决策系统的鲁棒性,实验表明记忆增强比单纯扩大模型规模更有效。

Comments 8 pages, 2 figures. Accepted to the 26th International Conference on Computational Science (ICCS 2026), to appear in Springer LNCS proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08816 2026-04-29 cs.IR cs.AI 81%

MemRec: Collaborative Memory-Augmented Agentic Recommender System

MemRec:协同记忆增强的代理推荐系统

Weixin Chen, Yuhan Zhao, Jingyuan Huang, Zihe Ye, Clark Mingxuan Ju, Tong Zhao, Neil Shah, Li Chen, Yongfeng Zhang

机构 * Hong Kong Baptist University(香港 Baptist大学) Rutgers University(罗格斯大学) Snap Inc.(Snap公司)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MemRec通过引入协同记忆机制,解决传统推荐系统中记忆隔离导致的上下文过载问题,通过轻量级语言模型管理动态记忆图谱,提升推荐精度与效率。

Comments Accepted at ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12087 2026-04-29 cs.CL 81%

BLASST: Dynamic BLocked Attention Sparsity via Softmax Thresholding

BLASST: 通过Softmax阈值实现动态阻塞注意力稀疏性

Jiayi Yuan, Cameron Shinn, Kai Xu, Jingze Cui, George Klimiashvili, Guangxuan Xiao, Perkz Zheng, Bo Li, Yuxin Zhou, Zhouhai Ye, Weijie You, Tian Zheng, Dominic Brown, Pengbo Wang, Markus Hoehnerbach, Richard Cai, Julien Demouth, John D. Owens, Xia Hu, Song Han, Timmy Liu, Huizi Mao

机构 * Anonymous Institution, Anonymous City, Anonymous Region, Anonymous Country(匿名机构,匿名城市,匿名地区,匿名国家)

专题命中 长上下文与记忆 :LLM(summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 BLASST通过Softmax阈值实现动态稀疏注意力机制,提升LLM长上下文推理效率,无需训练,减少预计算,优化硬件支持,实现1.52x和1.48x的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20651 2026-04-23 cs.AI 81%

CHORUS: An Agentic Framework for Generating Realistic Deliberation Data

CHORUS:生成真实辩论数据的代理框架

A. Koursaris, G. Domalis, A. Apostolopoulou, K. Kanaris, D. Tsakalidis, I. E. Livieris

机构 * Novelcore

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文提出CHORUS框架,通过LLM驱动的代理生成真实辩论数据,结合记忆机制和泊松过程模型,提升讨论的现实性和分析价值。

Comments This paper has been accepted for presentation at Engineering Applications and Advances of Artificial Intelligence 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03690 2026-04-23 cs.SE cs.AI 81%

The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents

OpenHands软件代理SDK:一种可组合且可扩展的生产代理基础

Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

机构 * MLSys 2026

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文提出OpenHands SDK,提供灵活的代理实现接口、安全可靠执行及用户交互接口,整合了本地到远程执行、多LLM路由和安全分析,验证了其在生产部署中的有效性。

Comments Accepted at MLSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02993 2026-04-22 cs.CL 81%

Stable-RAG: Mitigating Retrieval-Permutation-Induced Hallucinations in Retrieval-Augmented Generation

Stable-RAG:缓解检索排列引起的幻觉

Qianchi Zhang, Hainan Zhang, Liang Pang, Hongwei Zheng, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北航人工智能学院) Beijing Academy of Blockchain and Edge Computing(北京区块链与边缘计算研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Stable-RAG通过利用检索排列敏感性估计,缓解检索排列引起的幻觉,提升问答准确性与一致性。

Comments Accepted to ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00868 2026-04-21 cs.LG 81%

FlexiCache: Leveraging Temporal Stability of Attention Heads for Efficient KV Cache Management

FlexiCache: 利用注意力头的时序稳定性实现高效的KV缓存管理

Nazmul Takbir, Hamidreza Alikhani, Nikil Dutt, Sangeetha Abdu Jyothi

机构 * Anonymous Authors(匿名作者)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出FlexiCache,通过利用注意力头的时序稳定性减少GPU内存和计算开销,同时保持模型精度,适用于长上下文和长生成场景。

Comments Accepted at MLSys-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17052 2026-04-20 cs.LG 81%

Dynamic Tool Dependency Retrieval for Lightweight Function Calling

轻量级函数调用的动态工具依赖检索

Bhrij Patel, Davide Belli, Amir Jalalirad, Maximilian Arnold, Aleksandr Ermolov, Bence Major

机构 * Qualcomm AI Research(高通人工智能研究) University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出动态工具依赖检索方法,通过结合初始查询和逐步展开的工具调用计划,提升函数调用的准确性和效率,实验表明其在多个数据集和模型上均优于现有静态检索方法。

Comments 24 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01566 2026-04-20 cs.CL 81%

FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents

FS-Researcher:基于文件系统的长周期研究任务测试时扩展

Chiwei Zhu, Benfeng Xu, Mingxuan Du, Shaohan Wang, Xiaorui Wang, Zhendong Mao, Yongdong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(MetaStone技术公司)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出FS-Researcher框架,通过持久化工作空间实现长周期研究任务的测试时扩展,采用双代理结构提升研究质量与扩展性。

Comments 22 pages, 6 figures; Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14339 2026-04-17 cs.CL 81%

Shuffle the Context: RoPE-Perturbed Self-Distillation for Long-Context Adaptation

重组上下文:RoPE扰动的自我蒸馏用于长上下文适应

Zichong Li, Chen Liang, Liliang Ren, Tuo Zhao, Yelong Shen, Weizhu Chen

机构 * Georgia Institute of Technology(佐治亚理工学院) Microsoft(微软)

专题命中 长上下文与记忆 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出RoPE扰动的自我蒸馏方法,通过扰动RoPE索引生成不同视角的训练序列,提升模型对位置变化的鲁棒性,实验显示在长上下文任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03686 2026-04-17 cs.AI 81%

AI4S-SDS: A Neuro-Symbolic Solvent Design System via Sparse MCTS and Differentiable Physics Alignment

AI4S-SDS: 一种基于稀疏MCTS和可微物理对齐的神经符号溶剂设计系统

Jiangyu Chen

机构 * State Key Laboratory for Novel Software Technology at Nanjing University(南京大学新型软件技术国家重点实验室) School of Computer Science, Nanjing University(南京大学计算机科学学院) Suzhou Laboratory(苏州实验室)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AI4S-SDS系统,通过稀疏MCTS和可微物理对齐,解决化学配方设计中的高维组合空间问题,提升探索多样性并实现物理约束下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20352 2026-04-16 cs.AI 81%

AMA: Adaptive Memory via Multi-Agent Collaboration

AMA:通过多智能体协作实现自适应记忆

Weiquan Huang, Zixuan Wang, Hehai Lin, Sudong Wang, Bo Xu, Qian Li, Beier Zhu, Linyi Yang, Chengwei Qin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Shandong University(山东大学) Nanyang Technological University(南洋理工大学) Southern University of Science and Technology(南方科技大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AMA框架,通过多智能体协作实现自适应记忆管理,解决传统方法在记忆粒度和一致性维护上的不足,实验表明其在长上下文任务中表现优异,减少约80%的token消耗。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12776 2026-04-15 cs.CL 81%

EvoSpark: Endogenous Interactive Agent Societies for Unified Long-Horizon Narrative Evolution

EvoSpark:内生交互代理社会的统一长周期叙述进化

Shiyu He, Minchi Kuang, Mengxian Wang, Bin Hu, Tingxiang Gu

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Department of Precision Instrument, Tsinghua University(清华大学精密仪器系)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 EvoSpark通过内生交互代理社会框架,解决LLM多代理系统中长周期叙述演化的矛盾,通过分层叙述记忆和生成场景机制实现逻辑一致的持续叙事。

Comments Accepted to the Main Conference of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02211 2026-04-03 cs.IR cs.AI cs.MA 81%

Multi-Agent Video Recommenders: Evolution, Patterns, and Open Challenges

多智能体视频推荐系统:演进、模式与开放挑战

Srivaths Ranganathan, Abhishek Dharmaratnakar, Anushree Sinha, Debanshu Das

机构 * Google LLC(谷歌公司)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文探讨多智能体视频推荐系统的演进、协作模式及挑战,分析了从早期MARL到LLM驱动架构的发展,并提出可扩展性、多模态理解等开放问题。

Comments Accepted for publication in The Nineteenth ACM International Conference on Web Search and Data Mining (WSDM Companion 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26664 2026-03-30 cs.SE cs.CL 81%

Learning to Commit: Generating Organic Pull Requests via Online Repository Memory

学习承诺:通过在线仓库记忆生成有机的拉取请求

Mo Li, L. H. Xu, Qitai Tan, Ting Cao, Yunxin Liu

机构 * Tsinghua University(清华大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 本文提出Learning to Commit框架,通过在线仓库记忆提升生成拉取请求的有机性,通过对比历史提交改进代码风格和架构约束。

Comments Preprint. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18093 2026-03-09 cs.CL 81%

Agri-Query: A Case Study on RAG vs. Long-Context LLMs for Cross-Lingual Technical Question Answering

Agri-Query:基于RAG与长上下文LLM在跨语言技术问答中的案例研究

Julius Gun, Timo Oksanen

机构 * Technical University of Munich, Germany Professorship of Agrimechatronics(慕尼黑技术大学教授职位,农业机电学教授)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文通过Agri-Query案例研究,比较RAG与长上下文LLM在跨语言技术问答中的性能,发现混合RAG在准确性上优于直接提示方法。

Journal ref Technical University of Munich. 2026. ISBN 978-3-911430-11-1. https://mediatum.ub.tum.de/1845092

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11595 2026-01-26 cs.DC cs.LG cs.SE 81%

Enhancing Model Context Protocol (MCP) with Context-Aware Server Collaboration

增强模型上下文协议(MCP)的上下文感知服务器协作

Meenakshi Amulya Jayanti, X. Y. Han

机构 * University of Chicago(芝加哥大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究提出CA-MCP,通过引入共享上下文存储提升多智能体系统效率,减少LLM调用次数和响应失败频率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07470 2026-01-13 cs.AI 81%

Learning How to Remember: A Meta-Cognitive Management Method for Structured and Transferable Agent Memory

学习如何记忆:一种用于结构化和可迁移智能体记忆的元认知管理方法

Sirui Liang, Pengfei Cao, Jian Zhao, Wenhao Teng, Xiangwen Liao, Jun Zhao, Kang Liu

机构 * Institute of Automation, CAS(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究所) Department of Gastrointestinal Surgery, Fujian Provincial Cancer Hospital(福建省癌症医院胃肠外科) College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 本文提出MCMA方法,通过学习记忆抽象技能提升智能体在长期任务中的记忆管理和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23730 2025-12-09 cs.CL 81%

Evaluating Long-Term Memory for Long-Context Question Answering

评估长期记忆以实现长上下文问答

Alessandra Terranova, Björn Ross, Alexandra Birch

机构 * School of Informatics, The University of Edinburgh(信息学院,爱丁堡大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

AI总结 本文评估了增强记忆方法在长上下文问答任务中的效果,发现通过RAG和事件记忆可显著减少令牌使用并保持准确性。

Comments Accepted as a poster at Metacognition in Generative AI EurIPS workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04678 2025-10-07 cs.CL 81%

Multi-Agent Tool-Integrated Policy Optimization

Zhanfeng Mo, Xingxuan Li, Yuntao Chen, Lidong Bing

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24930 2025-09-30 cs.CL cs.CY 81%

How Well Do LLMs Imitate Human Writing Style?

Rebira Jemama, Rajesh Kumar

机构 * Lewisburg Area High School, Lewisburg, USA(刘易斯堡区高中) Bucknell University, Lewisburg, USA(巴克内尔大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments IEEE UEMCON 2025, 11 pages, 4 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18749 2025-08-27 cs.AI 81%

Reflection-Enhanced Meta-Optimization Integrating TextGrad-style Prompt Optimization with Memory-Driven Self-Evolution

Chunlong Wu, Zhibo Qu

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23088 2025-08-01 cs.RO cs.AI cs.HC 81%

Beyond Rigid AI: Towards Natural Human-Machine Symbiosis for Interoperative Surgical Assistance

Lalithkumar Seenivasan, Jiru Xu, Roger D. Soberanis Mukul, Hao Ding, Grayson Byrd, Yu-Chun Ku, Jose L. Porras, Masaru Ishii, Mathias Unberath

机构 * Johns Hopkins University(约翰霍普金斯大学) Johns Hopkins Applied Physics Laboratory(约翰霍普金斯应用物理实验室) Johns Hopkins Medical Institutions(约翰霍普金斯医学机构)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23609 2025-07-08 cs.CL 81%

On Positional Bias of Faithfulness for Long-form Summarization

David Wan, Jesse Vig, Mohit Bansal, Shafiq Joty

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Salesforce AI Research(Salesforce人工智能研究)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments NAACL 2025 (20 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11498 2025-06-16 cs.CL 81%

Lag-Relative Sparse Attention In Long Context Training

Manlai Liang, Wanyi Huang, Mandi Liu, Huaijun Li, Jinlong Li

机构 * AI Lab, China Merchants Bank, China(中国民生银行人工智能实验室)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04948 2025-05-28 cs.IR cs.CL 81%

Prompt-Based LLMs for Position Bias-Aware Reranking in Personalized Recommendations

Md Aminul Islam, Ahmed Sayeed Faruk

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments We have decided to withdraw the manuscript as it requires substantial revisions that go beyond what is appropriate for a versioned update on arXiv. We plan to resubmit once the necessary improvements are made

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11444 2025-02-18 cs.CL 81%

Does RAG Really Perform Bad For Long-Context Processing?

Kun Luo, Zheng Liu, Peitian Zhang, Hongjin Qian, Jun Zhao, Kang Liu

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11775 2025-01-17 cs.CL cs.NI 81%

Leveraging Fine-Tuned Retrieval-Augmented Generation with Long-Context Support: For 3GPP Standards

Omar Erak, Nouf Alabbasi, Omar Alhussein, Ismail Lotfi, Amr Hussein, Sami Muhaidat, Merouane Debbah

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);small language model(abstract);SLM(abstract)

Comments submitted to Proc. IEEE Globecom

详情

展开后加载摘要…

URL PDF HTML 收藏