arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-18 至 2026-03-18 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 13 篇

2603.15800 2026-03-18 cs.CV cs.CL cs.CR 88%

Evolving Contextual Safety in Multi-Modal Large Language Models via Inference-Time Self-Reflective Memory

通过推理时的自我反思记忆在多模态大语言模型中实现上下文安全演化

Ce Zhang, Jinxi He, Junyi He, Katia Sycara, Yaqi Xie

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出MM-SafetyBench++基准和EchoSafe框架,通过自反思记忆实现多模态大语言模型的上下文安全演化,实验表明其在安全性能上表现优异。

Comments Accepted at CVPR 2026. Project page: https://echosafe-mllm.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16734 2026-03-18 cs.AI 85%

Differential Harm Propensity in Personalized LLM Agents: The Curious Case of Mental Health Disclosure

个性化LLM代理中的差异性伤害倾向:心理健康披露的奇特案例

Caglar Yildirim

机构 * Khoury College of Computer Sciences(科里学院计算机科学学院)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究探讨了心理健康披露对代理有害行为的影响,发现个性化设置可降低伤害,但易受对抗性压力影响,需加强个性化评估与安全措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15653 2026-03-18 cs.CL cs.AI cs.LG 82%

Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context

递归语言模型与不确定性:自我反思程序搜索在长上下文中的意外效果

Keivan Alizadeh, Parshin Shojaee, Minsik Cho, Mehrdad Farajtabar

机构 * Apple(苹果公司)

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SRLM框架,通过引入不确定性感知的自我反思,提升长上下文处理能力,实验显示其在多种任务中优于现有基线,且无需递归机制。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15634 2026-03-18 cs.AI cs.IR cs.LG 81%

NextMem: Towards Latent Factual Memory for LLM-based Agents

NextMem: 向基于大语言模型的智能体构建潜在事实记忆

Zeyu Zhang, Rui Li, Xiaoyan Zhao, Yang Zhang, Wenjie Wang, Xu Chen, Tat-Seng Chua

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 NextMem提出一种基于自回归自编码器的潜在事实记忆框架,通过两阶段训练和量化技术提升记忆构建效率与准确性,在检索、鲁棒性和扩展性方面表现优异。

Comments 17 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15666 2026-03-18 cs.AI 79%

Compiled Memory: Not More Information, but More Precise Instructions for Language Agents

编译记忆:不是更多信息,而是为语言代理提供更精确的指令

James Rhodes, George Kang

机构 * AlphaBitCore, Inc.(AlphaBitCore公司)

专题命中 长上下文与记忆 :language agent(title,abstract);分类 cs.AI

AI总结 本文提出Atlas内存内核,通过编译积累的任务经验为语言代理生成指令结构,无需微调、RAG或人工干预,提升GPT-4o和Claude Sonnet~4.5在合同分析和多跳问答任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15642 2026-03-18 cs.AI 78%

CraniMem: Cranial Inspired Gated and Bounded Memory for Agentic Systems

CraniMem:受大脑启发的门控和有界的记忆用于智能体系统

Pearl Mody, Mihir Panchal, Rishit Kar, Kiran Bhowmick, Ruhina Karani

机构 * Dwarkadas Jivanlal Sanghvi College of Engineering(达沃拉萨·吉文拉尔·桑格维工程学院)

专题命中 长上下文与记忆 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CraniMem通过门控和有界多阶段记忆设计提升智能体在长期任务中的稳定性与鲁棒性,采用目标条件门控和效用标签结合短期缓冲和长期知识图谱,实现更持久的语义记忆与更小的干扰影响。

Comments International Conference on Learning Representations 2026 Workshop on Memory for LLM-Based Agentic Systems (MemAgents)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16862 2026-03-18 cs.CL 77%

Chronos: Temporal-Aware Conversational Agents with Structured Event Retrieval for Long-Term Memory

Chronos:具有结构化事件检索的时序感知对话代理以实现长期记忆

Sahil Sen, Elias Lumer, Anmol Gulati, Vamse Kumar Subbiah

机构 * Commercial Technology and Innovation Office(商业技术与创新办公室)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 Chronos通过结构化事件日历和对话日历实现时序感知,有效处理长期对话记忆中的时间敏感查询,提升多跳推理能力,在LongMemEvalS基准测试中取得新高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18546 2026-03-18 cs.RO cs.AI 77%

EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval

EfficientNav: 面向设备端目标物体导航的导航地图缓存与检索

Zebin Yang, Sunjian Zheng, Tong Xie, Tianshi Xu, Bo Yu, Fan Wang, Jie Tang, Shaoshan Liu, Meng Li

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Integrated Circuits, Peking University(北京大学集成电路学院) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人研究院) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进制造创新中心)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出EfficientNav,通过语义感知记忆检索和离散记忆缓存技术,在设备端实现零样本目标物体导航,提升成功率并降低规划延迟。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16557 2026-03-18 cs.AI cs.CL 73%

BenchPreS: A Benchmark for Context-Aware Personalized Preference Selectivity of Persistent-Memory LLMs

BenchPreS:面向持久内存LLM的上下文感知个性化偏好选择性基准

Sangyeon Yoon, Sunkyoung Kim, Hyesoo Hong, Wonje Jeung, Yongil Kim, Wooseok Seo, Heuiyeen Yeen, Albert No

机构 * Yonsei University(延世大学) LG AI Research(LG AI研究院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 BenchPreS评估持久内存LLM在不同通信场景中对用户偏好是否恰当应用,发现前沿模型在上下文敏感应用上存在不足,偏好遵循性强的模型易出现过度应用,推理能力和提示防御无法彻底解决此问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16413 2026-03-18 cs.LG cs.AI 73%

Trained Persistent Memory for Frozen Encoder--Decoder LLMs: Six Architectural Methods

为冻结的编码器-解码器语言模型训练持久内存:六种架构方法

Hong Jeong

机构 * Inha University in Tashkent, Uzbekistan(乌兹别克斯坦塔什克ENT的Inha大学)

专题命中 长上下文与记忆 :LLM(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了在冻结编码器-解码器语言模型中通过持久内存实现连续潜在空间的可行性,提出六种架构方法,通过训练适配器实现对话学习,验证了容量作为关键设计参数的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15723 2026-03-18 cs.AI 70%

Context-Length Robustness in Question Answering Models: A Comparative Empirical Study

问答模型中的上下文长度鲁棒性:一项比较实证研究

Trishita Dhara, Siddhesh Sheth

机构 * Upper Hand Ace Rent a Car

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过SQuAD和HotpotQA基准评估问答模型在上下文长度变化下的鲁棒性,发现多跳推理任务比单跨度提取任务更易受上下文稀释影响。

Comments Accepted for Oral Presentation at Math AI 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15994 2026-03-18 cs.AI 57%

Selective Memory for Artificial Intelligence: Write-Time Gating with Hierarchical Archiving

选择性记忆用于人工智能:具有层次归档的写时门控

Oliver Zahn, Simran Chana

机构 * Independent Researcher(独立研究者) University of Cambridge(剑桥大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI

AI总结 本文提出写时门控机制,通过复合显著性评分筛选知识对象,保持版本链以保存先前状态,实验证明其在噪声环境下优于传统方法,尤其在干扰比例增加时表现更优。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00512 2026-03-18 cs.CV 50%

Wavelet-based Frame Selection by Detecting Semantic Boundary for Long Video Understanding

基于语义边界的小波帧选择用于长视频理解

Wang Chen, Yuhui Zeng, Yongdong Luo, Tianyu Xie, Luojun Lin, Jiayi Ji, Yan Zhang, Xiawu Zheng

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院)

专题命中 长上下文与记忆 :language model(abstract)

AI总结 本文提出WFS-SB方法,通过小波变换检测语义边界,提升长视频中大视觉语言模型的性能,实验显示在多个基准上均优于现有方法。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏