arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-09 至 2026-03-09 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 6 篇

2601.16538 2026-03-09 cs.CV 88%

OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding

OnlineSI: 通过大规模语言模型实现在线3D理解和定位

Zixian Liu, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Shanghai AI Lab(上海人工智能实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 OnlineSI通过整合3D点云与语义信息,提升大规模语言模型在动态环境中的空间理解和物体识别能力。

Comments Project Page: https://onlinesi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23008 2026-03-09 cs.LG cs.AI 86%

Exploratory Memory-Augmented LLM Agent via Hybrid On- and Off-Policy Optimization

探索性记忆增强型大语言模型代理:通过混合的在线与离线策略优化

Zeyuan Liu, Jeonghye Kim, Xufang Luo, Dongsheng Li, Yuqing Yang

机构 * Microsoft Research(微软研究院) KAIST(韩国科学技术院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 EMPO²通过混合在线与离线策略优化,提升大语言模型在探索性和通用性方面的性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18093 2026-03-09 cs.CL 81%

Agri-Query: A Case Study on RAG vs. Long-Context LLMs for Cross-Lingual Technical Question Answering

Agri-Query:基于RAG与长上下文LLM在跨语言技术问答中的案例研究

Julius Gun, Timo Oksanen

机构 * Technical University of Munich, Germany Professorship of Agrimechatronics(慕尼黑技术大学教授职位,农业机电学教授)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文通过Agri-Query案例研究,比较RAG与长上下文LLM在跨语言技术问答中的性能,发现混合RAG在准确性上优于直接提示方法。

Journal ref Technical University of Munich. 2026. ISBN 978-3-911430-11-1. https://mediatum.ub.tum.de/1845092

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06358 2026-03-09 cs.SE 75%

A Scalable Benchmark for Repository-Oriented Long-Horizon Conversational Context Management

面向仓库的长 horizon 对话上下文管理可扩展基准

Yang Liu, Li Zhang, Fang Liu, Ping Lin, Xinyi Li

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出LoCoEval,首个面向仓库开发场景的长 horizon 对话上下文管理基准,评估了多种方法并提出改进方案,提升了代码助手在复杂对话中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06199 2026-03-09 cs.CL cs.AI 73%

FlashPrefill: Instantaneous Pattern Discovery and Thresholding for Ultra-Fast Long-Context Prefilling

FlashPrefill: ultra-fast long-context prefilling的即时模式发现与阈值处理

Qihang Fan, Huaibo Huang, Zhiying Wu, Juqiu Wang, Bingning Wang, Ran He

机构 * MAIS&NLPR, CASIA(MAIS与NLPR,中国科学院自动化研究所) UCAS(中国科学技术大学) WeChat, Tencent(微信、腾讯)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 FlashPrefill通过即时模式发现和动态阈值机制,实现超快长上下文prefilling,显著提升效率并保持在不同序列规模下的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16069 2026-03-09 cs.SE cs.LG 70%

The Limits of Long-Context Reasoning in Automated Bug Fixing

长上下文推理在自动化Bug修复中的局限性

Ravi Raju, Mengmeng Ji, Shubhangi Upasani, Bo Li, Urmish Thakker

机构 * SambaNova Systems(SambaNova系统)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究发现长上下文推理在自动化Bug修复中存在显著局限,现有模型在长上下文下的表现远低于预期。

Comments Accepted to ICLR 2026 ICBINB workshop

详情

展开后加载摘要…

URL PDF HTML 收藏