arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4738 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4738 篇

2606.12236 2026-06-12 cs.RO cs.CV 新提交 88%

DrivingAgent: Design and Scheduling Agents for Autonomous Driving Systems

DrivingAgent: 自动驾驶系统的设计与调度智能体

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 提出DrivingAgent框架,通过自动化模块开发(设计阶段)和强化学习训练的轻量级LLM实时调度(调度阶段),解决自动驾驶系统集成新模型和满足实时约束的挑战,在nuScenes和Bench2Drive上取得更优速度-精度权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02474 2026-05-26 cs.CL cs.AI cs.LG 88%

MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents

MemSkill:面向自进化智能体的可学习与进化记忆技能

Haozhen Zhang, Quanyu Long, Jianzhu Bao, Tao Feng, Weizhi Zhang, Haodong Yue, Wenya Wang

机构 * Nanyang Technological University(南洋理工大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Tsinghua University(清华大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出MemSkill框架,将记忆操作转化为可学习和可进化的技能,通过控制器选择技能、执行器生成记忆、设计者进化技能集,形成闭环提升LLM智能体任务性能。

Comments Code is available at https://github.com/ViktorAxelsen/MemSkill

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16538 2026-03-09 cs.CV 88%

OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding

OnlineSI: 通过大规模语言模型实现在线3D理解和定位

Zixian Liu, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Shanghai AI Lab(上海人工智能实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 OnlineSI通过整合3D点云与语义信息,提升大规模语言模型在动态环境中的空间理解和物体识别能力。

Comments Project Page: https://onlinesi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13126 2026-02-26 cs.CY 88%

Generative agents in the streets: Exploring the use of Large Language Models (LLMs) in collecting urban perceptions

街道中的生成代理:探索大型语言模型(LLMs)在收集城市感知中的应用

Deepank Verma, Olaf Mumm, Vanessa Miriam Carlow

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 本研究利用生成代理探索大型语言模型在模拟城市环境中人类行为中的应用,通过街景图像交互和感知评估提升AI在城市感知中的能力。

Comments 30 Pages, 15 Figures, Submitted in a Journal for Peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00071 2026-02-10 cs.CL cs.AI cs.LG 88%

YaRN: Efficient Context Window Extension of Large Language Models

YaRN: 大语言模型高效上下文窗口扩展

Bowen Peng, Jeffrey Quesnelle, Honglu Fan, Enrico Shippole

机构 * EleutherAI University of Geneva(日内瓦大学)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 YaRN通过高效方法扩展大语言模型的上下文窗口,实现更长上下文的利用与扩展,超越现有最先进水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18515 2025-11-12 cs.MA 88%

Socialized Learning and Emergent Behaviors in Multi-Agent Systems based on Multimodal Large Language Models

Sureyya Akin, Shruti T. Tiwari, Ram Bhattacharya, Sagar A. Raman, Kiran Mohanty, Sita Krishnan

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments We have identified critical issues in the code implementation that severely deviate from Algorithm 1, invalidating all experimental results and conclusions. Despite exhaustive efforts to correct these issues, we find they fundamentally undermine the paper's core claims. To uphold academic integrity and prevent misinformation, we are withdrawing this manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21449 2025-10-27 cs.CV 88%

MoniTor: Exploiting Large Language Models with Instruction for Online Video Anomaly Detection

Shengtian Yang, Yue Feng, Yingshi Liu, Jingrou Zhang, Jie Qin

机构 * College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(人工智能学院,南京航空航天大学) Key Laboratory of Brain-Machine Intelligence Technology, Ministry of Education, China(脑机智能技术重点实验室,教育部,中国)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments Accepted to NeurIPS 2025. The first two authors hold equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16257 2025-09-30 cs.CV 88%

Plug-and-Play 1.x-Bit KV Cache Quantization for Video Large Language Models

Keda Tao, Haoxuan You, Yang Sui, Can Qin, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Columbia University(哥伦比亚大学) Rice University(Rice大学) Salesforce AI Research(Salesforce人工智能研究)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14326 2025-09-05 cs.SE 88%

Assessing Large Language Models in Comprehending and Verifying Concurrent Programs across Memory Models

Ridhi Jain, Rahul Purandare

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18478 2025-07-25 cs.CR 88%

Scout: Leveraging Large Language Models for Rapid Digital Evidence Discovery

Shariq Murtuza

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08248 2025-06-10 cs.CL cs.AI cs.IR cs.LG 88%

Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models

Yifu Qiu, Varun Embar, Yizhe Zhang, Navdeep Jaitly, Shay B. Cohen, Benjamin Han

机构 * University of Edinburgh(爱丁堡大学) Apple(苹果公司)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01074 2025-05-05 eess.SP 88%

WirelessAgent: Large Language Model Agents for Intelligent Wireless Networks

Jingwen Tong, Wei Guo, Jiawei Shao, Qiong Wu, Zijian Li, Zehong Lin, Jun Zhang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments This manuscript is an extended version of a previous magazine version and is now submitted to a journal for possible publication. arXiv admin note: text overlap with arXiv:2409.07964

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01553 2025-04-08 cs.DB 88%

Bhakti: A Lightweight Vector Database Management System for Endowing Large Language Models with Semantic Search Capabilities and Memory

Zihao Wu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments 17 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18434 2025-03-25 cs.CV 88%

A Simple yet Effective Layout Token in Large Language Models for Document Understanding

Zhaoqing Zhu, Chuwei Luo, Zirui Shao, Feiyu Gao, Hangdi Xing, Qi Zheng, Ji Zhang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07463 2025-03-11 cs.HC 88%

GenAIReading: Augmenting Human Cognition with Interactive Digital Textbooks Using Large Language Models and Image Generation Models

Ryugo Morita, Ko Watanabe, Jinjia Zhou, Andreas Dengel, Shoya Ishimaru

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments Accepted at AHs2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06680 2024-11-12 cs.SE 88%

Anchor Attention, Small Cache: Code Generation with Large Language Models

Xiangyu Zhang, Yu Zhou, Guang Yang, Harald C. Gall, Taolue Chen

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments 14 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00287 2024-09-24 cs.DC 88%

Benchmarking the Performance of Large Language Models on the Cerebras Wafer Scale Engine

Zuoning Zhang, Dhruv Parikh, Youning Zhang, Viktor Prasanna

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments IEEE HPEC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05824 2024-09-10 cs.SE 88%

Are Large Language Models a Threat to Programming Platforms? An Exploratory Study

Md Mustakim Billah, Palash Ranjan Roy, Zadia Codabux, Banani Roy

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments Accepted in ESEM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04960 2024-07-09 cs.IR 88%

MemoCRS: Memory-enhanced Sequential Conversational Recommender Systems with Large Language Models

Yunjia Xi, Weiwen Liu, Jianghao Lin, Bo Chen, Ruiming Tang, Weinan Zhang, Yong Yu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10548 2024-02-19 cs.IR 88%

Cognitive Personalized Search Integrating Large Language Models with an Efficient Memory Mechanism

Yujia Zhou, Qiannan Zhu, Jiajie Jin, Zhicheng Dou

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by WWW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16797 2024-02-02 cs.PL cs.SE 88%

Enhancing Translation Validation of Compiler Transformations with Large Language Models

Yanzhao Wang, Fei Xie

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.15595 2023-06-29 cs.CL cs.AI cs.LG 88%

Extending Context Window of Large Language Models via Positional Interpolation

Shouyuan Chen, Sherman Wong, Liangjian Chen, Yuandong Tian

专题命中 长上下文与记忆 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG

Comments Fix template issues

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12522 2026-08-14 cs.AI 新提交 87%

$\varepsilon$-MemEvo: Adaptive Cross-Task Memory Transfer for LLM Program Evolution

ε-MemEvo:面向大语言模型程序进化的自适应跨任务记忆迁移

Aofan Liu, Shiyuan Song, Yiyan Qi

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 ε-MemEvo是面向LLM程序进化的自适应跨任务记忆迁移框架,在8个优化基准上以GPT-5为主干,较AdaEvolve实现AUCC与早期收敛提升,且计算开销极低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11034 2026-08-12 cs.DC cs.LG 新提交 87%

SCOUT: Symmetric Consensus Outlier Detection for Failure Localization in LLM Pre-Training

SCOUT:用于大语言模型预训练中故障定位的对称共识异常检测

Zhuang Wang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.LG

AI总结 SCOUT是用于LLM预训练故障定位的统一运行时框架,基于等价副本严格多数共识识别异常,可与主流大模型训练框架集成,解决现有诊断方法的局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08348 2026-08-12 cs.CL 版本更新 87%

Bayesian-Agent: Posterior-Guided Skill Evolution Across LLM Agent Harnesses

Bayesian-Agent:面向LLM Agent框架的后验引导技能演化

Xiaojun Wu, Cehao Yang, Honghao Liu, Xueyuan Lin, Wenjie Zhang, Zhichao Shi, Xuhui Jiang, Chengjin Xu, Jia Li, Jian Guo

机构 * IDEA Research(IDEA研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) DataArcTech Ltd.(DataArcTech有限公司)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL

AI总结 提出Bayesian-Agent框架,将可复用技能视为假设,通过后验分布指导技能演化(如修补、拆分、压缩等),在多个基准上显著提升性能,表明Agent技能演化应视为后验引导的框架优化。

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01707 2026-08-07 cs.CL cs.DB 版本更新 87%

Memory in the LLM Era: Modular Architectures and Strategies in a Unified Framework

在大语言模型时代:在统一框架下的模块化架构与策略

Yanchen Wu, Tenghui Lin, Yingli Zhou, Fangyuan Zhang, Qintian Guo, Xun Zhou, Sibo Wang, Xilin Liu, Yuchi Ma, Yixiang Fang

机构 * Huawei Cloud(华为云)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文在统一框架下系统比较了多种记忆方法,设计出优于现有方法的新方法,并探讨了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03844 2026-08-05 cs.AI 新提交 87%

MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents

MAFIA:针对经审计的大语言模型智能体的、基于探测与事实注入的仅查询内存攻击

Jiaming Chen, Yisen Gao, Yanping Li, Zifan Liu, Yumeng Zhang, Jun Zhang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 本研究针对经审计的LLM智能体,提出MAFIA攻击框架,通过放置策略与伪装有效载荷实现高攻击成功率,大幅降低审计检测率,揭示智能体内存系统的关键漏洞。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03391 2026-08-05 cs.LG 新提交 87%

TimeRLM: Recursive Language Models Enable Precise Anomaly Localization in Long-Context Time-Series

TimeRLM:递归语言模型可实现长时序数据中的精准异常定位

Nicolas Zumarraga, Lorenzo Steno, Ning Wang, Max Rosenblattl, Thomas Kaar, Maxwell A. Xu, Kevin O'Sullivan, Markus Kreft, Elgar Fleisch, Paul Schmiedmayer, Patrick Langer, Robert Jakob

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.LG

AI总结 提出TimeRLM(基于递归语言模型的时序异常定位框架),结合强化学习后训练后,在合成基准AnomalyXL及真实世界数据上,均优于现有时序语言模型,可实现长时序数据的精准异常定位。

Comments Open source code and datasets: https://github.com/OpenTSLM/TimeRLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29377 2026-08-03 cs.CL 新提交 87%

Zero-Mem: Zero-Token Memory Operations for LLM Agents

Zero-Mem:面向大语言模型智能体的零令牌内存操作

Yilin Xiao, Zhehan Zhu, Yujing Zhang, Jin Chen, Zijin Hong, Luyao Zhuang, Qinggang Zhang, Shengyuan Chen, Xiaocao Ouyang, Lingfei Ren, Xiao Huang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL

AI总结 Zero-Mem提出零令牌内存操作,以原始交互轨迹为记录来源,通过实体-上下文图与时间层次结构组织信息,仅在最终问答时调用LLM,在长记忆问答基准中实现性能与效率的平衡,降低内存操作时间成本57.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25992 2026-07-29 cs.DB cs.AI 新提交 87%

MemLens: A Value-Aware Memory Management System with Interactive Analytics for LLM-based Agents

MemLens:一种用于基于大语言模型的智能体的具有交互式分析的价值感知内存管理系统

Shuyue Wei, Chang Liu, Zimu Zhou, Yongxin Tong, Lizhen Cui

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 研究针对基于LLM的智能体内存管理问题,提出价值感知内存管理系统MemLens,通过端到端交互式分析仪表板展示内存生命周期,经学习助手应用程序帮助用户比较策略,可实现高效、可解释和个性化的长期内存管理。

详情

展开后加载摘要…

URL PDF HTML 收藏