arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-05-18 至 2026-05-18 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 24 篇

2605.15889 2026-05-18 cs.CR cs.LG 92%

A Multi-Layer Cloud-IDS Pipeline with LLM and Adaptive Q-Learning Calibration

多层云入侵检测系统与LLM和自适应Q学习校准

Syed Waqas Ali, Ibrar Ali Shah, Farzana Zahid, Daniyal Munir, Hans D. Schotten

机构 * Department of Computer Software Engineering, University of Engineering and Technology(计算机软件工程系,工程大学) Department of Computer Science, University of Waikato(计算机科学系,怀卡托大学) WICON, RPTU University, Kaiserslautern-Landau(WICON,鲁滕堡大学,凯泽斯劳滕-兰道) Department of Intelligent Networks, German Research Center for Artificial Intelligence (DFKI)(智能网络系,德国人工智能研究中心(DFKI))

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种多层云入侵检测系统,结合强化学习和LLM,通过自适应阈值和Chroma数据库提升检测性能,实验显示系统在准确率、精确率和召回率等方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21798 2026-05-18 cs.CV 90%

CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models

CG-MLLM:通过多模态大语言模型实现图像描述与3D内容生成

Junming Huang, Chi Wang, Letian Li, Guangkai Xu, Donglin Huang, Hao Chen, Qiang Dai, Weiwei Xu

机构 * Zhejiang University, China(浙江大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文提出CG-MLLM,一种能实现3D描述和高分辨率3D生成的多模态大语言模型,通过混合Transformer架构分离不同建模需求,结合预训练视觉语言模型与专用3D VAE潜在空间,提升3D生成质量与感知能力。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15617 2026-05-18 cs.DC cs.AI 90%

A Few GPUs, A Whole Lotta Scale: Faithful LLM Training Emulation with PrismLLM

几块GPU,大量规模:PrismLLM实现忠实的LLM训练仿真

Shaoke Xi, ChonLam Lao, Boyi Jia, Jiaqi Gao, Zhipeng Zhang, Jiamin Cao, Brian Sutioso, Erci Xu, Minlan Yu, Kui Ren, Yong Li, Zhengping Qian, Ennan Zhai, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团) Harvard University(哈佛大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PrismLLM通过切片方法构建高保真执行图,使工程师能用少量GPU模拟大规模训练行为,准确复现性能和内存表现,节省集群访问成本。

Comments 13 pages body, 21 pages total

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16045 2026-05-18 cs.CL cs.AI cs.LG 89%

RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents

RecMem:基于递归的记忆巩固用于高效且有效的长运行LLM代理

Zijie Dai, Shiyuan Deng, Sheng Guan, Yizhou Tian, Xin Yao, Xiao Yan, James Cheng

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) Huawei Cloud(华为云) Huawei Theory Lab(华为理论实验室) Institute for Math and AI, Wuhan University(武汉大学数学与人工智能研究院)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 RecMem通过递归机制优化内存巩固,减少token消耗并提升准确性,有效解决长运行LLM代理的内存管理问题。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00364 2026-05-18 cs.CR 89%

"Someone Hid It": Query-Agnostic Black-Box Attacks on LLM-Based Retrieval

有人隐藏了它:针对基于大语言模型的检索的查询无关黑盒攻击

Jiate Li, Defu Cao, Li Li, Wei Yang, Yuehan Qin, Chenxiao Yu, Tiannuo Yang, Ryan A. Rossi, Yan Liu, Xiyang Hu, Yue Zhao

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种无需查询或模型知识的黑盒攻击方法,通过零样本代理LLM生成可迁移的注入标记,揭示LLM检索系统的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15665 2026-05-18 cs.AI 84%

PRISM: Prompt Reliability via Iterative Simulation and Monitoring for Enterprise Conversational AI

PRISM:通过迭代模拟和监控实现提示的可靠性用于企业对话式AI

Keshava Chaitanya, Jahnavi Gundakaram

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);language agent(abstract)

AI总结 PRISM通过持续模拟和监控,将提示工程视为可靠性工程问题,提升企业对话式AI的可靠性,减少提示开发时间并修复生产中的回归问题。

Comments 12 pages, 1 figure, 5 tables. arXiv preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15343 2026-05-18 cs.AI cs.LG cs.MA 84%

Belief Engine: Configurable and Inspectable Stance Dynamics in Multi-Agent LLM Deliberation

信念引擎:多智能体大语言模型协商中的可配置和可检查立场动态

Joshua C. Yang, Maurice Flechtner, Damian Dailisan, Michiel A. Bakker

机构 * ETH Zurich(苏黎世联邦理工学院) Centre for Democracy Studies Aarau, University of Zurich(苏黎世大学民主研究中心) Massachusetts Institute of Technology(麻省理工学院)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出Belief Engine,通过可配置的信念更新机制,研究多智能体协商中的立场动态,揭示立场变化背后的证据吸收与锚定因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15701 2026-05-18 cs.CL cs.AI 82%

H-Mem: A Novel Memory Mechanism for Evolving and Retrieving Agent Memory via a Hybrid Structure

H-Mem: 一种通过混合结构进化和检索智能体记忆的新型记忆机制

Jiawei Yu, Yixiang Fang, Xilin Liu, Yuchi Ma

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Huawei Cloud Computing Technologies CO., LTD.(华为云计算技术有限公司)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 H-Mem通过混合结构有效建模智能体记忆的长期演化并高效检索记忆数据,提升问答任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14401 2026-05-18 cs.CL cs.AI 82%

Agentic Recommender System with Hierarchical Belief-State Memory

具有分层信念状态记忆的代理推荐系统

Xiang Shen, Yuhang Zhou, Yifan Wu, Zhuokai Zhao, Siyu Lin, Lei Huang, Qianqian Zhong, Lizhu Zhang, Benyu Zhang, Xiangjun Fan, Hong Yan

机构 * Meta Recommendation Systems (MRS)(Meta推荐系统)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 本文提出MARS框架,通过分层信念状态记忆提升推荐系统,采用LLM规划器动态调度六种操作,实验显示在四个基准领域中实现SOTA性能。

Comments 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15752 2026-05-18 astro-ph.IM astro-ph.EP 78%

Forecasting megaelectron-volt electron flux in the Earth's outer radiation belt using supervised machine learning algorithms and a timeseries foundation model

利用监督机器学习算法和时间序列基础模型预测地球磁层外辐射带兆电子伏特电子通量

Rungployphan Kieokaew, Ryad Guezzi, François Ginisty, Hadrien Mariaccia

专题命中 长上下文与记忆 :foundation model(title,abstract)

AI总结 本文提出利用TimesFM与岭回归结合的方法,通过2013-2023年的数据训练,实现了对1MeV电子通量的高精度预测,该方法在L壳层中表现优异,R²值达到0.9,优于其他模型。

Comments 19 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16233 2026-05-18 cs.AI cs.CL cs.LG cs.MA cs.SY eess.SY 75%

FORGE: Self-Evolving Agent Memory With No Weight Updates via Population Broadcast

FORGE:无权重更新的自演化代理记忆

Igor Bogdanov, Chung-Horng Lung, Thomas Kunz, Jie Gao, Adrian Taylor, Marzia Zaman

机构 * Carleton University(卡尔顿大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 FORGE通过群体广播机制实现无梯度更新的自生成记忆,提升层次ReAct代理决策能力,在CybORG CAGE-2任务中显著提高性能并降低失败率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08426 2026-05-18 cs.LG cs.AI cs.CL 75%

KV Cache Offloading for Context-Intensive Tasks

KV缓存卸载用于上下文密集型任务

Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev, Vyacheslav Zhdanovskiy, Yegor Yershov

机构 * HSE(俄罗斯人民友谊大学) Yandex NSU(俄罗斯国立核能研究大学梅利科夫)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了KV缓存卸载在上下文密集型任务中的应用,通过Text2JSON基准测试发现,该方法在Llama 3和Qwen 3模型上导致性能下降,分析指出低秩投影和不可靠地标是主要问题,并提出更简单的替代策略以提升准确性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07518 2026-05-18 cs.CL cs.AI cs.LG 75%

TokenButler: Token Importance is Predictable

TokenButler:令牌重要性是可预测的

Yash Akhauri, Ahmed F AbouElhamayed, Yifei Gao, Chi-Chih Chang, Sameh Gobriel, Nilesh Jain, Mohamed S. Abdelfattah

机构 * Cornell University(康奈尔大学) Intel Labs(英特尔实验室)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 TokenButler通过高粒度查询感知预测器识别关键令牌,减少KV缓存瓶颈,提升解码效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12636 2026-05-18 cs.DC cs.AI cs.LG cs.PF 73%

TrainMover: An Interruption-Resilient Runtime for ML Training

TrainMover: 一种具有中断容错能力的机器学习训练运行时

ChonLam Lao, Jiaqi Gao, Jiamin Cao, Zhipeng Zhang, Pengcheng Zhang, Jiangfei Duan, Zhilong Zheng, Yu Guan, Yichi Xu, Yong Li, Zhengping Qian, Aditya Akella, Minlan Yu, Ennan Zhai, Dennis Cai, Jingren Zhou

机构 * Harvard University(哈佛大学) Alibaba Group(阿里巴巴集团) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 TrainMover通过弹性与备用机器处理中断,实现最小停机时间和零内存开销,减少GPU浪费时间达55%。

Comments 14 pages body, 19 pages total

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13805 2026-05-18 cs.CV cs.AI cs.LG 73%

RAR: Retrieving And Ranking Augmented MLLMs for Visual Recognition

RAR:用于视觉识别的检索与排序增强多模态大语言模型

Ziyu Liu, Zeyi Sun, Yuhang Zang, Wei Li, Pan Zhang, Xiaoyi Dong, Yuanjun Xiong, Dahua Lin, Jiaqi Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) MThreads, Inc.(MThreads公司) Nanyang Technological University(南洋理工大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 RAR结合CLIP的检索与MLLM的排序,提升细粒度识别精度,增强少样本和零样本任务表现。

Comments Project: https://github.com/Liuziyu77/RAR

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15611 2026-05-18 cs.AI 70%

TopoEvo: A Topology-Aware Self-Evolving Multi-Agent Framework for Root Cause Analysis in Microservices

TopoEvo: 一种面向拓扑的自演化多智能体框架用于微服务中的根本原因分析

Junle Wang, Xingchuang Liao, Wenjun Wu

机构 * School of Artificial Intelligence, Beihang University Beijing, China(人工智能学院,北京航空航天大学,北京,中国)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对微服务中观测数据异质性、故障传播和拓扑漂移问题,TopoEvo通过多模态对齐、拓扑约束推理和自演化机制,提升根本原因分析的鲁棒性与准确性。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09033 2026-05-18 cs.CR cs.AI 70%

ShadowMerge: A Novel Poisoning Attack on Graph-Based Agent Memory via Relation-Channel Conflicts

ShadowMerge:一种通过关系通道冲突的图基agent内存新型污染攻击

Yang Luo, Zifeng Kang, Tiantian Ji, Xinran Liu, Yong Liu, Shuyu Li, Lingyun Peng

机构 * Key Laboratory of Trustworthy Distributed Computing and Service (MoE)(可信分布式计算与服务重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Laboratory(中关村实验室)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出ShadowMerge攻击,通过关系通道冲突攻击图基agent内存,利用冲突值影响agent行为,改进现有攻击方法,实现93.8%的攻击成功率。

Comments Preprint. Corresponding authors: Zifeng Kang and Tiantian Ji. Code is available at https://anonymous.4open.science/status/ShadowMerge-033C

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01970 2026-05-18 cs.CR cs.AI 70%

Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration

Trojan Hippo:利用代理记忆进行数据外泄

Debeshee Das, Julien Piet, Darya Kaviani, Luca Beurer-Kellner, Florian Tramèr, David Wagner

机构 * ETH Z\"urich

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 研究提出Trojan Hippo攻击,通过单次不可信工具调用在代理长期记忆中植入潜伏载荷,当用户讨论敏感话题时激活并外泄数据。通过动态评估框架评估不同内存架构和防御措施,发现现有防御措施在安全性和实用性之间存在显著权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10454 2026-05-18 cs.AI 70%

Traj-CoA: Patient Trajectory Modeling via Chain-of-Agents for Lung Cancer Risk Prediction

Traj-CoA:通过链式代理进行患者轨迹建模用于肺癌风险预测

Sihang Zeng, Yujuan Fu, Sitong Zhou, Zixuan Yu, Lucas Jing Liu, Jun Wen, Matthew Thompson, Ruth Etzioni, Meliha Yetisgen

机构 * University of Washington(华盛顿大学) Fred Hutch Cancer Center(Fred Hutch癌症中心) Harvard University(哈佛大学) Google(谷歌)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Traj-CoA通过链式代理系统处理电子健康记录数据,减少噪声并保留完整时间线,从而在肺癌风险预测中优于基线方法。

Comments Accepted by NeurIPS 2025 GenAI4Health Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15556 2026-05-18 cs.HC 67%

TopoClaw: A Human-Centric and Topology-Aware Agent Operating System

TopoClaw:一种以人为本且拓扑感知的代理操作系统

Heyuan Huang, Yeyi Guan, Jihong Wang, Mingzhi Wang, Jiamu Zhou, Xiangmou Qu, Jiaxin Yin, Xin Liao, Xingyu Lou, Jun Wang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 TopoClaw提出一种以人为本的拓扑感知代理操作系统,通过物理设备拓扑与社会关系拓扑的耦合结构,实现跨设备动作放置、跨用户身份归属和跨上下文权限治理,提升分布式协作与安全管控能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15514 2026-05-18 cs.CL cs.AI cs.LG 67%

RoPE Distinguishes Neither Positions Nor Tokens in Long Contexts, Provably

RoPE在长上下文中无法区分位置或令牌,证明性分析

Yufeng Du, Phillip Harris, Minyang Tian, Eliu A Huerta, Srikanth Ronanki, Subendhu Rongali, Aram Galstyan, Hao Peng

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Bonn(波恩大学) Argonne National Laboratory(阿贡国家实验室) Amazon AGI(亚马逊人工智能研究院)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文证明RoPE在长上下文中因失去局部偏倚和令牌相关性一致性而失效,无法区分位置或令牌,且增加RoPE基值只能牺牲位置区分能力。

Comments 35 pages, 11 figures, submitted to NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15812 2026-05-18 cs.HC cs.AI 57%

Toward Natural and Companionable Virtual Agents via Cross-Temporal Emotional Modeling

通过跨时间情感建模实现自然和陪伴型虚拟代理

Feier Qin, Xiao Li, Yi Zheng, Haibin Huang, Hanyao Wang, Xiaoyu Wang, Yan Lu, Yuan Zhang

机构 * Communication University of China(中国通信大学) Microsoft Research Asia(微软亚洲研究院) Institute of Artificial Intelligence, China Telecom(中国电信人工智能研究院)

专题命中 长上下文与记忆 :foundation model(abstract);分类 cs.AI

AI总结 本文提出CTEM框架,通过链接长期行为历史与即时情感表达,提升虚拟代理的自然性和情感和谐度,实验显示在21天的真实场景中效果显著。

Comments 21 pages, published in CHI '26

Journal ref Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI '26), ACM, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10813 2026-05-18 cs.AI 57%

NanoResearch: Co-Evolving Skills, Memory, and Policy for Personalized Research Automation

NanoResearch: 为个性化研究自动化共进化技能、记忆与政策

Jinhang Xu, Qiyuan Zhu, Yujun Wu, Zirui Wang, Dongxu Zhang, Marcia Tian, Yiling Duan, Siyuan Li, Jingxuan Wei, Sirui Han, Yike Guo, Odin Zhang, Conghui He, Cheng Tan

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Hong Kong University of Science and Technology(香港科技大学) Peking University(北京大学) Zhejiang University(浙江大学) Xi'an Jiaotong University(西安交通大学) East China University of Science and Technology(东华大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI

AI总结 本文提出NanoResearch框架,通过三重共进化解决研究自动化中的个性化需求,提升研究效率与用户体验。

Comments 40 pages, 14 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03922 2026-05-18 cs.LG 57%

Online Vector Quantized Attention

在线向量量化注意

Nick Alonso, Tomas Figliolia, Beren Millidge

机构 * Zyphra

专题命中 长上下文与记忆 :language model(abstract);分类 cs.LG

AI总结 本文提出OVQ注意机制,通过稀疏内存更新提升长上下文处理能力,在保持线性计算和常数内存的同时,显著优于线性注意和SSM。

详情

展开后加载摘要…

URL PDF HTML 收藏