arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4779 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4779 篇

2605.25435 2026-05-26 cs.AI 77%

Security of OpenClaw Agents: Fundamentals, Attacks, and Countermeasures

OpenClaw 代理的安全性:基础、攻击与对策

Yuntao Wang, Jianle Ba, Han Liu, Yanghe Pan, Jintao Wei, Zhou Su, Tom H. Luan, Linkang Du

机构 * School of Cyber Science and Engineering, Xi'an Jiaotong University(西安交通大学网络科学与工程学院)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文综述了 OpenClaw 代理的安全挑战,分类分析了技能投毒、认知操纵、多代理级联故障和供应链漏洞等威胁,并总结了现有防御机制。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23771 2026-05-25 cs.CV cs.AI cs.MA 77%

PhotoFlow: Agentic 3D Virtual Photography Missions

PhotoFlow: 智能体式3D虚拟摄影任务

Jiarui Guo, Haojia Wei, Yiming Zhang, Yifei Liu, Yuning Gong, Hongjie Zhang, Xue Yang, Zhihang Zhong

机构 * Shanghai Jiao Tong University(上海交通大学) Northeastern University(东北大学) University of California, Los Angeles(加州大学洛杉矶分校) Cornell University(康奈尔大学) Shanghai AI Laboratory(上海人工智能实验室) Sichuan University(四川大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);language model(abstract);分类 cs.AI

AI总结 提出PhotoFlow智能体框架,通过导演-评审-反思闭环搜索机制,在任意Blender场景中根据语言指令自动完成虚拟摄影,并引入VPhotoBench基准,实验表明其在外观质量对齐和成功率上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17625 2026-05-19 cs.AI 77%

Episodic-Semantic Memory Architecture for Long-Horizon Scientific Agents

用于长周期科学代理的事件-语义记忆架构

Nikola Milosevic

机构 * Serbian Institute for Artificial Intelligence Research and Development(塞尔维亚人工智能研究与发展研究所) Bayer A.G.(勃林格殷曼有限公司)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种双过程记忆架构,用于解决科学代理在长周期任务中面临的情境窗口饱和问题,通过分离即时事件需求和长期知识整合,提升了在大规模科学工作流中的表现和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06017 2026-05-19 cs.LG math.PR 77%

Matrix-Decoupled Concentration for Autoregressive Sequences: Dimension-Free Guarantees for Sparse Long-Context Rewards

自回归序列的矩阵解耦浓度:稀疏长上下文奖励的维度无关保证

Pei-Sen Li

机构 * School of Mathematics and Statistics, Beijing Institute of Technology, Beijing 100872, China(北京理工大学数学系,北京理工大学,北京100872,中国)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出矩阵解耦浓度框架,通过严格因果依赖解析和目标敏感性向量的精确矩阵-向量乘法,解决自回归模型中依赖结构与目标敏感性分离的问题,提供维度无关的方差代理和长上下文推理的稳定性保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12366 2026-05-13 cs.AI 77%

Classifier Context Rot: Monitor Performance Degrades with Context Length

分类器上下文旋转:通过上下文长度监控性能退化

Sam Martin, Fabien Roger

机构 * Anthropic Fellows Program(Anthropic fellows项目)

专题命中 长上下文与记忆 :language model(abstract);post-training(abstract);prompting(abstract);分类 cs.AI

AI总结 研究发现当前前沿模型在长上下文情况下难以检测危险行为,通过提示技术可部分缓解此问题,强调长上下文退化对监控性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03728 2026-05-11 cs.CV cs.AI 77%

CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval

CSMCIR: 基于记忆库的增强对称对齐用于复合图像检索

Zhipeng Qian, Zihan Liang, Yufei Ma, Ben Chen, Huangyu Dai, Yiwei Ma, Jiayi Ji, Chenyi Lei, Han Li, Xiaoshuai Sun

机构 * Kuaishou Technology(快播科技) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(教育部多媒体可信感知与高效计算重点实验室,厦门大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

AI总结 本文提出CSMCIR,通过多级链式思维提示策略、对称双塔架构和熵基记忆库策略,实现高效查询-目标对齐,提升复合图像检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00702 2026-05-04 cs.CL 77%

Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory

学习如何和记忆什么:受认知启发的两阶段优化用于进化记忆

Derong Xu, Shuochen Liu, Pengfei Luo, Pengyue Jia, Yingyi Zhang, Yi Wen, Yimin Deng, Wenlin Zhang, Enhong Chen, Xiangyu Zhao, Tong Xu

机构 * University of Science and Technology of China & State Key Laboratory of Cognitive Intelligence(中国科学技术大学 & 认知智能国家重点实验室) City University of Hong Kong(香港城市大学) Dalian University of Technology(大连理工大学) Xi’an Jiaotong University(西安交通大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出MemCoE框架,通过两阶段优化学习记忆组织方式和更新内容,提升长期个性化记忆的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20117 2026-04-23 cs.CL 77%

To Know is to Construct: Schema-Constrained Generation for Agent Memory

知即建构:基于模式约束的代理记忆生成

Lei Zheng, Weinan Song, Daili Li, Yanming Yang

机构 * UnionPay(中国银联)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出SCG-MEM架构,通过模式约束生成实现记忆检索,避免结构幻觉并提升多跳推理能力,实验显示其在LoCoMo基准上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20006 2026-04-23 cs.CL 77%

From Recall to Forgetting: Benchmarking Long-Term Memory for Personalized Agents

从回忆到遗忘:个性化代理长期记忆的基准测试

Md Nayem Uddin, Kumar Shubham, Eduardo Blanco, Chitta Baral, Gengyu Wang

机构 * Arizona State University(亚利桑那州立大学) Genies University of Arizona(亚利桑那大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 本文提出Memora基准测试,评估个性化代理在长期对话中的记忆、推理和推荐能力,引入FAMA指标以衡量对过时记忆的依赖,发现LLM和记忆代理在处理长期记忆时存在显著不足。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19926 2026-04-23 cs.AI 77%

CreativeGame:Toward Mechanic-Aware Creative Game Generation

CreativeGame:迈向机制感知的创意游戏生成

Hongnan Ma, Han Wang, Shenglin Wang, Tieyue Yin, Yiwei Shi, Yucong Huang, Yingtian Zou, Muning Wen, Mengyue Yang

机构 * University of Bristol(布里斯托大学) Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) Nanjing University(南京大学) Sreal AI Project(Sreal AI项目)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出CreativeGame系统,通过机制感知规划循环和跨版本经验积累,实现迭代式HTML5游戏生成,支持可解释的版本间进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19189 2026-04-22 cs.CL 77%

Headlines You Won't Forget: Can Pronoun Insertion Increase Memorability?

你会忘记的头条:代词插入能否提高记忆性?

Selina Meyer, Magdalena Abel, Michael Roth

机构 * Natural Language Understanding Lab(自然语言理解实验室) Cognitive Psychology Lab(认知心理学实验室) University of Technology Nuremberg(图恩大学)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过三个实验探讨代词插入对记忆性的影响,发现效果因话题和上下文而异,同时指出大语言模型自动修改可能不总是合适。

Comments To be published at the 15th edition of the Workshop on Cognitive Modeling and Computational Linguistics (CMCL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04852 2026-04-21 cs.SE cs.AI cs.PL 77%

Raw Pointer Rewriting with LLMs for Translating C to Safer Rust

使用LLM的原始指针重写用于将C翻译为更安全的Rust

Yifei Gao, Chengpeng Wang, Pengxiang Huang, Xuwei Liu, Mingwei Zheng, Xiangyu Zhang

机构 * Purdue University(普渡大学) University of Rochester(罗切斯特大学)

专题命中 长上下文与记忆 :LLM(title_cn);prompting(abstract);分类 cs.AI

AI总结 本文提出PR2技术,通过决策树提示引导指针提升,消除C到Rust翻译中的原始指针,提升代码安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17086 2026-04-15 cs.CL 77%

Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning

通过最小化强化学习推进多智能体RAG系统

Yihong Wu, Liheng Ma, Muzhi Li, Jiaming Zhou, Lei Ding, Jianye Hao, Ho-fung Leung, Irwin King, Yingxue Zhang, Jian-Yun Nie

机构 * McGill University \& Mila Montréal QC Canada The Chinese University of Hong Kong Hong Kong China Huawei Noah’s Ark Lab Montréal QC Canada University of Manitoba Winnipeg MB Canada Tianjin University Tianjin China Independent Researcher Hong Kong China McGill University \& Mila The Chinese University of Hong Kong Huawei Noah’s Ark Lab University of Manitoba Tianjin University Independent Researcher

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

AI总结 本文提出Mujica-MyGo框架,通过多智能体RAG流程分解多轮交互,结合轻量强化学习算法MyGO,有效解决长上下文问题,提升复杂问答性能。

Comments AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10661 2026-04-14 cs.SE cs.AI 77%

DynamicsLLM: a Dynamic Analysis-based Tool for Generating Intelligent Execution Traces Using LLMs to Detect Android Behavioural Code Smells

DynamicsLLM:基于动态分析的工具,利用LLMs生成智能执行轨迹以检测Android行为代码异味

Houcine Abdelkader Cherief, Florent Avellaneda, Naouel Moha

机构 * École de technologie supérieure(高等技术学院) Université du Québec à Montréal(魁北克大学蒙特利尔分校)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出DynamicsLLM,利用LLMs生成智能执行轨迹以检测Android行为代码异味,通过混合方法提高小活动应用的覆盖范围,并在333个应用上验证效果,显著提升代码异味检测率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09747 2026-04-14 cs.CR cs.AI 77%

ADAM: A Systematic Data Extraction Attack on Agent Memory via Adaptive Querying

ADAM:通过自适应查询对代理记忆进行系统性数据提取攻击

Xingyu Lyu, Jianfeng He, Ning Wang, Yidan Hu, Tao Li, Danjue Chen, Shixiong Li, Yimin Chen

机构 * University of Massachusetts Lowell, USA(马萨诸塞大学洛厄尔分校) Amazon, USA(亚马逊) University of South Florida, USA(南佛罗里达大学) Rochester Institute of Technology, USA(罗切斯特理工学院) Purdue University, USA(普渡大学) North Carolina State University, USA(北卡罗来纳州立大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出ADAM攻击,通过估计受害者代理内存的数据分布和熵引导查询策略,提升隐私泄露效果,实验显示其攻击成功率高达100%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07041 2026-04-09 cs.DB cs.AI cs.ET cs.HC cs.IR 77%

AV-SQL: Decomposing Complex Text-to-SQL Queries with Agentic Views

AV-SQL:通过代理视图分解复杂文本到SQL查询

Minh Tam Pham, Trinh Pham, Tong Chen, Hongzhi Yin, Quoc Viet Hung Nguyen, Thanh Tam Nguyen

机构 * Griffith University(格里菲斯大学) The University of Queensland(昆士兰大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AV-SQL通过代理视图分解复杂文本到SQL查询,提升复杂查询的执行准确率,其在Spider 2.0基准测试中达到70.38%的准确率,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05854 2026-04-08 cs.AI 77%

Deep Researcher Agent: An Autonomous Framework for 24/7 Deep Learning Experimentation with Zero-Cost Monitoring

深度研究员代理:一个全天候深度学习实验的自主框架,零成本监控

Xiangyue Zhang

机构 * The University of Tokyo(东京大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出深度研究员代理框架,实现24/7深度学习实验自动化,通过零成本监控、双层固定大小内存和最小工具集架构,提升实验效率与成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20791 2026-04-08 cs.SE cs.AI 77%

From Cool Demos to Production-Ready FMware: Core Challenges and a Technology Roadmap

从Cool演示到生产级FMware:核心挑战和技术路线图

Gopi Krishnan Rajbahadur, Gustavo A. Oliva, Dayi Lin, Jiho Shin, Ahmed E. Hassan

机构 * Centre for Software Excellence, Huawei Canada(华为加拿大软件卓越中心) Queen's University(女王大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

AI总结 本文探讨了从演示级到生产级FMware的过渡挑战,分析了FMware选型、数据对齐、提示工程等关键问题,并提出技术路线图以指导其规模化应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04853 2026-04-07 cs.AI 77%

MemMachine: A Ground-Truth-Preserving Memory System for Personalized AI Agents

MemMachine:一种保持事实真实性的记忆系统用于个性化AI代理

Shu Wang, Edwin Yu, Oscar Love, Tom Zhang, Tom Wong, Steve Scargall, Charles Fan

机构 * MemVerge, Inc.(MemVerge公司)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MemMachine是一种开源记忆系统,通过整合短期、长期事件和用户档案记忆,实现事实真实性保护,提升多会话交互的准确性和效率。

Comments 18 pages, 16 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09127 2026-04-07 cs.AI cs.MA 77%

Collective AI can amplify tiny perturbations into divergent decisions

集体AI可以放大微小扰动成为分歧决策

Hajime Shimao, Warut Khern-am-nuai, Sung Joo Kim

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) McGill University(麦吉尔大学) American University(美利坚大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究发现集体AI在迭代多模型讨论中可能放大微小扰动导致决策分歧,且委员会架构影响稳定性,揭示集体AI的稳定性问题。

Comments Main text: 9 pages, 4 figures;

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00438 2026-04-02 cs.CL 77%

TR-ICRL: Test-Time Rethinking for In-Context Reinforcement Learning

TR-ICRL:基于上下文的强化学习中的测试时重新思考

Wenxuan Jiang, Yuxin Zuo, Zijian Zhang, Xuecheng Wu, Zining Fan, Wenxuan Liu, Li Chen, Xiaoyu Li, Xuezhi Cao, Xiaolong Jin, Ninghao Liu

机构 * The Hong Kong Polytechnic University(香港理工大学) Meituan(美团) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Xi’an Jiaotong University(西安交通大学) East China Normal University(华东师范大学) Northeastern University(东北大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 TR-ICRL通过在推理过程中重新思考来解决ICRL中的奖励估计问题,通过伪标签生成反馈,提升模型在推理和知识密集型任务中的性能。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24595 2026-03-27 cs.PL cs.AI 77%

Model2Kernel: Model-Aware Symbolic Execution For Safe CUDA Kernels

Model2Kernel: 用于安全CUDA内核的模型感知符号执行

Mengting He, Shihao Xia, Haomin Jia, Wenfei Wu, Linhai Song

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器实验室) Peking University(北京大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Model2Kernel,通过模型感知动态分析验证LLM推理中CUDA内核的内存安全,利用专门的符号执行技术发现353个未知bug,仅产生9个误报。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13313 2026-03-27 cs.CL 77%

ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization

ReSum:通过上下文摘要解锁长周期搜索智能

Xixi Wu, Kuan Li, Yida Zhao, Liwen Zhang, Litu Ou, Huifeng Yin, Zhongwang Zhang, Xinmiao Yu, Dingchu Zhang, Yong Jiang, Pengjun Xie, Fei Huang, Minhao Cheng, Shuai Wang, Hong Cheng, Jingren Zhou

机构 * The Chinese University of Hong Kong(香港中文大学) Tongyi Lab, Alibaba Group(阿里云实验室) Penn State University(宾夕法尼亚州立大学) The Hong Kong University of Science(香港科学大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出ReSum方法,通过外部工具定期压缩交互历史以实现无限制探索,结合GRPO算法提升长周期奖励分配,实验证明其在免训练场景下优于ReAct,且用少量样本即可达到领先开源模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23508 2026-03-26 cs.CL cs.IR 77%

Fast and Faithful: Real-Time Verification for Long-Document Retrieval-Augmented Generation Systems

快速而忠实:长文档检索增强生成系统中的实时验证

Xunzhuo Liu, Bowei He, Xue Liu, Haichen Zhang, Huamin Chen

机构 * MBZUAI, McGill University(MBZUAI,麦吉尔大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种实时验证组件,用于长文档检索增强生成系统,通过平衡响应时间和验证覆盖度,提升对长文档的忠实性验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22704 2026-03-25 cs.CL 77%

Synthetic or Authentic? Building Mental Patient Simulators from Longitudinal Evidence

合成还是真实?从纵向证据构建心理健康患者模拟器

Baihan Li, Bingrui Jin, Kunyao Lan, Ming Wang, Mengyue Wu

机构 * SJTU Paris Elite Institute of Technology(上海交通大学巴黎精英理工学院) X-LANCE Lab(X-LANCE实验室) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算机与信息系统学院)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出DEPROFILE框架,通过整合多源数据构建统一患者档案,提升对话真实性和行为多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22367 2026-03-25 cs.IR cs.AI 77%

Reasoner-Executor-Synthesizer: Scalable Agentic Architecture with Static O(1) Context Window

推理-执行-合成器:具有静态O(1)上下文窗口的可扩展代理架构

Ivan Dobrovolskyi

机构 * Walmart Global Tech(沃尔玛全球技术)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出RES架构,通过分离意图解析、确定性数据检索与叙事生成,实现O(1)的token复杂度,有效解决LLM代理中上下文窗口过大导致的幻觉风险和token成本问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21719 2026-03-24 cs.CL 77%

Probing How Scalable Table Data Enhances General Long-Context Reasoning

探究表格数据如何提升长上下文推理的可扩展性

Huaibing Xie, Guoliang Zhao, Yang Liu, Shihan Dou, Siming Huang, Yanling Xiao, Shaolei Wang, Yiting Liu, Cheng Zhang, Shaofan Liu, Pluto Zhou

机构 * Large Language Model Department, Tencent(腾讯大语言模型部门) Xi'an Jiaotong University, Xi'an, China(西安交通大学) Fudan University, Shanghai, China(复旦大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

AI总结 本文研究表格数据对长上下文推理的增强作用,通过分析表格依赖结构揭示周期性非消失依赖,并提出TableLong框架提升推理能力,实验显示在多个基准上提升8.24%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21663 2026-03-24 cs.CL 77%

TAMTRL: Teacher-Aligned Reward Reshaping for Multi-Turn Reinforcement Learning in Long-Context Compression

TAMTRL:教师对齐的奖励重塑用于长上下文压缩中的多轮强化学习

Li Wang, Yandong Wang, Xin Yu, Kui Zhang, Tianhao Peng, Wenjun Wu

机构 * School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, Beihang University(北京航空航天大学未来区块链与隐私计算先进创新中心)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对多轮强化学习中长上下文压缩的信用分配问题,TAMTRL通过教师信号对齐和自监督奖励分配提升记忆更新质量,实验显示其在多个基准测试中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21520 2026-03-24 cs.CL 77%

Generalizable Self-Evolving Memory for Automatic Prompt Optimization

通用可推广的自我进化记忆用于自动提示优化

Guanbao Liang, Yuanchen Bei, Sheng Zhou, Yuheng Qin, Huan Zhou, Bingxin Jia, Bin Li, Jiajun Bu

机构 * Zhejiang University(浙江大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Alibaba Group(阿里巴巴集团)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出MemAPO框架,通过双记忆机制积累可推广的提示经验,提升提示优化的泛化能力和持续改进能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18173 2026-03-24 cs.CL 77%

Moneyball with LLMs: Analyzing Tabular Summarization in Sports Narratives

Moneyball with LLMs: 分析体育叙事中的表格摘要

Ritam Upadhyay, Naman Ahuja, Rishabh Baral, Aparna Garimella, Vivek Gupta

机构 * School of Computing and Augmented Intelligence, Arizona State University(计算与增强智能学院,亚利桑那州立大学) Adobe Research, India(印度Adobe研究)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过SPORTABSET基准测试,分析长上下文表格摘要中多实体记忆的瓶颈,揭示分解策略在多实体干扰下的表现及模型鲁棒性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏