arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 571 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 571 篇

2607.01047 2026-07-02 cs.CL 新提交 90%

Conversable Complexity: Agentic LLM Collectives as Interpretable Substrates

可对话的复杂性:作为可解释基质的智能体LLM集体

Elias Najarro, Ane Espeseth, Eleni Nisioti, Sebastian Risi, Stefano Nichele

机构 * IT University of Copenhagen(哥本哈根信息技术大学) University of Oslo(奥斯陆大学) Østfold University of Applied Sciences(东福尔应用科学大学) Sakana AI

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出将智能体大语言模型集体作为人工生命研究的计算基质,利用自然语言通信实现可解释性,并综述了相关实例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00368 2026-07-02 cs.CL 新提交 90%

Beyond Perplexity: A Behavioral Evaluation Framework for Deployment-Memory Claims in LLM Test-Time Training

超越困惑度:面向LLM测试时训练中部署记忆声称的行为评估框架

Xiangchen Song, Zhenhao Chen, Lingjing Kong, Shaoan Xie, Xinshuai Dong, Guangyi Chen, Kun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出行为评估框架,通过证据阶梯和显式记忆基线校准LLM测试时训练的记忆声称,揭示代理指标与部署行为之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31145 2026-07-01 cs.CL 新提交 90%

SeKV: Resolution-Adaptive KV Cache with Hierarchical Semantic Memory for Long-Context LLM Inference

SeKV:面向长上下文LLM推理的分辨率自适应KV缓存与层次化语义记忆

Amirhossein Abaskohi, Giuseppe Carenini, Peter West, Yuhang He

机构 * University of British Columbia(不列颠哥伦比亚大学) Microsoft Research(微软研究院)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出SeKV,一种分辨率自适应的语义KV缓存方法,通过熵引导的语义片段和GPU-CPU层次化存储,在不丢弃信息的情况下实现按需token级重建,平均性能提升5.9%,GPU内存减少53.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25161 2026-06-25 cs.AI 新提交 90%

TRUSTMEM: Learning Trustworthy Memory Consolidation for LLM Agents with Long-Term Memory

TRUSTMEM:学习具有长期记忆的LLM智能体的可信记忆巩固

Tianyu Yang, Sudipta Paul, Vijay Srinivasan, Vivek Kulkarni, Srinivas Chappidi

机构 * AI Center-Mountain View, Samsung Electronics(三星电子山景城AI中心) University of Notre Dame(圣母大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出TrustMem框架,通过记忆转换验证器评估更新过程,并利用偏好强化学习优化记忆更新行为,显著提升记忆效用和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24535 2026-06-24 cs.AI 新提交 90%

Governed Shared Memory for Multi-Agent LLM Systems

面向多智能体LLM系统的受控共享内存

Yanki Margalit, Nurit Cohen-Inger, Erni Avram, Ran Taig, Oded Margalit

机构 * Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 本文形式化多智能体LLM系统的舰队内存问题,提出四种故障模式,并设计显式系统级原语(范围检索、时间替代、溯源追踪、策略控制传播)在MemClaw中实现,通过ArgusFleet评估,发现长上下文检索不足以满足生产需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23075 2026-06-23 cs.CR cs.AI 新提交 90%

Safety in Self-Evolving LLM Agent Systems: Threats, Amplification, and Case Studies

自进化LLM智能体系统中的安全性:威胁、放大与案例研究

Ruixiao Lin, Xinhao Deng, Qingming Li, Jianan Ma, Yunhao Feng, Yuqi Qing, Zhenyuan Li, Yechao Zhang, Shiwen Cui, Changhua Meng, Tianwei Zhang, Xingjun Ma, Qi Li, Ke Xu, Shouling Ji

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Tsinghua University(清华大学) Hangzhou Dianzi University(杭州电子科技大学) Nanyang Technological University(南洋理工大学) Fudan University(复旦大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 本文系统分析自进化LLM智能体系统的安全威胁,提出模块-生命周期攻击面矩阵,揭示17个关键威胁和7种跨模块放大效应,并通过案例证明进化设计激活3.5倍攻击面且静态防御失效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22528 2026-06-23 cs.AI 新提交 90%

Governance Decay: How Context Compaction Silently Erases Safety Constraints in Long-Horizon LLM Agents

治理衰减:上下文压缩如何悄然消除长周期LLM智能体中的安全约束

Shiyang Chen

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 研究发现LLM智能体的上下文压缩机制会无意中移除安全约束,导致违规行为;提出ConstraintRot基准和Constraint Pinning缓解方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15874 2026-06-23 cs.AI cs.SE 新提交 90%

LLM-as-Code: Agentic Programming for Agent Harness

LLM即代码:面向Agent框架的编程范式

Junjia Qi, Zichuan Fu, Jingtong Gao, Wenlin Zhang, Hanyu Yan, Xian Wu, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) Tencent Jarvis Lab(腾讯贾维斯实验室)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 针对LLM作为编排器导致控制流幻觉和不可靠执行的问题,提出Agentic Programming范式,由程序控制所有流程,LLM仅作为代码组件在需要推理或生成时被调用,显著提升长序列操作的稳定性。

Comments Accepted at the KDD 2026 Workshop on Agentic Software Engineering (AgenticSE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13681 2026-06-18 cs.CL 新提交 90%

EvoArena: Tracking Memory Evolution for Robust LLM Agents in Dynamic Environments

EvoArena: 追踪记忆演化以构建动态环境中的鲁棒LLM智能体

Jundong Xu, Qingchuan Li, Jiaying Wu, Yihuai Lan, Shuyue Stella Li, Huichi Zhou, Bowen Jiang, Lei Wang, Jun Wang, Anh Tuan Luu, Caiming Xiong, Hae Won Park, Bryan Hooi, Zhiyuan Hu

机构 * National University of Singapore(新加坡国立大学) Singapore Management University(新加坡管理大学) University of Washington(华盛顿大学) University College London(伦敦大学学院) University of Pennsylvania(宾夕法尼亚大学) Nanyang Technological University(南洋理工大学) Recursive Massachusetts Institute of Technology(麻省理工学院)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出EvoArena基准套件模拟终端、软件和社交领域的渐进环境变化,并设计基于补丁的记忆范式EvoMem记录结构化更新历史,使智能体能通过记忆变化推理环境演化,实验表明当前智能体在动态环境中表现不佳,EvoMem可稳定提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14805 2026-06-16 cs.SE cs.AI 新提交 90%

Knowledge-Based Zero-Replay Debugging of Multi-Agent LLM Traces

基于知识的无重放多智能体LLM轨迹调试

Dong Ho Kang, Hyeonjeong Cha, Daein Weon

机构 * ustechlab.com(ustechlab)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种知识图谱驱动的无重放预测方法,通过结构化事件知识图谱和轻量级预测器,在不执行重放的情况下定位高影响事件,将轨迹定位召回率从0.73提升至0.93。

Comments 21 pages, 1 figure, 6 tables. Submitted to Knowledge-Based Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14589 2026-06-15 cs.SE cs.AI cs.DC 新提交 90%

When Errors Become Narratives: A Longitudinal Taxonomy of Silent Failures in a Production LLM Agent Runtime

当错误成为叙事:生产级LLM Agent运行时中静默故障的纵向分类

Wei Wu

机构 * Independent researcher(独立研究者)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 通过八周对生产级个人助手Agent运行时的研究,识别出28次静默故障,提出五类机制导向分类,其中D类(链式幻觉与捏造)为LLM特有且最危险,系统会生成流畅可信的虚假叙事。

Comments 18 pages, 5 figures, 2 tables. 22 incident postmortems and all defense-framework artifacts publicly available at https://github.com/bisdom-cell/openclaw-model-bridge; governance engine on PyPI (openclaw-ontology-engine)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14445 2026-06-15 cs.SE cs.AI cs.HC 新提交 90%

tap: A File-Based Protocol for Heterogeneous LLM Agent Collaboration

tap:一种用于异构LLM智能体协作的基于文件的协议

Minseo Kim

机构 * HUA Labs(HUA实验室)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 提出tap协议,通过文件优先设计实现不同厂商LLM智能体(如Claude和Codex)在共享代码库上的协作,无需共享内存或相同运行时,实验表明异构模型对审查缺陷发现率更高。

Comments Accepted to KCC 2026. English archival translation. 3 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10532 2026-06-10 cs.AI 新提交 90%

ActiveMem: Distributed Active Memory for Long-Horizon LLM Reasoning

ActiveMem: 用于长程LLM推理的分布式主动记忆

Yunhan Jiang, Wenbin Duan, Shasha Guo, Liang Pang, Xiaoqian Sun, Huawei Shen

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出ActiveMem框架,将记忆从核心推理中解耦,通过分布式主动记忆系统积累语义要点,在长程推理任务中实现高精度和低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24322 2026-06-24 cs.CR 新提交 90%

Securing LLM-Agent Long-Term Memory Against Poisoning: Non-Malleable, Origin-Bound Authority with Machine-Checked Guarantees

保护LLM智能体长期记忆免受投毒:具有机器验证保证的不可延展、源绑定权限

Yedidel Louck

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 针对LLM智能体长期记忆投毒攻击,提出不可延展信息流控制(IFC)方案TMA-NM,通过源绑定和防Sybil确认门控实现0%攻击成功率。

Comments Index Terms: LLM agents, long-term memory, memory poisoning, information-flow control, capability security, prompt injection, formal verification, benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26490 2026-07-30 cs.AI cs.LG cs.NE 新提交 90%

EvoPINN: Agentic Discovery of Executable Algorithms for Physics-Informed Neural Networks

EvoPINN:面向物理信息神经网络可执行算法的智能体式发现框架

Peng Yin, Kai Li, Yifan Zhang, Jian Cheng

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉科学学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 EvoPINN是智能体式框架,将PINN开发转化为基于执行的算法发现,通过LLM智能体迭代优化,自主发明SLRC-PINN,可显著降低PDE求解的相对L₂误差,为科学计算提供新机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12195 2026-07-15 cs.CL cs.AI 新提交 90%

Comparing Semantic Navigation in Humans and Large Language Models using Natural Language Processing

使用自然语言处理比较人类和大语言模型中的语义导航

Gabriel Paris-Colombo, Rodrigo M. Cabral-Carvalho, Felipe D. Toro-Hernández

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 该研究通过语言流畅性数据,运用基于轨迹的自然语言处理指标,比较人类与三个大语言模型的语义搜索动态,量化相关维度,发现人类语义搜索在局部利用和全局探索间有独特平衡,当前模型架构无法重现。

Comments Cogsci paper 2026

Journal ref Proceedings of the Annual Meeting of the Cognitive Science Society, 48(0), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13962 2026-08-17 cs.AR 新提交 89%

MoE Expert Execution in Disaggregated LLM Serving with a High-Bandwidth ReRAM Near-Memory Architecture

采用高带宽ReRAM近内存架构的分散式大语言模型(LLM)服务中的MoE专家执行

Kunming Shao, Ming Zeng, Xin Yuan, Binbin Liao, Yangming Zhang, Wei Wang, Tim Kwang-Ting Cheng, Chi-Ying Tsui

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 本文针对分散式LLM服务中MoE专家执行的资源效率问题,提出ReRAM近内存架构,通过优化池化、放置与取数策略提升资源占用率,在实测中大幅降低延迟与能耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27187 2026-07-30 cs.PF 新提交 89%

A Photonic-CXL Memory Appliance for Scalable KV Cache Management in LLM Inference

用于LLM推理中可扩展KV缓存管理的光子-CXL存储设备

Jing Ding, Yash Nishant, Chandrish Ambati, Jyothsna Kamati, Trung Diep

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 该研究针对LLM推理的存储墙问题,提出Marvell光子-CXL混合存储设备,实现32 TB共享内存,延迟降超50%,多轮对话首token时间提升6.6倍,解决了电气CXL池的部署痛点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06273 2026-07-08 cs.SE 新提交 89%

AgentTether: Graph-Guided Diagnosis and Runtime Intervention for Reliable LLM Agent Operation

AgentTether:用于可靠大语言模型代理操作的图引导诊断与运行时干预

Chenyu Zhao, Shenglin Zhang, Wenwei Gu, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM代理生产可靠性有限问题,提出AgentTether运行时修复框架,通过抽象运行、构建关键转换图等定位故障子轨迹并转换为指导,经实验评估,该框架能提高修复效果,减少资源消耗,为代理部署提供实用可靠性层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26883 2026-07-01 cs.DL 新提交 89%

EconSimulacra: A Digital Twin Platform of Socio-Economic Systems Powered by LLM Agents

EconSimulacra:基于LLM代理的社会经济系统数字孪生平台

Ryuji Hashimoto, Masahiro Kaneko, Kentaro Ueda, Takehiro Takayanagi, Kiyoshi Izumi

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出EconSimulacra,一种通过共享内部状态机制耦合消费经济、移动性和社交网络的多智能体模拟器,使代理能产生跨领域一致行为,并复现线上关注与线下流行度的非线性关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23752 2026-06-24 cs.SE 新提交 89%

ESAA-Conversational: An Event-Sourced Memory Layer for Continuity, Handoff, and Curation Across Heterogeneous LLM Coding Agents

ESAA-Conversational:一种用于异构LLM编码智能体之间连续性、交接和策管的事件溯源记忆层

Elzo Brito dos Santos Filho

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出ESAA-Conversational架构,通过事件溯源实现跨多个LLM编码智能体的共享会话记忆,解决会话状态漂移问题,支持连续性、交接和策管。

Comments 11 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15229 2026-06-16 cs.CR 新提交 89%

LLM: LSTM Look-Ahead Moving Target Defense Based on Historical Malicious Scan

LLM:基于历史恶意扫描的LSTM前瞻移动目标防御

Yu Li

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出LLM方法,利用LSTM网络预测攻击者可能扫描的目标地址,结合集成学习和动态变异机制,提升IP shuffling的安全性和降低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14779 2026-06-16 cs.AR 新提交 89%

Unified KV Pooling to Accelerate Long-Context LLM Serving

统一KV池化以加速长上下文LLM服务

Minchul Kang, Changyong Shin, Jinwoo Jeong, Jaerim Park, Woohyun Kim, Bonyul Gu, Dongwoo Kang, Gyeongsik Yang, Chuck Yoo

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 针对长上下文LLM服务中KV缓存卸载到主机内存和SSD时的高延迟问题,提出统一KV池化方法,聚合多设备并绕过内核文件系统,实现TTFT降低约4.1倍。

Comments 7 pages, 12 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12142 2026-06-11 cs.RO cs.CV 新提交 89%

AerialClaw: An Open-Source Framework for LLM-Driven Autonomous Aerial Agents

AerialClaw:一个用于LLM驱动的自主空中智能体的开源框架

Ke Li, Jianfei Yang, Luyao Zhang, Guo Yu, Chengwei Yan, Yuan Ding, Di Wang, Nan Luo, Gang Liu, Xiao Gao, Quan Wang

机构 * Xidian University(西安电子科技大学) Xi'an University of Architecture and Technology(西安建筑科技大学)

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出AerialClaw开源框架,采用模块化脑-技能-运行时架构,使基于LLM的智能体能够理解自然语言任务、调用空中技能、闭环决策,提升无人机系统的灵活性、可复现性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03003 2026-07-07 cs.CL 新提交 89%

psytechlab at CLPsych 2026: Utilising Natural Language Processing methods and Large Language Models for Social Media Text Analysis

CLPsych 2026 中的心理技术实验室:利用自然语言处理方法和大语言模型进行社交媒体文本分析

Igor Buyanov, Nafisa Valieva, Ekaterina Mazurina

机构 * psytechlab(心理技术实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.CL

AI总结 在 CLPsych 2026 共享任务中,利用自然语言处理方法和大语言模型对社交媒体文本进行自我状态和幸福感分析与总结,为改进心理健康支持系统做贡献。

Comments Accepted by CLPsych2026. CLPsych 2026 will be held at ACL in San Diego July 4th, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02560 2026-08-04 cs.LG cs.AI cs.IR 新提交 89%

Structured Memory for Edge Language Models: Persistent Context and Corpus Retrieval via O(1) SSM State Injection

边缘语言模型的结构化记忆:通过O(1) SSM状态注入实现持久上下文与语料库检索

Anusha Madan Gopal, Aras Pirbadian, Kristofor D. Carlson, M Anthony Lewis, Jonathan Tapson

机构 * BrainChip Inc.(BrainChip公司)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究针对边缘语言模型提出PRECOG与SMC机制,将SSM预填充成本压缩至O(1),在1.2B参数的TENNs-LLM上实现约4500倍预填充加速,达到与RAG相当的答案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08340 2026-06-09 cs.AI cs.LG cs.MA 新提交 89%

Benchmarking Open-Ended Multi-Agent Coordination in Language Agents

开放式多智能体协作在语言智能体中的基准测试

Kale-ab Abebe Tessera, Andras Szecsenyi, Cameron Barker, Alexander Rutherford, Davide Paglieri, Aidan Scannell, Henry Gouk, Elliot J. Crowley, Tim Rocktäschel, Amos Storkey

机构 * University of Edinburgh(爱丁堡大学) University of Oxford(牛津大学) University College London(伦敦大学学院)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);language agent(title);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出基于JAX的开放式多智能体协作基准Alem,评估13种现代LLM在长时生存世界中的零样本协作能力,发现协调能力是前沿LLM智能体的独立瓶颈。

Comments 42 pages, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07387 2026-07-09 cs.MA cs.SI physics.soc-ph 新提交 89%

A Large Language Model-Driven Agent-Based Modeling Framework with Multi-Round Communication for Simulating Vaccine Opinion Dynamics

一种用于模拟疫苗舆论动态的基于多轮通信的大语言模型驱动的基于代理的建模框架

Bo Zhang, Na Jiang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 该研究引入大语言模型(Qwen3-8B)集成到基于代理的建模框架,以疫苗接种舆论动态为例,通过启用不同认知模块模拟舆论动态,发现不同模块对突发舆论有相反影响,再现了社会影响的非线性行为模式,证明框架有效性和潜力。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02716 2026-07-07 cs.MA 新提交 89%

Evaluating Large Language Models for Decision-Making in Agent-Based Urban Mobility Simulations

在基于代理的城市交通模拟中评估用于决策的大语言模型

Bruno Cascaes Alves, Míriam Blank Born, Ulisses Gilioli Francescatto Júnior, Felipe Moura Goulart, Letícia Brandão Caldas, Marilton Sanchotene de Aguiar

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 研究在多智能体模拟中集成大语言模型作为决策组件,提出混合架构,通过API连接GAMA平台与外部基于大语言模型的模块,能指导智能体重规划行为,比较不同场景下效果,显示其可丰富行为表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03420 2026-08-05 cs.AI 新提交 89%

Towards Improving Sequential Decision-Making in LLM Agents via Experience Memory

基于经验记忆提升大语言模型智能体的序列决策能力

Jakub Rada, Viliam Lisý

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究针对LLM智能体序列决策性能不足的问题,提出带经验记忆的智能体框架,通过对局后反思与规则提取,在不修改模型权重的情况下提升了井字棋任务的表现。

Comments 8 pages, 6 figures, 14 tables, 5 appendices, accepted at Neuro-Symbolic Intelligence for LLMs and Autonomous Agents workshop at IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏