arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4746 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4746 篇

2509.03736 2026-05-11 cs.AI cs.CL cs.LG 67%

Are LLM Agents Behaviorally Coherent? Latent Profiles for Social Simulation

LLM代理行为是否一致?用于社交模拟的潜在特征

James Mooney, Josef Woldense, Zheng Robert Jia, Shirley Anugrah Hayati, My Ha Nguyen, Vipul Raheja, Dongyeop Kang

机构 * Department of Computer Science and Engineering, University of Minnesota(明尼苏达大学计算机科学与工程系) Department of African American & African Studies, University of Minnesota(明尼苏达大学非裔美国人与非洲研究系) Department of Sociology, University of Chicago(芝加哥大学社会学系)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文研究LLM代理在不同实验环境下是否保持经验一致性,通过揭示代理的潜在特征来检验其行为一致性,发现不同模型家族和大小的LLM存在显著不一致。

Comments 25 pages, 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27045 2026-05-01 cs.LG cs.AI cs.CL 67%

Detecting Clinical Discrepancies in Health Coaching Agents: A Dual-Stream Memory and Reconciliation Architecture

在健康教练代理中检测临床差异:一种双流记忆与协调架构

Samuel L Pugh, Eric Yang, Alexander Muir Sutherland, Alessandra Breschi

机构 * Verily Health Inc(Verily健康公司)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出双流记忆与协调架构,用于检测健康教练代理中的临床差异,通过验证患者报告与临床记录以确保安全部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25325 2026-04-29 cs.SE cs.AI cs.CL 67%

R$^3$-SQL: Ranking Reward and Resampling for Text-to-SQL

R³-SQL:基于排名奖励和重采样的文本到SQL

Hojae Han, Yeonseok Jeong, Seung-won Hwang, Zhewei Yao, Yuxiong He

机构 * ETRI(电子科技大学) Seoul National University(首尔国立大学) Snowflake AI Research(Snowflake人工智能研究)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 R³-SQL通过统一奖励和重采样解决文本到SQL中排名不一致和正确SQL缺失的问题,提升了执行准确率。

Comments Accepted by Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15393 2026-04-20 quant-ph 67%

Projected Dynamic Programming for Sequential Quantum State Discrimination

投影动态规划用于顺序量子态辨识

Jaehun Jeong, Donghwa Ji, Hyunjun Jang, Kabgyun Jeong

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)

AI总结 本文将顺序量子态辨识问题建模为静态隐藏状态部分可观测马尔可夫决策过程,通过网格离散化连续信念单纯形并分析误差和计算复杂性,验证了量子领域中的精度与复杂性权衡及维度诅咒。

Comments 54 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07248 2026-04-15 cs.MA cs.HC 67%

DarwinTOD: LLM-driven Lifelong Self-evolution for Task-oriented Dialog Systems

DarwinTOD: 基于LLM的持续自我进化任务导向对话系统

Shuyu Zhang, Yujie Liu, Xinru Wang, Cheng Zhang, Yanmin Zhu, Bin Li

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 DarwinTOD通过整合进化计算与LLM驱动的自我改进,提出一种持续自我进化对话框架,实现零样本基础下的持续策略优化,无需任务特定微调。

Comments Accepted in ACL2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11563 2026-04-14 cs.CL cs.AI cs.LG 67%

Synthius-Mem: Brain-Inspired Hallucination-Resistant Persona Memory Achieving 94.4% Memory Accuracy and 99.6% Adversarial Robustness on LoCoMo

Synthius-Mem: 基于大脑启发的hallucination抵抗性人格记忆实现94.4%的记忆准确率和99.6%的对抗鲁棒性于LoCoMo

Artem Gadzhiev, Andrew Kislov

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Synthius-Mem通过结构化人格记忆系统在LoCoMo基准上实现94.4%的记忆准确率和99.6%的对抗鲁棒性,优于现有系统并超越人类表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10722 2026-04-13 q-bio.NC cs.NE 67%

Bridging Brains and Machines: A Unified Frontier in Neuroscience, Artificial Intelligence, and Neuromorphic Systems

连接大脑与机器:神经科学、人工智能与神经形态系统的统一前沿

Sohan Shankar, Yi Pan, Hanqi Jiang, Zhengliang Liu, Mohammad R. Darbandi, Agustin Lorenzo, Junhao Chen, Weihang You, Md Mehedi Hasan, Arif Hassan Zidan, Eliana Gelman, Joshua A. Konfrst, Jillian Y. Russell, Katelyn Fernandes, Tianze Yang, Yiwei Li, Huaqin Zhao, Afrar Jahin, Triparna Ganguly, Shair Dinesha, Yifan Zhou, Zihao Wu, Xinliang Li, Lokesh Adusumilli, Aziza Hussein, Sagar Nookarapu, Jixin Hou, Kun Jiang, Jiaxi Li, Brenden Heinel, XianShen Xi, Hailey Hubbard, Zayna Khan, Levi Whitaker, Ivan Cao, Max Allgaier, Andrew Darby, Lin Zhao, Lu Zhang, Xiaoqiao Wang, Xiang Li, Wei Zhang, Xiaowei Yu, Dajiang Zhu, Yohannes Abate, Tianming Liu

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 本文探讨神经科学、通用人工智能与神经形态计算的融合,提出基于脑生理学的框架,总结了突触可塑性、稀疏脉冲通信和多模态关联在下一代AGI系统中的应用,并讨论了突破冯·诺依曼瓶颈的物理子系统及四个关键挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05131 2026-04-08 cs.MA cs.SY eess.SY 67%

Nash Approximation Gap in Truncated Infinite-horizon Partially Observable Markov Games

截断无限 horizon 部分可观测马尔可夫游戏中的纳什近似间隙

Lan Sang, Chinmay Maheshwari

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 本文提出一种有限记忆截断框架,将无限 horizon 部分可观测马尔可夫游戏近似为有限状态和动作的马尔可夫游戏,证明截断游戏的纳什均衡是原游戏的ε-纳什均衡,ε随截断长度增加而趋近于零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03997 2026-04-07 cs.DC cs.MA 67%

Ledger-State Stigmergy: A Formal Framework for Indirect Coordination Grounded in Distributed Ledger State

账本-状态斯蒂格玛:一种基于分布式账本状态的间接协调形式化框架

Fernando Paredes García

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于账本状态的间接协调框架,通过状态转换形式化方法,识别三种常见链上协调模式及Commit-Reveal序列叠加,提供可重用的词汇和设计指导。

Comments 15 pages, 1 figure. Also archived at Zenodo DOI: 10.5281/zenodo.19425884. Companion foundations preprint DOI: 10.5281/zenodo.19199497

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20660 2026-03-30 cs.LG cs.AI cs.SE 67%

The Dual-State Architecture for Reliable LLM Agents

双状态架构用于可靠的LLM代理

Matthew Thompson

机构 * Independent Researcher(独立研究者)

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文提出双状态动作对DSAP,通过结合随机生成与确定性后置条件验证,提升LLM代理在软件工程中的可靠性,实验表明在1.2-2.1倍基准成本下可靠性提升达66个百分点。

Comments 18 pages, 2 figures, 5 tables. V2 extends and supersedes V1, introducing tri-state guard semantics, a three-level recovery hierarchy, and SWE-Bench boundary analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24632 2026-03-25 cs.HC 67%

ReflectEd: Evaluating Reflection-Driven Learning in an AI-Assisted System

ReflectEd:在AI辅助系统中评估基于反思的学习

Md Nazmus Sakib, Ishika Tarin, Naga Manogna Rayasam, Manas Gaur, Sanorita Dey

专题命中 记忆与上下文管理 :planning(abstract);workflow(abstract)

AI总结 本文提出ReflectEd系统,通过理论驱动提示和机制支撑,评估反思驱动学习在协作环境中的效果,发现深度反思提升行动力但增加工作负担。

Comments Accepted at the 27th International Conference on Artificial Intelligence in Education (AIED 2026). The final authenticated version will appear in Springer LNAI/LNCS proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12971 2026-03-17 cs.HC 67%

Generative Horcrux: Designing AI Carriers for Afterlife Selves

生成霍克鲁克斯:为永生自我设计AI载体

Zhen-Chi Lai, Yu-Ting Cheng, Pei-Ying Lin, Chiao-Wei Ho, Janet Yi-Ching Huang

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract)

AI总结 本文探讨生成AI时代数字遗产的载体设计,通过工作坊探索AI代理如何重构记忆与身份,推动人机交互与AI伦理研究。

Comments 6 pages

Journal ref Proceedings of IASDR 2025: Design Next

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03290 2026-03-05 cs.CL cs.AI cs.IR cs.LG 67%

AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents

AriadneMem: 为LLM代理梳理终身记忆的迷宫

Wenhui Zhu, Xiwen Chen, Zhipeng Wang, Jingjing Wang, Xuanzhao Dong, Minzhou Huang, Rui Cai, Hejian Sang, Hao Wang, Peijie Qiu, Yueyue Deng, Prayag Tiwari, Brendan Hogan Rappazzo, Yalin Wang

机构 * Arizona State University(亚利桑那州立大学) Morgan Stanley(摩根大通) Rice University(里奇大学) Clemson University(克莱姆森大学) Northwestern University(西北大学) UC Davis(加州大学戴维斯分校) Iowa State University(爱荷华州立大学) Washington University in St. Louis(圣路易斯华盛顿大学) Columbia University(哥伦比亚大学) Halmstad University(哈马格大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 AriadneMem通过解耦的两阶段流程提升LLM代理在长期对话中的多跳和平均F1表现,同时减少运行时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23174 2026-02-27 cs.GT 67%

Approximately Solving Continuous-Time Mean Field Games with Finite State Spaces

近似求解具有有限状态空间的连续时间均场博弈

Yannick Eich, Christian Fabian, Kai Cui, Heinz Koeppl

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于正则化方法的近似算法,用于求解具有有限状态空间的连续时间均场博弈问题,通过扩展固定点迭代和假想玩法规则,提高了计算效率和实用性。

Comments To be published in ACC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14457 2026-02-17 cs.AI cs.CL cs.CV cs.CY cs.LG 67%

Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5

实践中的前沿AI风险管理框架:一项风险分析技术报告v1.5

Dongrui Liu, Yi Yu, Jie Zhang, Guanxu Chen, Qihao Lin, Hanxi Zhu, Lige Huang, Yijin Zhou, Peng Wang, Shuai Shao, Boxuan Zhang, Zicheng Liu, Jingwei Sun, Yu Li, Yuejin Xie, Jiaxuan Guo, Jia Xu, Chaochao Lu, Bowen Zhou, Xia Hu, Jing Shao

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出实践中的前沿AI风险管理框架,评估五个关键风险维度并提出缓解策略,为安全部署前沿AI提供技术路径。

Comments 49 pages, 17 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02594 2026-02-06 cs.LG cs.AI cs.SE 67%

SMARLA: A Safety Monitoring Approach for Deep Reinforcement Learning Agents

SMARLA:一种用于深度强化学习智能体的安全监控方法

Amirhossein Zolfagharian, Manel Abdellatif, Lionel C. Briand, Ramesh S

机构 * School of Electrical Engineering and Computer Science (EECS), University of Ottawa(电气工程与计算机科学系,渥太华大学) Software and Information Technology Engineering Department, École de Technologie Supérieure(软件与信息技术工程系,高等技术学院) Lero SFI Research Center and University of Limerick(Lero SFI研究中心和利默里克大学) Department of Research and Development, General Motors(研发部,通用汽车)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 SMARLA是一种用于深度强化学习智能体的安全监控方法,通过状态抽象和Q值预测安全违规,实现早期检测与低假阳性率的平衡。

Journal ref in IEEE Transactions on Software Engineering, vol. 51, no. 01, pp. 82-105, Jan. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17019 2026-01-27 cs.DB cs.DC 67%

Context Lake: A System Class Defined by Decision Coherence

Context Lake:由决策一致性定义的系统类别

Xiaowei Jiang

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract)

AI总结 本文提出Context Lake作为必要系统类别,要求语义操作、事务一致性和操作边界限制,以解决多代理决策一致性问题。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14602 2026-01-22 cs.CV 67%

3D Space as a Scratchpad for Editable Text-to-Image Generation

3D空间作为可编辑的文本到图像生成的草稿纸

Oindrila Saha, Vojtech Krs, Radomir Mech, Subhransu Maji, Matheus Gadelha, Kevin Blackburn-Matzen

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Adobe Research(Adobe研究)

专题命中 记忆与上下文管理 :planning(abstract);agentic(abstract)

AI总结 本文提出一种基于3D空间推理的文本到图像生成方法,通过可编辑的3D网格实现空间一致性,提升图像生成的精度和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11750 2026-01-21 cs.HC 67%

Opportunities and Barriers for AI Feedback on Meeting Inclusion in Socioorganizational Teams

人工智能反馈在社会组织团队包容性中的机遇与障碍

Mo Houtti, Moyan Zhou, Daniel Runningen, Surabhi Sunil, Leor Porat, Harmanpreet Kaur, Loren Terveen, Stevie Chancellor

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract)

AI总结 本文提出一种AI代理辅助的反馈交流系统,通过诱导虚伪程序改善会议包容性,但发现组织障碍影响其实际应用效果。

Comments To appear in Proceedings of the CHI Conference on Human Factors in Computing Systems (CHI '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07492 2026-01-13 math.OC stat.ML 67%

Online Markov Decision Processes with Terminal Law Constraints

在线马尔可夫决策过程与终端律约束

Bianca Marin Moreno, Margaux Brégère, Pierre Gaillard, Nadia Oudjane

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 本文提出无重置的周期性框架,旨在通过周期性策略在动态未知的在线场景中实现非渐近保证的最优学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03875 2026-01-08 eess.IV cs.CV 67%

Staged Voxel-Level Deep Reinforcement Learning for 3D Medical Image Segmentation with Noisy Annotations

分阶段体素级深度强化学习用于带有噪声标注的3D医学图像分割

Yuyang Fu, Xiuzhen Guo, Ji Shi

机构 * the Academy for Multidisciplinary Studies, Beijing National Center for Applied Mathematic(多学科研究学院,北京应用数学中心) Capital Normal University(首都师范大学)

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出分阶段体素级深度强化学习框架,通过动态迭代更新策略和新颖的强化学习方法,在噪声标注条件下提升医学图像分割的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23747 2026-01-01 cs.SE cs.AI cs.CL 67%

State-of-the-art Small Language Coder Model: Mify-Coder

最先进的小型语言编码器模型:Mify-Coder

Abhinav Parmar, Abhisek Panigrahi, Abhishek Kumar Dwivedi, Abhishek Bhattacharya, Adarsh Ramachandra, Aditya Choudhary, Aditya Garg, Aditya Raj, Alankrit Bhatt, Alpesh Yadav, Anant Vishnu, Ananthu Pillai, Ankush Kumar, Aryan Patnaik, Aswatha Narayanan S, Avanish Raj Singh, Bhavya Shree Gadda, Brijesh Pankajbhai Kachhadiya, Buggala Jahnavi, Chidurala Nithin Krishna, Chintan Shah, Chunduru Akshaya, Debarshi Banerjee, Debrup Dey, Deepa R., Deepika B G, Faiz ur Rahman, Gagan Gayari, Gudhi Jagadeesh Kumar Naidu, Gursimar Singh, Harshal Tyagi, Harshini K, James Mani Vathalloor, Jayarama Nettar, Jayashree Gajjam, Joe Walter Sugil George, Kamalakara Sri Krishna Tadepalli, Kamalkumar Rathinasamy, Karan Chaurasia, Karthikeyan S, Kashish Arora, Kaushal Desai, Khushboo Buwade, Kiran Manjrekar, Malikireddy Venkata Sai Likhitha, Manjunath A, Mitali Mahavir Bedmutha, Mohammed Rafee Tarafdar, Nikhil Tiwari, Nikitha K Gigi, Pavan Ravikumar, Pendyala Swarnanjali, Piyush Anand, Prakash Chandrasekar, Prasanna Bhalchandra Gawade, Prasanth Sivan, Preeti Khurana, Priyanshi Babbar, Rajab Ali Mondal, Rajesh Kumar Vissapragada, Rajeshwari Ganesan, Rajeswari Koppisetti, Ramjee R., Ramkumar Thiruppathisamy, Rani G. S., S Reka, Samarth Gupta, Sandeep Reddy Kothakota, Sarathy K, Sathyanarayana Sampath Kumar, Saurabh Kumar, Shashank Khasare, Shenbaga Devi Venkatesh Kumar, Shiva Rama Krishna Parvatham, Shoeb Shaikh, Shrishanmathi A, Shubham Pathak, Sree Samhita Koppaka, Sreenivasa Raghavan K S, Sreeram Venkatasubramanian, Suprabha Desai Bojja, Swetha R, Syed Ahmed, Chinmai Harshitha Thota, Tushar Yadav, Veeravelly Kusumitha, V V S S Prasanth Patnaik, Vidya Sri Sesetti, Vijayakeerthi K, Vikram Raj Bakshi, Vinay K K, Vinoth Kumar Loganathan, Vipin Tiwari, Vivek Kumar Shrivastav, V Venkata Sri Datta Charan, Wasim Akhtar Khan

机构 * Infosys AI Research(英矽斯人工智能研究院) Mify Team(Mify团队)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 Mify-Coder通过高效训练策略和数据优化,在保持高准确性和安全性的同时,实现了比更大模型更优的代码生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19972 2025-12-24 cs.DC 67%

Rethinking Knowledge Distillation in Collaborative Machine Learning: Memory, Knowledge, and Their Interactions

重新思考协同机器学习中的知识蒸馏:记忆、知识及其交互

Pengchao Han, Xi Huang, Yi Fang, Guojun Han

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 本文重新审视协同机器学习中的知识蒸馏,探讨记忆与知识的交互作用,分析不同学习模式下的挑战与未来方向。

Comments Published in IEEE TNSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22657 2025-12-18 cs.CV cs.AI cs.CL cs.LG 67%

3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model

3DLLM-Mem: 长期空间-时间记忆用于具身3D大语言模型

Wenbo Hu, Yining Hong, Yanjun Wang, Leison Gao, Zibu Wei, Xingcheng Yao, Nanyun Peng, Yonatan Bitton, Idan Szpektor, Kai-Wei Chang

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 3DLLM-Mem通过引入动态内存管理和融合模型,提升LLMs在复杂3D环境中的长期空间-时间记忆推理与行动能力。

Comments demos at: https://3dllm-mem.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00268 2025-12-02 math.OC 67%

Exact Decentralized Optimization via Explicit $\ell_1$ Consensus Penalties

通过显式ℓ₁一致性惩罚实现精确去中心化优化

Hong Wang

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract)

AI总结 DP²G通过显式ℓ₁惩罚实现精确去中心化优化,兼具快速收敛与高效通信,适用于复合目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22609 2025-12-01 cs.CV cs.RO 67%

MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory

MG-Nav:基于稀疏空间记忆的双尺度视觉导航

Bo Wang, Jiehong Lin, Chenzhi Liu, Xinting Hu, Yifei Yu, Tianjia Liu, Zhongrui Wang, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)

AI总结 MG-Nav通过稀疏空间记忆图和VGGT-adapter模块实现双尺度视觉导航,结合全局规划与局部控制,实现零样本导航的高鲁棒性与高性能。

Comments 10pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22311 2025-12-01 cs.AI cond-mat.mes-hall cond-mat.soft cs.CL cs.LG 67%

Swarms of Large Language Model Agents for Protein Sequence Design with Experimental Validation

大规模语言模型代理群组用于蛋白质序列设计的实验验证

Fiona Y. Wang, Di Sheng Lee, David L. Kaplan, Markus J. Buehler

机构 * Laboratory for Atomistic and Molecular Mechanics (LAMM), Department of Biological Engineering, Massachusetts Institute of Technology(原子分子力学实验室(LAMM),生物工程系,麻省理工学院) Department of Biomedical Engineering, Tufts University(生物医学工程系,塔夫茨大学) Laboratory for Atomistic and Molecular Mechanics (LAMM), Department of Civil and Environmental Engineering, Department of Mechanical Engineering, Center for Computational Science and Engineering, Schwarzman College of Computing, Massachusetts Institute of Technology(原子分子力学实验室(LAMM),土木与环境工程系,机械工程系,计算科学与工程中心,计算机科学学院,麻省理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种基于大规模语言模型代理群组的蛋白质序列设计方法,通过去中心化协调实现高效目标导向设计,无需微调或特定训练,且在实验中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21730 2025-12-01 cs.CL cs.AI cs.LG 67%

A Benchmark for Procedural Memory Retrieval in Language Agents

一种用于语言代理中程序记忆检索的基准测试

Ishant Kohar, Aswanth Krishnan

机构 * Qpi AI

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种用于评估语言代理程序记忆检索能力的基准测试,通过构建双语料库和系统分层查询,揭示了基于嵌入的方法在新上下文中的泛化问题,并展示了LLM生成的程序抽象在跨上下文转移中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21726 2025-12-01 cs.CL cs.AI cs.LG 67%

Goal-Directed Search Outperforms Goal-Agnostic Memory Compression in Long-Context Memory Tasks

目标导向搜索在长上下文记忆任务中优于目标无关的记忆压缩

Yicong Zheng, Kevin L. McKee, Thomas Miconi, Zacharie Bugaud, Mick van Gelderen, Jed McCaleb

机构 * Astera Institute(Astera研究所)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SUMER通过目标导向搜索在长上下文记忆任务中超越传统记忆压缩方法,达到SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21037 2025-11-27 cs.HC 67%

LOOM: Personalized Learning Informed by Daily LLM Conversations Toward Long-Term Mastery via a Dynamic Learner Memory Graph

LOOM:通过动态学习者记忆图实现每日LLM对话指导的个性化学习以实现长期掌握

Justin Cui, Kevin Pu, Tovi Grossman

专题命中 记忆与上下文管理 :planning(abstract);agentic(abstract)

AI总结 LOOM通过动态学习者记忆图分析每日LLM对话,生成个性化学习材料以实现长期掌握,兼顾连续性和主动性,提升学习者持续进步与即时相关性的平衡。

Comments Accepted to the PerFM Workshop at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏