arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-23 至 2026-03-23 共收录 4 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4 篇

2603.19469 2026-03-23 cs.CR cs.AI 79%

A Framework for Formalizing LLM Agent Security

一个形式化大语言模型代理安全性的框架

Vincent Siu, Jingxuan He, Kyle Montgomery, Zhun Wang, Neil Gong, Chenguang Wang, Dawn Song

机构 * UC Santa Cruz(加州大学圣克ruz分校) UC Berkeley(加州大学伯克利分校) Duke University(杜克大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一个框架,从情境安全角度系统化现有攻击与防御,定义四个安全属性并引入Oracle函数验证,重新定义攻击和防御,为未来研究提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19935 2026-03-23 cs.LG 57%

Memori: A Persistent Memory Layer for Efficient, Context-Aware LLM Agents

Memori:一种高效的、基于上下文的LLM代理持久内存层

Luiz C. Borro, Luiz A. B. Macarini, Gordon Tindall, Michael Montero, Adam B. Struck

机构 * Memori Labs Inc.(Memori实验室)

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.LG

AI总结 Memori通过结构化表示替代大上下文窗口,实现高效、低成本的LLM代理部署,准确率达81.95%。

Comments 9 pages; 2 figures; white paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15693 2026-03-23 cs.AI 57%

Average Reward Reinforcement Learning for Omega-Regular and Mean-Payoff Objectives

用于Ω-正则和平均收益目标的平均收益强化学习

Milad Kazemi, Mateo Perez, Fabio Somenzi, Sadegh Soudjani, Ashutosh Trivedi, Alvaro Velasquez

机构 * King’s College London(伦敦大学国王学院) University of Colorado Boulder(科罗拉多大学波尔德分校) University of Birmingham, UK(英国伯明翰大学) MPI-SWS(马克斯·普朗克研究所(SWS))

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出首个无模型强化学习框架,将绝对活性规范转化为平均收益目标,支持未知通信马尔可夫决策过程的学习,且在无episodic重置情况下收敛。

Comments 29 pages

Journal ref Journal of Artificial Intelligence Research 85, Article 25(March 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.13426 2026-03-23 econ.GN q-fin.EC 50%

Arrow-Debreu Meets Kyle: Price Discovery Across Derivatives

阿罗-德布雷-凯尔模型:跨衍生品的价格发现

Christian Keller, Michael C. Tseng

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了在信息知情者拥有状态概率私有信息并交易状态依赖证券的模型中价格发现。该模型结合了阿罗-德布雷和凯尔的关键要素,当证券为期权时,知情者拥有标的资产收益分布的任意信息并交易期权组合。

详情

展开后加载摘要…

URL PDF HTML 收藏