arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4753 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4753 篇

2607.09385 2026-07-13 cs.DC cs.AI cs.PF 新提交 57%

STEEL: Sparsity-Aware Fused Attention for Energy-Efficient Long-Sequence Inference on AMD's XDNA NPU

STEEL:用于在AMD的XDNA NPU上进行节能长序列推理的稀疏感知融合注意力

Victor J. B. Jung, Gagandeep Singh, Joseph Melber, Kristof Denolf, Francesco Conti, Luca Benini

机构 * AMD Research and Advanced Development (RAD)(AMD研究与先进开发) Integrated Systems Laboratory (IIS)(集成系统实验室) ETH Zürich(苏黎世联邦理工学院) Department of Electrical, Electronic and Information Engineering (DEI)(电气电子信息工程系) University of Bologna(博洛尼亚大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 研究针对笔记本级SoC上节能推理,提出STEEL这一针对类似XDNA的NPU的FlashAttention开源实现,通过引入预填充注意力数据流公式化及稀疏感知流水线布局,降低能耗与延迟,相比CPU和GPU有显著性能提升。

Comments Accepted at IEEE COINS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08032 2026-07-10 cs.LG 新提交 57%

What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents

保留什么,遗忘什么:大语言模型和智能体中内存压缩的率失真视角

Ashwin Gerard Colaco, Nada Lahjouji

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 研究大语言模型和智能体内存压缩问题,提出基于率失真视角统一分类各层方法,构建七轴分类法并转移机制,还针对相关问题未被测量及缺乏统一基准的情况,转化为提案、实验、原则并梳理开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07847 2026-07-10 cs.LG 新提交 57%

When Does Continual Learning Require Learning

持续学习何时需要学习

Anne Harrington, Nayan Saxena, Michael Murphy, Anastasia Borovykh, Zeyu Yun, Sridhar Kamath, Ara Eindra Kyi, Trevor Darrell, Jitendra Malik, Yutong Bai

机构 * UC Berkeley(加州大学伯克利分校) Capital Fund Management(资本基金管理公司)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 研究大语言模型持续学习问题,从空间和时间轴分解变化,通过重新设置基准和引入协议评估多种方法,发现持续学习非单一能力,不同环境变化需不同更新行为,为设计更强持续学习系统提供指导。

Comments Code: https://github.com/anneharrington/studying-cl. Project page: https://anneharrington.github.io/studying-cl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02514 2026-07-10 cs.AI 新提交 57%

Distributed Attacks in Persistent-State AI Control

持久状态AI控制中的分布式攻击

Josh Hills, Ida Caspary, Asa Cooper Stickland

机构 * Constellation Astra Fellowship(Constellation Astra 奖学金) Imperial College London(帝国理工学院) UK AI Security Institute(英国人工智能安全研究所)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 研究AI编码代理在持久代码库中跨拉取请求分布攻击的威胁,提出Iterative VibeCoding基准,发现单一监控器无法同时防御渐进与非渐进攻击,而状态跟踪监控器可显著降低渐进攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18999 2026-07-10 cs.RO cs.AI cs.CV 版本更新 57%

OREN: Octree Residual Network for Real-Time Euclidean Signed Distance Mapping

OREN:八叉树残差网络用于实时欧几里得符号距离映射

Zhirui Dai, Qihao Qian, Tianxing Fan, Nikolay Atanasov

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电子与计算机工程系)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 OREN结合八叉树插值的显式先验和神经网络回归的隐式残差,实现高效且可微的非截断SDF重建,优于现有方法的准确性和效率。

Comments Accepted to IEEE/RSJ International Conference Intelligent Robots & Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07392 2026-07-09 cs.LG cs.IR cs.RO 版本更新 57%

Event-Centric World Modeling with Memory-Augmented Retrieval for Embodied Decision-Making

基于记忆增强检索的事件中心世界建模用于具身决策

Zhaowen Fan, Rongchao Zhang, Yunxiang Han

机构 * Zhaowen Fan(Fan 研究院) Rongchao Zhang(Zhang 实验室)

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.LG

AI总结 本文提出一种事件中心世界建模框架,通过记忆增强检索实现具身决策,结合语义事件和先前经验进行决策,提升动态环境的结构抽象与可解释性。

Comments 12 pages, 9 figures, 4 tables, currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20342 2026-07-08 cs.HC cs.AI cs.CY 版本更新 57%

Narrative-Centered Emotional Reflection: An Early Prototype for AI-Supported Emotional Self-Reflection

以叙事为中心的情感反思:人工智能支持的情感自我反思的早期原型

Shou-Tzu Han

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 该研究以Reflexion为早期原型,通过整合情感检测、分层反思提示和隐喻故事生成等方法,探索结构化情感自我反思,支持用户超越基本情感分类进行自主情感探索,记录了理论驱动的情感计算方向。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04562 2026-07-07 cs.AI cs.NE 新提交 57%

Heaviside Continuity of Rolling Coefficients for Eliminating Epistemic Entropy in Large Language Models

用于消除大语言模型认知熵的滚动系数的海维赛德连续性

MY Pitsane, Hope Mogale

机构 * North-West University, RSA(南非北开普大学) University of Pretoria, RSA(南非彼得里亚大学) Mankind Research Labs, Sandton(沙顿人类研究实验室)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 研究大语言模型输出难检测错误的问题,提出海维赛德连续性的滚动系数框架,将推理重新表述为谓词门控状态转换,结合模型置信度与并行验证信号,防止无效状态传播,降低认知熵。

Comments A First draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04089 2026-07-07 cs.AI 新提交 57%

PLACEMEM: Toward a Compute-Aware Memory Plane for Lifelong Agents

PLACEMEM:迈向用于终身智能体的计算感知内存平面

Sukanta Ganguly

机构 * NetApp

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 研究终身智能体的内存需求,提出PLACEMEM,以版本化胶囊表示智能体内存,介绍其在当前原型中的应用及特性,给出vLLM优先原型及基准测试工具,展示了成果与未来路线图。

Comments 6 pages, 3 Tables,. 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02689 2026-07-07 cs.CV cs.AI 新提交 57%

S-EMBER: A Large-Scale Benchmark for Streaming Egocentric Memory Retrieval

S-EMBER:用于流式自我中心记忆检索的大规模基准测试

Xiaodong Wang, Xuanyi Zhao, Pedro Rodriguez, Devendra Singh Sachan, Barlas Oguz, Seungwhan Moon, Shang-Wen Li, Gargi Ghosh, Xin Dong, Wen-Tau Yih

机构 * FAIR, Meta(公平研究院,元公司) Reality Labs, Meta(现实实验室,元公司)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 研究针对可穿戴设备连续第一人称记录下AI助手的情景记忆问题,引入S-EMBER基准测试,通过视频及问答对模拟真实交互,发现前沿模型存在定位矛盾,为可穿戴AI代理情景记忆发展奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01988 2026-07-03 cs.AI cs.RO 新提交 57%

Episodic-to-Semantic Consolidation Without Identity Drift

无身份漂移的情景到语义巩固

Xue Qin, Simin Luan, Cong Yang, Zhijun Li

机构 * School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 针对长期运行自适应智能体中知识巩固与身份完整性之间的张力,提出将巩固作为情景记忆上的确定性函数,输出可单独寻址的语义知识层,保持代理加密身份不变,实验证明平均减少79.82%无效规划尝试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01831 2026-07-03 cs.DC cs.LG 新提交 57%

Lynx: Progressive Speculative Quantization for accelerating KV Transfer in Long-Context Inference

Lynx: 渐进式推测量化加速长上下文推理中的KV传输

Wenchen Han, Gingfung Matthew Yeung, Marco Barletta, William Toner, Amory Hoste, Adam Barker

机构 * University College London(伦敦大学学院) Huawei(华为)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 针对长上下文推理中KV缓存传输延迟问题,提出Lynx系统,通过将KV缓存分为高优先级Anchor流和低优先级Residual流,实现渐进式传输和推测解码,在降低首令牌延迟的同时保持高精度。

Comments 15 pages, 12 figures. This manuscript was originally submitted to SIGCOMM '26 in February 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03315 2026-07-03 cs.AI 版本更新 57%

Memora: A Harmonic Memory Representation Balancing Abstraction and Specificity

Memora: 一种平衡抽象与特异性的和谐记忆表示

Menglin Xia, Xuchao Zhang, Shantanu Dixit, Paramaguru Harimurugan, Rujia Wang, Victor Ruhle, Robert Sim, Chetan Bansal, Saravan Rajmohan

机构 * Microsoft(微软)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出Memora记忆表示,通过主抽象和线索锚点平衡抽象与特异性,结合检索策略实现高效上下文感知检索,在LoCoMo和LongMemEval基准上达到新最优。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01131 2026-07-02 cs.CV cs.AI 新提交 57%

Autonomous Scientific Discovery via Iterative Meta-Reflection

通过迭代元反射实现自主科学发现

Bingchen Zhao, Sara Beery, Oisin Mac Aodha

机构 * University of Edinburgh(爱丁堡大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 记忆与上下文管理 :tool use(abstract);分类 cs.AI

AI总结 提出DiscoPER框架,利用大语言模型进行开放式的自主科学发现,通过动态代码生成、统计检验和二阶推理机制,在iNatDisco基准上以72.7%假设支持率恢复8/9已知模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00339 2026-07-02 cs.CL 新提交 57%

TRACE: State-Aware Query Processing over Temporal Evidence Graphs for Conversational Data

TRACE:面向对话数据的时间证据图状态感知查询处理

Maolin Wang, Yu Wang, Zichun Liu, Baiyuan Qiu, Chenbin Zhang, Jiguang Shen, Haoran Yang, Hao Miao

机构 * Hong Kong Institute of AI for Science, City University of Hong Kong(香港城市大学香港人工智能科学研究院) Independent Researcher(独立研究者) Central South University(中南大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.CL

AI总结 提出TRACE框架,通过构建时间证据图并维护有效性标注,实现对话数据中状态感知的查询处理,提升时间推理和多跳推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30296 2026-07-02 cs.AI 版本更新 57%

ManimAgent: Self-Evolving Multimodal Agents for Visual Education

ManimAgent: 用于视觉教育的自进化多模态智能体

Wenjia Jiang, Zongyuan Cai, Yuanhang Shao, Chenru Wang, Boyan Han, Zhixue Song, Keyu Chen, Shengwei An, Xu Yang, Zhou Yang

机构 * University of Alberta(阿尔伯塔大学) Southeast University(东南大学) Virginia Tech(弗吉尼亚理工学院) Xidian University(西安电子科技大学) Vivavia Inc(Vivavia公司)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出ManimAgent,通过双通道情节记忆库跨任务传递反思经验,无需权重更新或人工种子,在代码生成任务中提升通过率并减少反思轮次。

Comments Project page: https://manimagent.github.io/. Code: https://github.com/jwj1342/Paper2Manim

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30975 2026-07-01 cs.AI 新提交 57%

When Regulation Has Memory: Hysteresis and Control Burden in Artificial Agency

当调控具有记忆:人工智能体中的迟滞与控制负担

Veronique Ziegler

机构 * Independent Researcher(独立研究员)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 通过自适应不确定性调控模型,发现智能体调控增益形成可复现的迟滞环,且提前稳定化可降低控制需求,表明评估智能体需考虑调控负担而非仅状态稳定性。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30449 2026-06-30 cs.LG 57%

Internal-State Probes Read the Situation, Not the Action: Three Negative Results for Pre-Action Misalignment Monitoring

内部状态探针读取的是情境而非行动:预行动失调监测的三个负面结果

Max Fomin, Elad David, Amit LeVi

机构 * Zenity

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 研究通过探针监测模型内部状态以预测有害行动,发现构造有效性、语义可读性和引导效应均无法成为稳健的预行动监测器,并提出了将内部读取转化为预行动测试的方法。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026. 17 pages (including appendices), 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29212 2026-06-30 cs.AI 57%

A Cognition-Emotion-Personality Framework for Modeling Human-Like Awareness and Behavior in Emergency Evacuations

用于模拟紧急疏散中类人意识与行为的认知-情绪-人格框架

Zoi Lygizou, Michalis Zervas, Helena G. Theodoropoulou, Vasilis Zafeiropoulos, Dimitris Kalles, Chairi Kiourt

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出一个集成认知、情绪、社会与人格机制的疏散仿真框架,通过动态事件意识、记忆模型、连续恐惧模型和OCEAN人格表征,揭示认知与情绪过程如何影响疏散效率并产生现实人群现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28343 2026-06-30 cs.IR cs.AI 57%

The Crowded Embedding Space: A Mean-Field Mechanism for Emergent Marginalization in Retrieval-Augmented Agents

拥挤的嵌入空间:检索增强型智能体中涌现边缘化的平均场机制

Shwan Ashrafi, Dan Roth

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 研究检索增强型智能体中密集检索导致少数内容被边缘化的问题,通过静态和动态分析揭示平均场机制,证明局部相关性目标会系统性地排斥少数兴趣。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02652 2026-06-26 cs.SD cs.AI cs.MM 版本更新 57%

Pianist Transformer: Towards Expressive Piano Performance Rendering via Scalable Self-Supervised Pre-Training

Pianist Transformer:通过可扩展的自监督预训练实现富有表现力的钢琴演奏渲染

Hong-Jie You, Jie-Jing Shao, Xiao-Wen Yang, Lin-Han Jia, Lan-Zhe Guo, Yu-Feng Li

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI

AI总结 提出Pianist Transformer,通过统一MIDI表示进行大规模自监督预训练,结合非对称Transformer和音符级压缩,实现高效且富有表现力的钢琴演奏生成。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25342 2026-06-25 cs.LG 新提交 57%

Lifelong In-Context Learning with Transformers Requires Parametric Forms of Attention

基于Transformer的终身上下文学习需要注意力的参数化形式

Luke McDermott, Robert W. Heath, Rahul Parhi

机构 * UC San Diego(加州大学圣地亚哥分校)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.LG

AI总结 本文提出将上下文学习扩展到终身设置是AI代理持续学习的实用方案,并论证需要参数化注意力机制来在固定硬件预算下理解终身上下文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23961 2026-06-24 cs.LG 新提交 57%

Forget Without Compromise: Nexus Sampling for Streaming KV-Cache Eviction Under Fixed Budgets

无需妥协的遗忘:固定预算下流式KV缓存驱逐的Nexus采样

Duc Duong, Hoang Anh Duy Le, Jianwen Xie, Anshumali Shrivastava, Zhaozhuo Xu

机构 * Department of Computer Science, Grinnell College(格林内尔学院计算机科学系) Department of Computer Science, Rice University(莱斯大学计算机科学系) Lambda, Inc(Lambda公司) Workato(Workato公司)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 提出Nexus采样方法,通过迭代注意力计算和加权水库采样替代确定性top-K选择,在固定预算下保留微妙重要令牌,理论证明其长期优势,实验在80%驱逐率下性能接近密集注意力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17473 2026-06-24 cs.CV cs.AI 版本更新 57%

Dual-Anchoring: Addressing State Drift in Vision-Language Navigation

双锚定:解决视觉语言导航中的状态漂移问题

Kangyi Wu, Pengna Li, Kailin Lyu, Xi Lin, Lin Zhao, Qingrong He, Jinjun Wang, Jianyi Liu

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) National Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院) Xi’an Jiaotong University(西安交通大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Johns Hopkins University(约翰霍普金斯大学) Joy Future Academy, JD(京东探索研究院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出双锚定框架,通过指令进度锚定和记忆地标锚定分别解决进度漂移和记忆漂移,显著提升长场景导航成功率。

Comments Accepted by ECCV26

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07884 2026-06-24 quant-ph cs.LG 版本更新 57%

Reinforcement Learning to Disentangle Multiqubit Quantum States from Partial Observations

基于部分观测的多量子比特态纠缠消除的强化学习

Pavel Tashev, Stefan Petrov, Matthew T. Diaz, Friederike Metz, Alaina M. Green, Norbert M. Linke, Marin Bukov

机构 * Department of Mathematics and Informatics(数学与信息学系) St. Kliment Ohridski University of Sofia(索菲亚圣克莱门特·欧赫里迪斯大学) Joint Quantum Institute(联合量子研究所) Department of Physics(物理系) University of Maryland(马里兰大学) National Quantum Laboratory (QLab)(国家量子实验室(QLab)) Institute of Physics(物理研究所) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院(EPFL)) Center for Quantum Science and Engineering(量子科学与工程中心) Quantum Systems Unit(量子系统单元) OIST Graduate University(OIST研究生大学) Duke Quantum Center(杜克量子中心) Max Planck Institute for the Physics of Complex Systems(复杂系统物理研究所)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 提出使用演员-评论家深度强化学习算法,仅基于两量子比特约化密度矩阵,为最多16量子比特态构建短纠缠消除电路,并在离子阱量子计算机上实验验证。

Comments The source code as well as a demo in the form of an interactive Jupyter notebook are available on Github: https://github.com/mgbukov/RL_disentangle

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22913 2026-06-23 cs.CV cs.AI 新提交 57%

Intend, Reflect, Refine: An Adaptive Multimodal Reflection Framework for Autonomous Driving

意图、反思、优化:一种用于自动驾驶的自适应多模态反思框架

Zisheng Chen, Yuping Qiu, Jianhua Han, Tao Tang, Xiuwei Chen, Likui Zhang, Ying-Cong Chen, Hang Xu, Xiaodan Liang

机构 * Sun Yat-sen University(中山大学) HKUST(GZ)(香港科技大学(广州)) Yinwang Intelligent Technology Co. Ltd.(引望智能科技有限公司)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 提出IRR-Drive框架,通过生成初步文本意图并预测未来语义BEV表示,构建双模态反思空间,实现自适应轨迹修正,在NAVSIM基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21595 2026-06-23 cs.CL cs.IR 新提交 57%

Per-Entity Bias Mapping for AI Visibility: Why Brand Mentions Require Entity-Specific Calibration

面向AI可见性的逐实体偏差映射:为何品牌提及需要实体特定校准

Zoltan Varga

机构 * Neural Awareness

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

AI总结 提出逐实体偏差映射(PEBM)框架,识别三种失败模式及参数-检索滞后不对称性,通过大规模实证揭示品牌幻觉悖论,并引入鬼影制图机制解释实体在稀疏潜在区域的虚构输出。

Comments 26 pages, 14 tables. Zenodo preprint: https://doi.org/10.5281/zenodo.20419277. Data and code: https://doi.org/10.5281/zenodo.20308957

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21513 2026-06-23 cs.LG 新提交 57%

Privacy-Preserving Federated Temporal Graph Learning with Digital Twin--Guided Adaptive Deception for Cyber-Resilient IoMT

基于数字孪生引导自适应欺骗的隐私保护联邦时序图学习及其在弹性医疗物联网中的应用

Syed Zeeshan Haider, Anwar Shah, Muneeb Arif, Hamza Iftikhar, Waqas Ali

机构 * FAST National University of Computer and Emerging Sciences(FAST国立计算机与新兴科学大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 提出联邦时序图卷积网络与优势演员-评论家(Federated TGCN-A2C)架构,结合数字孪生异常评分、联邦A2C动作选择和增强蜜罐层,在CICDDoS 2019和TON-IoT数据集上分别达到99.48%和99.61%的测试准确率,并覆盖更多攻击类别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18356 2026-06-18 cs.CR cs.AI 新提交 57%

SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents

SafeClawBench: 区分工具使用LLM代理中的语义、审计证据和沙箱危害

Yuchuan Tian, Mengyu Zheng, Haocheng Mei, Ye Yuan, Chao Xu, Xinghao Chen, Hanting Chen, Yu Wang

机构 * Peking University(北京大学) Beijing Jiaotong University(北京交通大学) SUIBE(上海外国语大学) Huawei(华为) Tsinghua University(清华大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出SafeClawBench基准,通过三个独立端点(语义攻击接受、审计可见危害证据、沙箱观察危害)评估工具使用LLM代理的安全性,揭示不同失败模式并支持可复现比较。

Comments 32 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13681 2026-06-18 cs.CL 新提交 57%

EvoArena: Tracking Memory Evolution for Robust LLM Agents in Dynamic Environments

EvoArena: 追踪记忆演化以构建动态环境中的鲁棒LLM智能体

Jundong Xu, Qingchuan Li, Jiaying Wu, Yihuai Lan, Shuyue Stella Li, Huichi Zhou, Bowen Jiang, Lei Wang, Jun Wang, Anh Tuan Luu, Caiming Xiong, Hae Won Park, Bryan Hooi, Zhiyuan Hu

机构 * National University of Singapore(新加坡国立大学) Singapore Management University(新加坡管理大学) University of Washington(华盛顿大学) University College London(伦敦大学学院) University of Pennsylvania(宾夕法尼亚大学) Nanyang Technological University(南洋理工大学) Recursive Massachusetts Institute of Technology(麻省理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 提出EvoArena基准套件模拟终端、软件和社交领域的渐进环境变化,并设计基于补丁的记忆范式EvoMem记录结构化更新历史,使智能体能通过记忆变化推理环境演化,实验表明当前智能体在动态环境中表现不佳,EvoMem可稳定提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏