arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-19 至 2026-05-19 共收录 402 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 14 篇

2602.06807 2026-05-19 cs.RO cs.AI cs.LG 62%

SuReNav: Superpixel Graph-based Constraint Relaxation for Navigation in Over-constrained Environments

SuReNav:基于超像素图的约束放松用于过约束环境中的导航

Keonyoung Koh, Moonkyeong Jung, Samuel Seungsup Lee, Daehyung Park

机构 * School of Computing, Korea Advanced Institute of Science and Technology, Korea(韩国科学技术院计算机学院)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SuReNav方法,通过超像素图构建区域约束,利用图神经网络实现安全高效导航,适用于半静态环境中过约束规划问题,提升导航的人类类比性能。

Comments Accepted by ICRA 2026. Code and videos are available at https://sure-nav.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18197 2026-05-19 cs.RO cs.AI cs.CV 57%

RGB-only Active 3D Scene Graph Generation for Indoor Mobile Robots

仅RGB的主动3D场景图生成用于室内移动机器人

Giorgia Modi, Davide Buoso, Giuseppe Averta, Daniele De Martini

机构 * Mobile Robotics Group (MRG)(移动机器人小组) Visual and Multimodal Applied Learning Lab (VANDAL)(视觉与多模态应用学习实验室)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种仅使用RGB输入的主动3D场景图生成方法,通过统一感知与规划的结构化表示,解决了传统方法对专用传感器的依赖问题,并在Replica数据集上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17320 2026-05-19 cs.OS cs.AI 57%

TClone: Low-Latency Forking of Live GUI Environments for Computer-Use Agents

TClone:用于计算机使用代理的低延迟活GUI环境分叉

Yutong Huang, Vikranth Srivatsa, Alex Asch, Hansin Tushar Patwa, Yiying Zhang

机构 * University of California, San Diego(加州大学圣迭戈分校) GenseeAI

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 TClone通过分离快速分支创建与持久快照,实现了对计算机使用代理的活GUI环境的低延迟版本控制,从而提高代理执行的安全性和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09269 2026-05-19 cs.LG cs.IR 57%

Goal inference with Rao-Blackwellized Particle Filters

基于 Rao-Blackwellized 粒子滤波器的目标推断

Yixuan Wang, Dan P. Guralnik, Warren E. Dixon

机构 * Mechanical \& Aerospace Engineering Department, University of Florida. Mathematics Department, Ohio University

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出利用改进的 Rao-Blackwellized 粒子滤波器推断移动智能体的目标,通过闭合环行为假设提升样本效率,并引入两种估计器评估对抗者恢复意图的能力。

Comments 6 pages, 3 figures. Accepted for presentation at the 23rd IFAC World Congress 2026, Busan, Republic of Korea, August 23-28, 2026. To appear in IFAC-PapersOnLine

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18441 2026-05-19 cs.RO cs.SY eess.SY 50%

REACT: Environment-Adaptive Architecture for Continuous Formation Navigation of Wheeled Mobile Robots

REACT:面向轮式移动机器人连续编队导航的环境自适应架构

Jianghong Dong, Yifeng Zhang, Jiawei Wang, Mengchi Cai, Keqiang Li, Guillaume Sartoretti

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院) Department of Mechanical Engineering, National University of Singapore(新加坡国立大学机械工程系) Department of Civil and Environmental Engineering, University of Michigan(密歇根大学土木与环境工程系)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出REACT架构,通过集中式编队生成和分布式编队维护相结合的方法,解决轮式移动机器人在复杂环境中编队导航的适应性问题,实现了无轨迹冲突的连续编队导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17302 2026-05-19 cs.RO 50%

Beyond Geometry: Efficient Topologically-Grounded Navigation in Complex 3D Environments

超越几何:在复杂3D环境中高效拓扑导向的导航

Yifan Du, Chengwei Zhang, Siyu Liao, Zhongfeng Wang

机构 * School of Integrated Circuits(集成电路学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出了一种表面提取框架,通过强制地面支撑、头顶 clearance 和基于种子的连通性约束,构建了物理可达的站立位置的简化状态空间,从而在复杂3D环境中实现高效的拓扑导向导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16979 2026-05-19 cs.RO 50%

NORM-Nav: Zero-Shot Mobile Robot Navigation with Natural Language Behavioral Constraints

NORM-Nav: 通过自然语言行为约束实现零样本移动机器人导航

Dongjie Huo, Junhui Wang, Chao Gao, Yan Qiao, Dong Zhang, Guyue Zhou

机构 * College of Information Science and Technology, Beijing University of Chemical Technology(北京化工大学信息科学与技术学院) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Institute of Systems Engineering and Collaborative Laboratory for Intelligent Science and Systems, Macau University of Science and Technology(澳门大学系统工程与智能科学与系统联合实验室) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出NORM-Nav框架,通过将自然语言行为约束整合到基于成本图的规划中,提升移动机器人在人类环境中导航的社交适应性,实验表明其在任务成功率和轨迹贴近人类参考方面优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02759 2026-05-19 cs.RO cs.CV 50%

DynoSLAM: Dynamic SLAM with Generative Graph Neural Networks for Real-World Social Navigation

DynoSLAM:基于生成图神经网络的动态SLAM用于现实世界的社交导航

Danil Tokhchukov, Veronika Morozova, Gonzalo Ferrer

机构 * Applied AI Institute(应用人工智能研究所)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出DynoSLAM,通过整合社交感知图神经网络,解决动态环境中SLAM的不确定性问题,提升机器人在拥挤环境中的导航能力。

Comments Code & Project page at https://github.com/makriot/dynoslam

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16537 2026-05-19 cs.RO 50%

Nori Bot: A Sub-$1,000 Floor-to-Counter Mobile Manipulator

Nori Bot:一款不到1000美元的 floor-to-counter 移动机械臂

Antonio Li, Sungjoon Park, Wen Ni Chew

机构 * LeRobot

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 Nori Bot 通过600mm Z轴提升、Raspberry Pi 4与OpenClaw协同控制以及软件安全栈解决移动机械臂的三大限制,成本仅为同类商业平台的3%。

Comments 7 pages, 3 figures, 2 tables. Columbia University Deep Learning Robot Manipulation course project, Spring 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16402 2026-05-19 cs.CV 50%

WinDeskGround: A Benchmark for Robust GUI Grounding in Complex Multi-Window Desktop Environments

WinDeskGround:复杂多窗口桌面环境中的鲁棒GUI定位基准

Haoren Zhao, Tianyi Chen, Zhen Wang

机构 * School of Cyberspace, Hangzhou Dianzi University, Hangzhou, China(杭州电子科技大学信息学院) Microsoft(微软公司)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出WinDeskGround基准,通过参数生成复杂桌面场景,评估GUI定位鲁棒性。实验显示顶级模型在简单环境表现佳,但部分遮挡下准确率下降。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 记忆与上下文管理 36 篇

2604.25850 2026-05-19 cs.CL cs.SE 88%

Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses

代理 harness 工程:基于可观测性的自动进化编码代理 harness

Jiahang Lin, Shichun Liu, Chengjun Pan, Lizhi Lin, Shihan Dou, Zhiheng Xi, Xuanjing Huang, Hang Yan, Zhenhua Han, Tao Gui, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Peking University(北京大学) Shanghai Qiji Zhifeng Co., Ltd(上海启智锋科技有限公司)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(title,abstract);分类 cs.CL、cs.SE

AI总结 本文提出了一种基于可观测性的代理 harness 工程方法,通过三个支柱解决 harness 工程中的挑战,使 harness 进化过程自动且可控,实验表明其在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16872 2026-05-19 cs.CY cs.AI 83%

Some[Body] Must Receive That Pain for Agent Accountability

某些身体必须承受痛苦以实现代理问责

Botao Amber Hu, Helena Rong

机构 * University of Oxford(牛津大学) New York University Shanghai(纽约大学上海分校)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文研究了人工智能代理问责中的后果接收问题,指出当前LLM代理无法满足必要的身体条件,因此传统法律回应失效,提出需要建立社会技术基础设施来实现后果-代理耦合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20857 2026-05-19 cs.CL cs.AI 81%

Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory

Evo-Memory:通过自演化记忆基准测试LLM代理的测试时间学习

Tianxin Wei, Noveen Sachdeva, Benjamin Coleman, Zhankui He, Yuanchen Bei, Xuying Ning, Mengting Ai, Yunzhe Li, Jingrui He, Ed H. Chi, Chi Wang, Shuo Chen, Fernando Pereira, Wang-Cheng Kang, Derek Zhiyuan Cheng

机构 * Google DeepMind(谷歌DeepMind) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 记忆与上下文管理 :agent(title);planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出Evo-Memory,一个用于评估LLM代理自演化记忆能力的综合流基准和框架,通过构建序列任务流数据集,要求LLM在每次交互后搜索、适应和演化记忆,并在10个多样化的多轮目标导向和单轮推理与问答数据集上评估了超过十种代表性的记忆模块。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17283 2026-05-19 cs.CL cs.AI 81%

OProver: A Unified Framework for Agentic Formal Theorem Proving

OProver:一个用于代理形式定理证明的统一框架

David Ma, Kaijing Ma, Shawn Guo, Yunfeng Shi, Enduo Zhao, Jiajun Shi, Zhaoxiang Zhang, Gavin Cheung, Jiaheng Liu, Zili Wang

机构 * Lean 4

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出OProver,一个用于Lean 4的统一框架,通过迭代修订检索到的编译器验证证明和Lean编译器反馈来改进代理证明,通过持续预训练和迭代后训练,使OProver-32B在多个基准测试中取得最佳成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23566 2026-05-19 cs.LG cs.AI 81%

AscendOptimizer: Episodic Agent for Ascend NPU Operator Optimization

AscendOptimizer: 一种用于Ascend NPU运算优化的经验型智能体

Jiehao Wu, Zixiao Huang, Wenhao Li, Chuyun Shen, Junjie Sheng, Xiangfeng Wang

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Shanghai University of International Business and Economics(上海国际商务经济大学) Key Lab of Mathematics and Engineering Applications (MoE), East China Normal University(东华大学数学与工程应用重点实验室) School of Mathematical Sciences, East China Normal University(东华大学数学科学学院) Shenzhen Loop Area Institute (SLAI)(深圳环宇院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出AscendOptimizer,通过自身执行构建缺失的优化知识,结合主机侧和内核侧优化,实现AscendC运算的加速,达到1.21倍的几何平均速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14498 2026-05-19 cs.CL 79%

GroupMemBench: Benchmarking LLM Agent Memory in Multi-Party Conversations

GroupMemBench: 多方对话中LLM代理记忆的基准测试

Jingbo Yang, Kwei-Herng Lai, Xiaowen Wang, Shiyu Chang, Yaar Harari, Evgeniy Gabrilovich

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) Microsoft(微软)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 本文提出GroupMemBench,用于评估多方对话中LLM代理的记忆能力,揭示现有记忆系统在群体动态、信念跟踪和语言适应方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17969 2026-05-19 cs.CV 78%

Generation Navigator: A State-Aware Agentic Framework for Image Generation

生成导航器:一种基于状态的图像生成代理框架

Jinming Liu, Ruoyu Feng, Yuqi Wang, Wenjun Zeng, Xin Jin

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(东部技术研究所) Independent(独立)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract)

AI总结 本文提出了一种基于状态的图像生成代理框架Generation Navigator,通过将图像生成问题重新表述为状态条件下的动作生成问题,解决了传统方法中在强化学习训练中因信用分配问题导致的不足,通过PRE-GRPO算法提升了生成质量与推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01080 2026-05-19 econ.TH math.OC 78%

Principal-agent problems with adverse selection: A stochastic target problem formulation

有 adverse selection 的委托-代理问题:一个随机目标问题的 formulation

Guillermo Alonso Alvarez, Ibrahim Ekren, Liwei Huang

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 本文研究了存在逆向选择的委托-代理问题,通过将代理的优化问题转化为随机目标问题,解决了委托人在信息不完全情况下的最优合同设计问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03664 2026-05-19 cs.AI cs.LG 73%

Mitigating Conversational Inertia in Multi-Turn Agents

缓解多轮代理中的对话惯性

Yang Wan, Zheng Cao, Zhenhao Zhang, Zhengwen Zeng, Shuheng Shen, Changhua Meng, Linchao Zhu

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院) University of Rochester, Rochester, NY, USA(罗切斯特大学)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了多轮代理中对话惯性问题,提出通过上下文偏好学习来校准模型偏好,以减少惯性并提升性能。

Comments ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16042 2026-05-19 cs.AI cs.LG cs.OS 73%

OSWorld-Human: Benchmarking the Efficiency of Computer-Use Agents

OSWorld-Human: 评估计算机使用代理的效率基准

Reyna Abhyankar, Qi Qi, Yiying Zhang

机构 * OpenAI Anthropic Google DeepMind(谷歌DeepMind) ByteDance(字节跳动) Agent S2 GTA1 Lei Jedi

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了计算机使用代理在OSWorld基准上的时间性能,发现大模型调用导致高延迟,并构建了包含人类轨迹的OSWorld Human数据集,评估发现最佳代理仍需更多步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17830 2026-05-19 cs.AI cs.CL 73%

Remembering More, Risking More: Longitudinal Safety Risks in Memory-Equipped LLM Agents

记住更多,风险更多:具有记忆能力的LLM代理的纵向安全风险

Ahmad Al-Tawaha, Shangding Gu, Peizhi Niu, Ruoxi Jia, Ming Jin

机构 * Virginia Tech(弗吉尼亚理工大学) University of California, Berkeley(加州大学伯克利分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究探讨了具有记忆能力的LLM代理在长期任务中因记忆积累导致的安全风险,提出了一种触发-探测协议来评估记忆污染的影响,并发现记忆安全应被视为一个纵向属性而非单一状态属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16746 2026-05-19 cs.AI cs.LG 73%

State Contamination in Memory-Augmented LLM Agents

内存增强型大语言模型代理中的状态污染

Yian Wang, Agam Goyal, Yuen Chen, Hari Sundaram

机构 * Department of Computer Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学系)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨了内存增强型大语言模型代理中由于状态污染导致的安全问题,通过分析内存总结中的毒性内容传播,提出了一种新的衡量指标,并指出在信息压缩前进行净化可以有效减少潜在影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18729 2026-05-19 cs.RO cs.CV 71%

Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction

Robo-Cortex: 通过双粒认知记忆和自主知识诱导实现自我进化具身智能体

Nga Teng Chan, Yi Zhang, Yechi Liu, Renwen Cui, Fanhu Zeng, Zeyuan Ding, Xiancong Ren, Zhang Zhang, Qifeng Chen, Jian Liu, Yong Dai, Xiaozhu Ju

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) X-Humanoid Institute of Automation, CAS(中国科学院自动化研究所) Beijing University of Aeronautics and Astronautics(北京航空航天大学)

专题命中 记忆与上下文管理 :agent(title)

AI总结 本文提出Robo-Cortex框架,通过双粒认知记忆和自主知识诱导机制,使机器人能够自主诱导导航启发式方法并优化认知策略,从而在复杂环境中实现自主导航和探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18284 2026-05-19 cs.SE cs.AI 62%

CommitDistill: A Lightweight Knowledge-Centric Memory Layer for Software Repositories

CommitDistill: 一种轻量级的知识导向内存层用于软件仓库

Divya Chukkapalli, Thejesh Avula, Aditya Aggarwal, Harsimran Singh, Amith Tallanki

机构 * Microsoft Corporation(微软公司)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出CommitDistill,一种轻量级的知识导向内存层,通过确定性正则表达式从本地git历史中提取类型化知识单元,并通过TF-IDF检索器进行检索,以提高软件仓库中历史信息的利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18246 2026-05-19 cs.LG cs.AI 62%

Privacy Preserving Reinforcement Learning with One-Sided Feedback

具有单侧反馈的隐私保护强化学习

Lin William Cong, Guangyan Gan, Hanzhang Qin, Zhenzhen Yan

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学) Cornell SC Johnson College of Business(康奈尔大学SC Johnson商学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了在多维连续状态和动作空间中,代理仅接收状态部分观测并仅在每个时间步获得状态-动作空间子集奖励信息的强化学习问题,提出了一种新的隐私保护强化学习算法POOL,并通过理论分析证明其样本复杂度与非隐私强化学习的下界一致,展示了在保持高学习效率的同时实现强隐私保障的可行性。

Comments Accepted at IJCAI-ECAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17138 2026-05-19 cs.LG cs.AI 62%

RAP: Runtime Adaptive Pruning for LLM Inference

RAP: 用于大语言模型推理的运行时自适应剪枝

Huanrong Liu, Chunlin Tian, Xuyang Wei, Qingbiao Li, Li Li

机构 * Faculty of Science and Technology, University of Macau, Macau, China(澳门大学科学与技术学院) School of Information and Software Engineering, University of Electronic Science and Technology of China, Chengdu, China(电子科技大学信息与软件工程学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出RAP,一种基于强化学习的弹性剪枝框架,通过动态调整压缩策略来适应运行时内存变化和异构KV缓存需求,首次在推理过程中同时考虑模型权重和KV缓存。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17431 2026-05-19 cs.LG cs.AI 62%

MATE: Solving Contextual Markov Decision Processes with Memory of Accumulated Transition Embeddings

MATE:利用累积转移嵌入记忆解决上下文马尔可夫决策过程

Himchan Hwang, Hyeokju Jeong, Gene Chung, Seungyeon Kim, Sangwoong Yoon, Frank Chongwoo Park

机构 * Seoul National University(首尔国立大学) Ulsan National Institute of Science and Technology (UNIST)(釜山国立科学技术研究所(UNIST))

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 MATE通过使用累积转移嵌入的记忆架构,解决了由未观察上下文参数化的上下文马尔可夫决策过程(CMDPs),在保持后验信念的同时,避免了传统方法的计算和梯度问题,实现了高效且性能优异的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15508 2026-05-19 cs.LG cs.CL 62%

STS: Efficient Sparse Attention with Speculative Token Sparsity

STS: 高效稀疏注意力与推测性标记稀疏性

Ceyu Xu, Jiangnan Yu, Yongji Wu, Yuan Xie

机构 * The Hong Kong University of Science and Technology(香港科技大学) UC Berkeley(加州大学伯克利分校)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL、cs.LG

AI总结 本文提出STS,一种无需模型再训练的稀疏注意力机制,通过利用较小的草稿模型识别出的重要标记来预测更大目标模型的重要标记,从而在大规模语言模型推理中实现高效的稀疏注意力计算,显著提升速度并保持准确性。

Comments 14 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14371 2026-05-19 cs.RO cs.AI 57%

OxyGen: Unified KV Cache Management for VLA Inference under Multi-Task Parallelism

OxyGen: 为多任务并行下的VLA推理提供统一的KV缓存管理

Xiangyu Li, Huaizhi Tang, Xin Ding, Weijun Wang, Ting Cao, Yunxin Liu

机构 * Institute for AI Industry Research (AIR)(人工智能产业研究院) Department of Electronic Engineering(电子工程系) University of Science and Technology of China(中国科学技术大学)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 本文提出OxyGen,一种统一的KV缓存管理方法,用于在多任务并行下提高VLA推理效率,通过跨任务KV共享和跨帧连续批处理实现冗余计算和资源竞争的减少,从而在设备端实现更高的吞吐量和频率。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17721 2026-05-19 cs.AI 57%

EXG: Self-Evolving Agents with Experience Graphs

EXG: 基于经验图的自演化代理

Yuxin Jin, Siyuan Zhang, Hanchen Wang, Lu Qin, Ying Zhang, Wenjie Zhang

机构 * University of Technology Sydney(悉尼科技大学) The University of New South Wales(新南威尔士大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出EXG,一种基于经验图的自演化代理框架,通过结构化组织积累的成功与失败经验,提升代理在复杂任务中的解决质量和资源效率。

详情

展开后加载摘要…

URL PDF HTML 收藏