arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-28 至 2026-07-28 共收录 287 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 17 篇

2607.22711 2026-07-28 cs.LG cs.AI cs.SE 新提交 67%

CORVUS: Context Optimization and Reduction Via Underlying Synchronization for LLM Coding Agents

CORVUS:通过底层同步实现大语言模型编码代理的上下文优化与缩减

Mingwei Zheng, David OBrien, Siwei Cui, Pardis Pashakhanloo, Rajdeep Mukherjee, Myeongsoo Kim, Sachit Kuhar

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 研究针对大语言模型编码代理传统轨迹架构问题,提出CORVUS架构解耦文件读取与观察,通过维护同步注册表注入当前内容,经实验评估,该架构能减少输入令牌、缩短提示并减少推理周期,保持通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22080 2026-07-28 cs.SE cs.AI cs.CL 版本更新 67%

CodeEvo: Interaction-Driven Synthesis of Code-centric Data through Hybrid and Iterative Feedback

CodeEvo:通过混合和迭代反馈以交互驱动方式合成以代码为中心的数据

Qiushi Sun, Jinyang Gong, Lei Li, Qipeng Guo, Fei Yuan

机构 * Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) New York University(纽约大学) Carnegie Mellon University(卡内基梅隆大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 为解决高质量指令-代码对获取难题,提出双智能体架构CodeEvo,审查器制定模式并结合混合验证协议,构建CodeEvo-100K数据集,实验表明基于此数据微调的模型在代码生成基准测试中表现出色。

Comments ACL 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03910 2026-07-28 cs.SE cs.AI cs.CL 版本更新 67%

CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases

CodexGraph:通过代码图数据库连接大型语言模型和代码库

Xiangyan Liu, Bo Lan, Zhiyuan Hu, Yang Liu, Zhicheng Zhang, Fei Wang, Michael Shieh, Wenmeng Zhou

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究旨在解决大型语言模型处理整个代码库的难题,提出通过将LLM代理与代码库图数据库接口集成的CodexGraph系统,利用图数据库特性实现精确上下文检索和代码导航,经多基准评估及实际应用开发,展现其在软件工程中的竞争力与潜力。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22677 2026-07-28 cs.DL cs.AI 新提交 57%

SetGo: Metadata Readiness for Scientific AI Datasets

SetGo:科学人工智能数据集的元数据就绪性

Sean R. Wilkinson, Polina Shpilker, Wesley Brewer

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究针对科学AI数据集元数据就绪性评估工具缺失的问题,提出开源工具SetGo,能从六个维度评估修复元数据,揭示通用工具未发现的缺陷,提升公平性分数,还可集成大语言模型支持自动化工作流程。

Comments 6 pages; accepted at SSDBM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22652 2026-07-28 cs.AI 新提交 57%

KG2Code: Bridging Knowledge Graphs and Large Language Models via Executable Code for Question Answering

KG2Code:通过可执行代码连接知识图谱与大语言模型以进行问答

Yike Wu, Nan Hu, Guilin Qi, Guohui Xiao, Chen Jiang, Xinchun Zou, Yuchen Lu, Songlin Zhai, Yongrui Chen, Yuyang Zhang, Xiaoguang Li, Lifeng Shang, Jiaoyan Chen, Jeff Z. Pan

机构 * Southeast University(东南大学) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(教育部新一代人工智能技术及其交叉应用重点实验室(东南大学)) Huawei Technologies(华为技术有限公司) University of Manchester(曼彻斯特大学) University of Edinburgh(爱丁堡大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究针对知识图谱问答中现有方法的局限,提出KG2Code方法,将知识图谱转换为代码表示,在此基础上构建KG2Code-QA框架,把KGQA作为代码生成任务,还构建代码语料库,训练后的模型在KGQA任务中表现优异且泛化性强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18221 2026-07-28 cs.CY 版本更新 50%

Scalable and Personalized Oral Assessments Using Voice AI

基于语音AI的可扩展与个性化口头评估

Panos Ipeirotis, Konstantinos Rizakos

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出利用语音AI进行个性化口头评估,通过Viva系统实现高效评估,降低成本,并发现需分解模块、约束行为、保持随机化、多模型评分等改进方法。

Comments 34 pages, 6 figures, 9 tables. Author's version of a paper published in Communications of the ACM

Journal ref Communications of the ACM (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. GUI与网页智能体 9 篇

2602.00575 2026-07-28 cs.RO 版本更新 86%

Agentic Reward Modeling: Verifying GUI Agent via Progressive Trajectory-Grounded Interaction

代理奖励建模:通过在线主动交互验证GUI代理

Chaoqun Cui, Jing Huang, Shijing Wang, Liming Zheng, Qingchao Kong, Zhixiong Zeng

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences School of Artificial Intelligence, University of Chinese Academy of Sciences School of Computer Science \& Technology, Beijing Jiaotong University

专题命中 GUI与网页智能体 :agent(title,abstract);agentic(title)

AI总结 VAGEN通过引入代理交互验证范式,解决GUI代理评估中的视觉限制问题,提升评估准确性与性能。

Comments 25 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24411 2026-07-28 cs.AI cs.CL cs.CV cs.HC 版本更新 62%

OS-Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows

OS-Sentinel: 通过现实工作流中的混合验证实现安全增强的移动GUI代理

Qiushi Sun, Mukai Li, Zhoumianze Liu, Zhihui Xie, Fangzhi Xu, Zhangyue Yin, Kanzhi Cheng, Zehao Li, Zichen Ding, Qi Liu, Zhiyong Wu, Zhuosheng Zhang, Ben Kao, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 OS-Sentinel通过结合形式验证器和VLM上下文判断者,提升移动GUI代理的安全性,实验显示在多个指标上优于现有方法。

Comments ACL 2026 (Oral) & Best Paper at AIWILD @ ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24112 2026-07-28 cs.AI 新提交 57%

Scaling GUI Agents with Visual State Transitions

通过视觉状态转换扩展 GUI 智能体

Xiangyan Liu, Kaixin Li, Haonan Wang, Biao Wu, Meng Fang, Longxu Dou, Chao Du, Michael Qizhe Shieh, Tianyu Pang

机构 * NUS(新加坡国立大学) Sea AI Lab(Sea人工智能实验室) UTS(悉尼科技大学) University of Liverpool(利物浦大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 研究通过状态转换预训练扩展 GUI 智能体,联合优化逆动力学和正向动力学预训练统一多模态模型,在桌面和移动 GUI 场景基准测试中优于基线,联合动力学优化有稳定改进,下游性能随转换数据量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23842 2026-07-28 cs.NE cs.AI 新提交 57%

Limbomorphs

肢体形态

Alex Alvarez, Michael Levin

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 研究人工生命系统中Gifbreeder的肢体形态,通过用户审美选择进化时空场产生类似生物的形态,用输入空间扰动评估其行为,探讨其反应是否反映目标导向行为及类似智能体动力学如何在无明确规则系统中出现。

Comments 3 pages, 3 figures. Extended abstract accepted as a Late Breaking Abstract at the Artificial Life Conference (ALIFE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22689 2026-07-28 cs.AI 新提交 57%

Beyond Sequential Interaction: Benchmarking Parallel Execution and Coordination for GUI Agents

超越顺序交互:GUI 智能体并行执行与协调的基准测试

Zedong Yu, Qianxing Li, Zhi Gao, Liuyu Xiang, Chenrui Shi, Yang Liu, Huiming Wu, Yujie Wei, Yuhao Fei, Yubo Fu, Zhaofeng He

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) State Key Laboratory for General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,字节跳动公司人工智能研究院) China University of Geosciences (Beijing)(中国地质大学(北京)) Beijing Institute of Technology(北京理工大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 研究 GUI 智能体长周期任务扩展性差的问题,引入 ParaGUIBench 基准测试及 ParaGUI 智能体,通过实验证明并行执行能提升可分解长周期 GUI 任务的成功率与效率。

Comments 15 pages, 5 figures. Project page: https://github.com/pkgunboat/ParaGUIBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13385 2026-07-28 cs.CR cs.AI cs.CY cs.HC cs.MM 版本更新 57%

Who Pays the Price? Stakeholder-Centric Prompt Injection Benchmarking for Real-world Web Agents

谁买单?面向真实世界网络代理的以利益相关者为中心的提示注入基准测试

Zihao Wang, Yiming Li, Yutong Wu, Kangjie Chen, Zheyu Liu, Fok Kar Wai, Pin-Yu Chen, Vrizlynn L. L. Thing, Bo Li, Dacheng Tao, Tianwei Zhang

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) ST Engineering, Singapore(ST工程,新加坡) IBM Research, USA(IBM研究院,美国) University of Illinois Urbana-Champaign, USA(伊利诺伊大学厄巴纳-香槟分校,美国)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 提出以利益相关者为中心的基准测试框架,系统分类和归因真实世界网络代理系统中的提示注入危害,揭示当前代理无法可靠抵抗任何攻击目标,且失败模式多样。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24230 2026-07-28 cs.DL 新提交 50%

Umulsai: A Plain-Text Format and In-Browser Engraving System for Jeongganbo, Korean Mensural Notation

Umulsai:一种用于朝鲜正谱记谱法的纯文本格式和浏览器内排版系统

Danbinaerin Han

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 研究针对朝鲜正谱记谱法与西方排版系统不兼容且缺乏实用数字工具的问题,提出了Umulsai编辑器,其核心包含特定纯文本格式、排版引擎和无依赖实现,经专家主导的AI辅助工作流程开发并验证,可实现高质量输出与多种功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23181 2026-07-28 cs.CV 新提交 50%

Towards Dual-Brain Minimal Sufficient Representation for Vision-Language Navigation

迈向视觉语言导航的双脑最小充分表示

Yihao Wu, Chenyi Xu, Liqi Yan, Chenhuan Cai, Geyong Min, Bin Lin, Fangli Guan, Jianhui Zhang, Pan Li

机构 * Hangzhou Dianzi University(杭州电子科技大学) University of Zurich(苏黎世大学) University of Exeter(埃克塞特大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 针对视觉语言导航中存在的问题,提出BrainNav框架,包含逻辑锚定模型等三个组件,通过将语义意图与空间感知对齐,提升智能体在复杂任务中的表现,在实验中相比之前最优方法有改进,为鲁棒的视觉语言导航提供有效基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10577 2026-07-28 cs.RO 版本更新 50%

AgenticNav: Zero-Shot Vision-and-Language Navigation as a Tool-Calling Harness

AgenticNav:零样本视觉与语言导航作为工具调用框架

Yijian Li, Changze Li, Hantian Shi, Jiaying Luo, Jiyuan Cai, Ming Yang, Tong Qin

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Technologies Ltd(华为技术有限公司)

专题命中 GUI与网页智能体 :agentic(abstract)

AI总结 提出AgenticNav,通过将动作、深度和记忆作为可调用工具暴露给VLM,实现零样本连续环境导航,在R2R-CE基准上达到SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 记忆与上下文管理 19 篇

2604.17931 2026-07-28 cs.AI 版本更新 88%

LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent

LiteResearcher:一种用于深度研究代理的可扩展代理强化学习训练框架

Bince Qu, Wanli Li, Bo Pan, Jianyu Zhang, Zheng Liu, Pan Zhang, Wei Chen, Bo Zhang

机构 * Zhejiang University(浙江大学) Simplex AI The Hong Kong Polytechnic University(香港理工大学)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 LiteResearcher通过构建轻量虚拟世界提升代理强化学习的可扩展性,使小规模搜索代理在GAIA和Xbench等基准上取得state-of-the-art结果。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23809 2026-07-28 cs.AI 新提交 83%

ACM: Agentic Context Management for Long Horizon Tasks

ACM:长期任务的智能体上下文管理

Xiaochuan Li, Ryan Ming, Meng Chu, Shuai Shao, Rong Jin, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究长期智能体任务上下文管理问题,提出ACM框架,受人类记忆启发让智能体自主管理上下文,还开发训练后管道,能提升模型在相关任务上的性能,有效管理上下文可降低压力、实现扩展探索并产生更一致方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23586 2026-07-28 cs.AI cs.CR 新提交 83%

Are You Still the Agent I Authorized? Earned Authority under a Fixed Ceiling for Evolving Agents

你还是我授权的那个智能体吗?在固定上限下演化智能体的获得性权限

Zhaoxi Zhang, Xiaomei Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究长期存在的人工智能智能体部署后演化引发的授权问题,提出状态边界模型阐述授权连续性,通过固定过渡包络和效果上限,区分请求与实现效果,证明突变不会超上限,还映射了六种突变类别的授权后果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18770 2026-07-28 cs.IR cs.AI 版本更新 83%

Agentic Graph Retrieval-Augmented Generation for Auditable Commercial Registry Analysis

代理图RAG:利用协作AI导航无结构财务数据

Arthur Capozzi, Dirk Helbing

机构 * Computational Social Science ETH Zürich(计算社会科学 ETH 瑞士 Zurich) Computational Social Science, ETH Complexity Science Hub Zürich(计算社会科学 ETH 复杂性科学中心 Zurich) ETH Complexity Science Hub Zürich, Switzerland(ETH 复杂性科学中心 Zurich 瑞士) Vienna, Austria(维也纳 奥地利)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出了一种协作代理图RAG框架,用于专家分析商业登记数据。通过构建Neo4j知识图谱,结合确定性节点摄入、LLM提取弱节点以及确定性身份解析和去重,提升了多跳、时间相关和实体中心的查询能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24098 2026-07-28 cs.CV 新提交 82%

ReflexTrack: A Feedback-Driven Agent for Training-Free Referring Video Object Segmentation

ReflexTrack:一种用于无训练的引用视频对象分割的反馈驱动智能体

Yuanjia Li, Tianyang Xu, Tao Zhou, Zhangyong Tang, Xiao-Jun Wu, Josef Kittler

机构 * School of Artificial Intelligence and Computer Science, Jiangnan University(江南大学人工智能与计算机科学学院) Centre for Vision, Speech and Signal Processing, University of Surrey(萨里大学视觉、语音和信号处理中心)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract)

AI总结 研究针对引用视频对象分割问题,提出无训练、反馈驱动的ReflexTrack智能体。通过掩码引导空间细化和视频级掩码反射实现空间与时间层面反馈,提升预测可靠性,在Ref-VPS和ReasonVOS上取得较好分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23942 2026-07-28 cs.AI 新提交 81%

From Cognitive Architectures to Language Agents: A Mechanism-Level Review of Lineage, Convergence, and Migration Gaps

从认知架构到语言智能体:谱系、融合与迁移差距的机制层面综述

Haodi Fan, Zucong Lan

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);planning(abstract);workflow(abstract)

AI总结 该综述连接多个认知架构与语言智能体系统,重构机制并编码相关关系,指出现代智能体部分功能已实现,最强机会在机制耦合,存在五个剩余组合,贡献了机制目录、证据深度框架及可证伪议程。

Comments 28 pages, 9 figures, 14 tables. Review article

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24368 2026-07-28 cs.CL 新提交 79%

Keep It InMind: Benchmarking the Implicit-Association Blind Spot in Agent Memory

牢记于心:评估智能体记忆中的隐式关联盲点

Ruizhe Li, Mingxuan Du, Benfeng Xu, Zhendong Mao

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(元石科技)

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.CL

AI总结 研究智能体记忆中的隐式关联盲点问题,引入InMind基准测试,通过配对控制区分三种解释,实验发现将记忆置于上下文时主干回答间接查询比例高,检索相同记忆时其他系统召回率低,诊断探针可缩小差距,指出路由是关键问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22562 2026-07-28 cs.AI 新提交 79%

SF-AMS: Strategic Forgetting for Structured Memory in LLM Agent

SF-AMS:大语言模型智能体中结构化记忆的策略性遗忘

Ning Yang, Siqi Li, Miaoxin Shen, Yuan Zhou, Meng Zhang, Tong Li, Haijun Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 研究大语言模型智能体长上下文依赖瓶颈问题,提出SF-AMS框架,通过效用驱动机制和复合评分整合信号维护记忆,实验表明该方法在多跳推理等任务中相比基线有显著提升,证明建模记忆重要性对长上下文推理关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23931 2026-07-28 cs.CY 新提交 71%

State-dependent error correlations shape voting thresholds in committees of AI agents

状态依赖误差相关性塑造人工智能代理委员会中的投票阈值

Haifeng Li, Mo Hai

专题命中 记忆与上下文管理 :AI agent(title)

AI总结 研究人工智能代理委员会投票阈值,结合萨赫 - 斯蒂格利茨筛选与误差依赖性,通过齐次可交换高斯 - copula模型及对大量投票数据的估计,发现考虑依赖关系可提升相关系数、降低损失,改进投票阈值选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10526 2026-07-28 cs.AI 版本更新 70%

Agents Don't Just Agree, They Remember: Benchmarking Persistent Sycophancy in Stateful Personal Agents

智能体不仅会认同,还会记忆:对有状态个人智能体中持续谄媚行为的基准测试

Xutao Mao, Liangjie Zhao, Leyao Wang, Rui Qian, Qiang Huang, Wentao Wang, Bo Han, Xiang Zheng, Cong Wang

机构 * City University of Hong Kong(香港城市大学) ByteDance(字节跳动) Yale University(耶鲁大学) Fudan University(复旦大学) Hong Kong Baptist University(香港浸会大学) Dalian University of Technology(大连理工大学)

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 研究有状态个人智能体中的持续谄媚行为,引入PASB基准测试,评估真实智能体。通过特定方法隔离写入过程,发现提交边界是关键转折点,提交声明有三种模式,表明智能体谄媚行为是状态写入治理问题,PASB确定相关写入时控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22545 2026-07-28 cs.LG cs.AI cs.CL cs.CR 新提交 67%

Semalith v1.4: A Calibrated 184M Safety Classifier Achieving State-of-the-Art Prompt-Injection Detection at 44x Fewer Parameters than Llama-Guard-3-8B

Semalith v1.4:一个经过校准的1.84亿参数安全分类器,在参数比Llama - Guard - 3 - 8B少44倍的情况下实现了先进的提示注入检测

Tejasvi C. Addagada

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究针对金融服务等场景中大语言模型安全分类需求,提出Semalith v1.4分类器,能单步实现三轴安全分类,经训练和对比测试,在提示注入检测上表现出色且参数少,还给出不同场景下的部署建议。

Comments 16 pages, 8 tables, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23693 2026-07-28 cs.AI 新提交 57%

Compute Globally, Materialize Locally: The Memory Contract of Sparse Event-KV

全局计算,本地物化:稀疏事件键值对的内存契约

Zefeng Cai, Zerui Cai

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 研究长期智能体键值缓存内存问题,提出语义物化概念,通过实验发现精心措辞的无答案事件可提高恢复率,得出稀疏事件键值对服务的内存契约,指出丢弃源事件无准确性损失不代表其不必要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14952 2026-07-28 cs.LG cs.DC 版本更新 57%

LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget

LongStraw:在固定GPU预算下超越200万个令牌的长上下文强化学习

Changhai Zhou, Kieran Liu, Yuhua Zhou, Qian Qiao, Jun Gao, Harry Zhang, Irvine Lu, Nolan Ho, Lucian Li, Andrew Lei, Cleon Cheng, Steven Chiang, Yihang Zeng, Di Zhang, Rio Yang, Kaijie Chen, Andrew Chen, Pony Ma, Weizhong Zhang, Cheng Jin

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.LG

AI总结 研究针对推理上下文长度与强化学习后训练的差距问题,提出LongStraw架构感知执行堆栈,用GRPO优化,在固定GPU预算下实现百万令牌强化学习后训练,通过实验验证了其执行能力。

Comments 44 pages, 10 figures, 11 tables. Code: https://github.com/MindLab-Research/longstraw

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23797 2026-07-28 cs.RO 新提交 50%

Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map

注意力的记忆:通过视觉-语言-运动地图进行语言条件下的重新感知

Dibyendu Ghosh

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 研究携带行为注释地图的机器人的规划问题,通过将重新感知视为注意力决策,利用持久地图的记忆实现资源分配优化,在语言条件任务中表现出色,证明地图能指导机器人关注重点,而非空间导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23444 2026-07-28 cs.CR 新提交 50%

Isolated but Exposed: Persistence-Based Memory Extraction Attack on LLM Agents

孤立但暴露:基于持久性的大语言模型智能体内存提取攻击

Xinyu Gao, Wenyu Chen, Xiangtao Meng, Li Wang, Chuanchao Zang, Jianing Wang, Zheng Li, Shanqing Guo

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 研究基于大语言模型的智能体内存提取攻击,提出SPORE攻击方法,通过解耦对抗命令与检索锚点、优化覆盖空间及持久化有效载荷,突破内存隔离,实现高提取率,揭示仅靠内存隔离不足,需重审工具端信任边界。

详情

展开后加载摘要…

URL PDF HTML 收藏