arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-08 至 2026-07-08 共收录 10 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 10 篇

2607.05511 2026-07-08 cs.CV 新提交 88%

Light-Omni: Reflex over Reasoning in Agentic Video Understanding with Long-Term Memory

Light-Omni:基于长期记忆的智能视频理解中的反射优于推理

Chang Nie, Jiaju Wei, Junlan Feng, Chaoyou Fu, Caifeng Shan

机构 * Nanjing University(南京大学)

专题命中 记忆与上下文管理 :agent(summary_cn,abstract);agentic(title,abstract)

AI总结 研究针对智能视频理解中先进智能体依赖迭代推理成本高的问题,提出Light-Omni框架,通过双重上下文状态实现反射式轻量级视频理解,经实验验证其有效性,性能优于M3-Agent且能增强现有MLLMs。

Comments Project Page: https://clare-nie.github.io/Light-Omni

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06195 2026-07-08 cs.SE 新提交 88%

LogicHunter: Testing LLM Agent Frameworks with an Agentic Oracle

LogicHunter:使用智能预言机测试大语言模型代理框架

Minghui Long, Yanjie Zhao, Haoyu Wang

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(title,abstract);分类 cs.SE

AI总结 研究针对大语言模型代理框架测试不足问题,提出LogicHunter模糊测试框架。通过规范驱动生成有效极端输入,引入智能预言机解决预言机歧义。在三个框架上评估,发现众多未知错误,智能预言机精度高,远超基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19458 2026-07-08 cs.AI cond-mat.mtrl-sci 版本更新 88%

VASP Agent: An Agentic Framework for Autonomous First-principles Calculations

VASP智能体:一种用于自主第一性原理计算的智能框架

Zeyu Xia, Jinzhe Ma, Congjie Zheng, Zhongyao Wang, Shufei Zhang, Yuqiang Li, Hang Su, P. Hu, Changshui Zhang, Xingao Gong, Wanli Ouyang, Lei Bai, Dongzhan Zhou, Mao Su

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Computer Science and Technology(计算机科学与技术系) School of Physical Science and Technology(物理科学与技术学院) Department of Automation(自动化系) Beijing National Research Center for Information Science and Technology (BNRist)(北京信息科学与技术国家研究中心) School of Chemistry and Chemical Engineering(化学与化工学院) Key Laboratory of Computational Physical Sciences (Ministry of Education)(计算物理科学重点实验室) The Chinese University of Hong Kong(香港中文大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 研究针对第一性原理材料计算对自主性的高要求,提出VASP智能体系统,结合多种技能和工具执行多步VASP计算,经多任务评估,其计算结果更优,还能诊断并恢复计算错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06273 2026-07-08 cs.SE 新提交 83%

AgentTether: Graph-Guided Diagnosis and Runtime Intervention for Reliable LLM Agent Operation

AgentTether:用于可靠大语言模型代理操作的图引导诊断与运行时干预

Chenyu Zhao, Shenglin Zhang, Wenwei Gu, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

专题命中 记忆与上下文管理 :agent(title,abstract);tool-use(abstract);分类 cs.SE

AI总结 研究LLM代理生产可靠性有限问题,提出AgentTether运行时修复框架,通过抽象运行、构建关键转换图等定位故障子轨迹并转换为指导,经实验评估,该框架能提高修复效果,减少资源消耗,为代理部署提供实用可靠性层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19990 2026-07-08 cs.AI 新提交 83%

Reward as An Agent for Embodied World Models

奖励作为具身世界模型的智能体

Pu Li, Zhigang Lin, Qiang Wu, Yongxuan Lv, Fei Wang, Shan You

机构 * ACE Robotics(ACE机器人)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 提出奖励智能体框架和动态感知 rollout 多样化方法,通过鲁棒验证支持更广泛探索,缓解奖励黑客问题,提升世界模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06283 2026-07-08 cs.AI 新提交 79%

Task Decomposition-Guided Reranking for Adaptive Agent Skill Retrieval

用于自适应智能体技能检索的任务分解引导重排序

Yanping Chen, Weijie Shi, Wen Yang, Jiajie Xu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 针对技能库规模增长带来的技能选择挑战,提出SkillReranker框架,通过任务和技能语义分解构建执行图,利用交叉编码器评分,在多场景实验中有效提升任务性能、减少交互步骤并降低令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05483 2026-07-08 cs.LG cs.AI cs.LO cs.MA cs.PL 新提交 79%

PatchOptic for Shared-State LLM Workflows with Projected Views and Verified Structured Updates

用于具有投影视图和经过验证的结构化更新的共享状态大语言模型工作流的PatchOptic

Zhaoyu Bai, Jiaqi Cai

机构 * Weizmann Institute of Science(魏茨曼科学研究所) Massachusetts Institute of Technology(麻省理工学院)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究共享状态大语言模型工作流问题,提出受光学启发的PatchOptic接口,通过投影读取和验证结构化补丁实现,经PatchBench评估,该设计能减少泄漏和成本,保持输出质量,阻止违规并拒绝受损补丁。

Comments 24 pages, 13 figures, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05577 2026-07-08 cs.AI cs.CL cs.IR 新提交 62%

Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction

叙事世界模型:基于叙事学的长篇小说作者记忆

Mohammad Saifullah, Thomas Kornmaier, Taaha Kazi, Vasu Sharma, Aditya Sanjiv Kanade, Aanand Kumar Yadav

机构 * PocketFM(口袋FM)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 研究针对长篇小说作者记忆问题,提出叙事世界模型(NWM),结合叙事学时间状态图与查询条件混合检索,在多跳叙事学问答上显著优于基线,优势源于其独特表征,非提取方式。

Comments 23 pages, 4 figures; 9-page main text plus appendix. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09276 2026-07-08 cs.LG cs.AI 版本更新 62%

Learning The Minimum Action Distance

学习最小动作距离

Lorenzo Steccanella, Joshua B. Evans, Özgür Şimşek, Anders Jonsson

机构 * Department of Information and Communication Technologies, Universitat Pompeu Fabra(信息与通信技术系,庞培法华大学) Department of Computer Science, University of Bath(计算机科学系,巴斯大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于状态轨迹学习的马尔可夫决策过程状态表示框架,通过学习最小动作距离(MAD)来捕捉环境结构,有效支持目标引导强化学习和奖励塑造。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20342 2026-07-08 cs.HC cs.AI cs.CY 版本更新 57%

Narrative-Centered Emotional Reflection: An Early Prototype for AI-Supported Emotional Self-Reflection

以叙事为中心的情感反思:人工智能支持的情感自我反思的早期原型

Shou-Tzu Han

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 该研究以Reflexion为早期原型,通过整合情感检测、分层反思提示和隐喻故事生成等方法,探索结构化情感自我反思,支持用户超越基本情感分类进行自主情感探索,记录了理论驱动的情感计算方向。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏