arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-14 至 2026-07-14 共收录 311 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 23 篇

2607.10455 2026-07-14 cs.AI cs.CL 新提交 73%

ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm

ANCHOR:针对现实世界危害的CLI代理自动对齐审计

Kefan Song, Yanjun Qi

机构 * Anthropic(Anthropic公司)

专题命中 软件智能体 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 研究自主CLI代理在现实世界危害中的风险,提出ANCHOR自动审计框架,通过基于黑暗人格数据微调的审计代理模拟恶意用户,测试CLI代理,发现当前对齐技术不足,强调针对此类恶意用户进行安全评估的必要。

Comments Accepted at ICML 2026. 19 pages, 14 figures, 5 tables

Journal ref International Conference on Machine Learning, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10789 2026-07-14 cs.AI 新提交 70%

Imaging-101: Benchmarking LLM Coding Agents on Scientific Computational Imaging

成像101:在科学计算成像上对大语言模型编码智能体进行基准测试

Siyi Chen, Jiahe Ying, Yixuan Jia, Yuxuan Gu, Enze Ye, Weimin Bai, Zhijun Zeng, Shaochi Ren, Binhong Gao, Yubing Li, Tianhan Zhang, He Sun

机构 * College of Future Technology and the National Biomedical Imaging Center, Peking University(北京大学未来技术学院和国家生物医学成像中心) AI for Science Institute (AISI)(科学人工智能研究所) University of Michigan(密歇根大学) State Key Laboratory of Acoustics and Marine Information, Institute of Acoustics, Chinese Academy of Sciences(中国科学院声学研究所声场声信息国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) School of Astronautics, Beihang University(北京航空航天大学宇航学院) Key Laboratory of Spacecraft Design Optimization and Dynamic Simulation Technologies, Ministry of Education(教育部航天器设计优化与动态仿真技术重点实验室)

专题命中 软件智能体 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 研究针对计算成像构建正确重建管道费力的问题,引入含57个任务的Imaging-101基准及三个评估轨道,评估七个前沿大语言模型,发现应用编码智能体于计算成像存在系统性挑战,指出技能增强、领域专业化智能体是可靠成像辅助的途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04089 2026-07-14 physics.comp-ph cond-mat.str-el cs.AI cs.HC 版本更新 70%

From Paper to Program: Knowledge Externalization and Bottleneck Diagnosis in AI-Assisted Quantum Many-Body Programming

从论文到程序:AI辅助量子多体代码生成中的知识外化

Yi Zhou

机构 * Institute of Physics, Chinese Academy of Sciences, Beijing 100190, China(中国科学院物理研究所,北京100190,中国)

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 针对AI直接翻译论文为代码时因隐含约定导致失败的问题,提出知识外化方法,通过多阶段人机协作流程将隐式假设显式化,在DMRG和Pfaffian-MPS任务上验证了有效性。

Comments 20 pages, 4 figures. Substantially revised presentation, related-work context, reproducibility documentation, validation-gate wording, limitations, and generative-AI disclosure; numerical results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09361 2026-07-14 cs.DB 版本更新 67%

Bespoke-Card: Why Tune When You Can Generate? Synthesizing Workload-Specific Cardinality Estimators

Bespoke-Card:为何调优而非生成?合成工作负载特定的基数估计器

Johannes Wehrstein, Anton Winter, Timo Eckmann, Carsten Binnig

专题命中 软件智能体 :agent(abstract);planning(abstract)

AI总结 提出Bespoke-Card系统,通过智能体驱动合成工作负载特定的基数估计器,利用结构化q-error反馈和课程学习等策略,在JOB上降低33%总运行时间和41%中位数q-error。

Comments Accepted for AIDB@VLDB'26 (Boston)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04419 2026-07-14 cs.CL cs.AI cs.LG 版本更新 67%

Context-Dependent Affordance Computation in Vision-Language Models

视觉-语言模型中基于情境的可及性计算

Murad Farzulla

机构 * Dissensus AI King’s College London(伦敦国王学院)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究揭示视觉-语言模型中可及性计算的高度情境依赖性,通过大规模实验显示超过90%的词汇描述受情境影响,提出动态本体投影方法替代静态世界建模。

Comments 33 pages, 13 tables, 3 figures. Code available at: https://github.com/studiofarzulla/semantic-vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11565 2026-07-14 cs.LG cs.AI physics.flu-dyn 新提交 62%

Heuristic Learning for Active Flow Control Using Coding Agents

使用编码智能体的主动流动控制启发式学习

Paul Garnier, Jonathan Viquerat, Elie Hachem

机构 * Mines Paris - PSL University Centre for Material Forming (CEMEF) CNRS(巴黎矿业 - 巴黎文理研究大学材料成型中心(CEMEF)法国国家科学研究中心)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究主动流动控制中控制器设计难题,提出用编码智能体直接搜索显式可执行反馈律的启发式学习范式及受限协议,经多基准评估,其启发式控制器性能优、可解释,是传统强化学习的可靠互补替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11111 2026-07-14 cs.SE 新提交 57%

Know Before Fix: QA-Driven Repository Knowledge Acquisition for Software Issue Resolution

修复前先了解:用于软件问题解决的基于问答的仓库知识获取

Haotian Lin, Silin Chen, Xiaodong Gu, Yuling Shi, Chengxi Pan, Jiaqi Ge, Mengfan Li, Jianghong Huang, Mengchieh Chuang, Beijun Shen, Haibing Guan

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 研究针对基于大语言模型的编码代理解决软件问题易因仓库理解不足出错的问题,提出ACQUIRE框架,通过问答驱动在修复前获取仓库知识,经两阶段解耦知识获取与补丁生成,实验证明该框架能提升问题解决准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10712 2026-07-14 cs.CR cs.AI cs.DL 新提交 57%

Distributed Denial of Science: How Indirect Data Poisoning of AI Systems Can Industrialize Scientific Fraud

分布式科学否认:人工智能系统的间接数据投毒如何使科学欺诈产业化

Bálint Gyevnár, Atoosa Kasirzadeh, Nihar B. Shah

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究探讨人工智能时代科学欺诈新形式,即间接数据投毒。对手 corrupt 开放数据集上传,使自主研究代理处理后传播欺诈。通过多话题、多系统实验发现投毒成功率高而检测率低。提出科学家角色和数据溯源审计措施,后者可有效降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11601 2026-07-14 cs.CR 新提交 50%

Cardano's Voltaire Governance: Complete Specification and Research Program

卡尔达诺的伏尔泰治理:完整规范与研究计划

Nimrod Talmon, Oghenekaro Elem

专题命中 软件智能体 :agent(abstract)

AI总结 研究卡尔达诺的伏尔泰治理系统,给出其机制完整技术规范,涵盖架构、行动类型等;建立治理优化研究议程,含模拟平台设计等,提供初步结果如治理内核,助力推进区块链治理科学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10948 2026-07-14 eess.SY cs.SY 新提交 50%

Reinforcement Learning versus Optimization for Optimal Transmission Switching: A Comparative Study

最优输电切换的强化学习与优化方法比较研究

Yuanrui Sang, Israel Abiala, Rachel Gerdes

专题命中 软件智能体 :agent(abstract)

AI总结 研究最优输电切换问题,比较强化学习框架与基于混合整数线性规划的优化方法,通过在IEEE RTS-96 24节点系统上的案例研究发现,强化学习智能体在低预算下能产生接近最优解,生成可行解速度比优化求解器快两到三个数量级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10842 2026-07-14 cs.RO cs.SY eess.SY 新提交 50%

D-SafeMPC: Diffusion-Driven Safe Model Predictive Control with Discrete-Time Control Barrier Functions

D-SafeMPC:基于离散时间控制障碍函数的扩散驱动安全模型预测控制

Erdi Sayar, Ersin Daş, Joel W. Burdick, Alois Knoll, Erdal Kayacan

机构 * Paderborn University(帕德博恩大学) Illinois Institute of Technology(伊利诺伊理工学院) California Institute of Technology(加州理工学院) Technical University of Munich(慕尼黑工业大学)

专题命中 软件智能体 :planning(abstract)

AI总结 研究针对扩散模型用于机器人规划时无法保证安全和动态约束的问题,提出D-SafeMPC方法,通过控制障碍函数等引导扩散过程,结合迭代投影方案,经实验验证该方法能提升安全性、任务成功率和规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10017 2026-07-14 cs.MS cs.GR 新提交 50%

AcadGIS: A Single-Import Python Package for Reproducible, Publication-Ready Academic Maps

AcadGIS:一个用于生成可重现、适合发表的学术地图的单导入Python包

Ripon Chandra Malo, Shatabdi Roy, Tong Qiu

专题命中 软件智能体 :workflow(abstract)

AI总结 研究针对学术地图制作流程零散的问题,提出AcadGIS这个免费开源Python包,它能在一个命名空间下从高级命令创建面向发表的研究地图,通过三个用例展示其可将常见地图表示为紧凑脚本,解决了可访问性和可重复性问题。

Comments 19 pages, 8 figures, 2 tables, and 6 code listings. AcadGIS v0.2.0: https://github.com/riponcm/AcadGIS/releases/tag/v0.2.0

详情

展开后加载摘要…

URL PDF HTML 收藏

2. GUI与网页智能体 12 篇

2607.09716 2026-07-14 cs.RO 新提交 78%

RoboNav-Arm: Agentic AI-Driven Navigation and Obstacle Avoidance for Robotic Manipulator in Cluttered Environments

RoboNav-Arm:杂乱环境中机器人操纵器的智能AI驱动导航与避障

Aachal Sharma, Narendra Kumar Dhar

机构 * Centre for Artificial Intelligence and Robotics (CAIR), Indian Institute of Technology Mandi(人工智能与机器人中心(CAIR),印度曼迪理工学院)

专题命中 GUI与网页智能体 :agentic(title);planning(abstract)

AI总结 针对杂乱环境中机器人操纵器面临的挑战,提出含环境、中央协调和规划模块的安全任务执行框架,能实时检测与定位障碍物,依环境选算法规划轨迹并优化,在Gazebo Classic中评估,展现动态场景鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09375 2026-07-14 cs.RO 75%

Self-navigation in crowds: An invariant set-based approach

人群中的自主导航:基于不变集的方法

Veejay Karthik J, Leena Vachhani

机构 * Indian Institute of Technology Bombay(印度理工学院班加罗尔)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于不变集的自主导航方法,通过输入受限反馈控制器和规划策略,实现非协调拥挤环境中安全快速的多智能体导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07459 2026-07-14 cs.RO cs.CV 版本更新 71%

EmbodiedGen V2: An Agentic, Simulation-Ready 3D World Engine for Embodied AI

EmbodiedGen V2:用于具身人工智能的具有智能体特性、可用于模拟的3D世界引擎

Xinjie Wang, Liu Liu, Taojun Ding, Andrew Choi, Chaodong Huang, Mengao Zhao, Ziang Li, Jackson Jiang, Chunlei Yu, Shengxiang Liu, Wei Xu, Zhizhong Su

机构 * Horizon Robotics(地平线机器人) WuwenAI(悟文智能)

专题命中 GUI与网页智能体 :agentic(title)

AI总结 研究提出EmbodiedGen V2这个用于具身智能的3D世界引擎,通过统一表示解决资产组装问题。其生成环境支持多种任务,评估中资产管道表现良好,强化学习提升了模拟成功率,确立了它作为可扩展模拟基础设施的地位。

Comments Minor revisions to presentation; technical content and results remain unchanged. Project page: horizonrobotics.github.io/EmbodiedGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11185 2026-07-14 cs.AI 新提交 70%

SCALECUA: Scaling Computer Use Agents with Verifiable Task Synthesis and Efficient Online RL

SCALECUA:通过可验证任务合成和高效在线强化学习扩展计算机使用代理

Bowen Lv, Xiao Liu, Yanyu Ren, Hanyu Lai, Bohao Jing, Hanchen Zhang, Yanxiao Zhao, Shuntian Yao, Jie Tang, Yuxiao Dong

机构 * Tsinghua University(清华大学)

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究针对计算机使用代理扩展能力受限问题,提出ScaleCUA框架,通过可验证任务合成及高效训练实现。包括设计VeriGen生成任务、前沿采样提高效率、视觉上下文分割加速训练,在相关平台取得新的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01830 2026-07-14 cs.RO 版本更新 67%

What Matters in RL-Based Methods for Object-Goal Navigation? An Empirical Study and A Unified Framework

基于强化学习的目标导航方法中什么重要?实证研究与统一框架

Hongze Wang, Boyang Sun, Jiaxu Xing, Fan Yang, Marco Hutter, Dhruv Shah, Davide Scaramuzza, Marc Pollefeys

机构 * Computer Vision and Geometry Group, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机视觉与几何组) Robotics and Perception Group, University of Zurich, Switzerland(苏黎世大学机器人与感知组) Robotic Systems Lab, ETH Zurich, Switzerland(苏黎世联邦理工学院机器人系统实验室) Princeton Robotic Intelligence and SysteMs group, Princeton University, USA(普林斯顿大学机器人智能与系统组) Microsoft, Switzerland(微软公司)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 研究目标导航中基于强化学习方法各组件影响,通过分解导航管道为感知、策略和测试时增强三组件进行实证研究,引入统一框架,构建增强系统达领先性能,提供见解与建议,凸显当前智能体与人类导航差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11739 2026-07-14 cs.RO 新提交 50%

AutoPath: Learning Transferable Goal-Conditioned Stochastic Path Prior for Safe Navigation Without Human Demonstrations

AutoPath:学习可转移的目标条件随机路径先验以实现无人类示范的安全导航

Ziyang Zhang, Boyang Zhou, Zesong Yang, Haocheng Peng, Zeming Gai, Xiao Liang, Yujun Shen, Danping Zou, Ruizhen Hu, Hujun Bao, Zhaopeng Cui

机构 * Zhejiang University(浙江大学) Harbin Institute of Technology(哈尔滨工业大学) Ant Group(蚂蚁集团) Shanghai Jiao Tong University(上海交通大学) Shenzhen University(深圳大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 研究在复杂环境下的安全导航问题,提出学习可转移目标条件随机路径先验的方法,引入规范状态表示和结构化先验学习框架,实验证明该方法成功率高、效率有竞争力且可跨平台转移。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L). 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10374 2026-07-14 cs.RO cs.HC 新提交 50%

Navigating the Crowd: Non-linear MPC with Social Forces Dynamics for Human-Aware Robot Navigation

在人群中导航:用于人类感知机器人导航的具有社会力动力学的非线性模型预测控制

Stefano Trepella, Andrea Ostuni, Mauro Martini, Pablo Pueyo, Noé Pérez-Higueras, Marcello Chiaberge, Fernando Caballero, Luis Merino

机构 * Department of Electronics and Telecommunications, Politecnico di Torino(电子与电信系,都灵理工大学) School of Engineering, Pablo de Olavide University(工程学院,巴勃罗·德奥拉维德大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 研究针对自主机器人在人群中安全合规导航的挑战,提出基于社会力模型的非线性模型预测控制框架SFM-NMPC,将人类运动预测嵌入优化循环,能联合预测人机轨迹,经测试在社会合规性上优于基线,有效用于现实社会导航。

Comments 9 pages, 7 figures, accepted at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10288 2026-07-14 cs.RO 新提交 50%

PIER-Flow: Physics-Informed Efficient Rectified Flow for Real-Time Mobile Robot Navigation

PIER-Flow:用于实时移动机器人导航的物理信息高效整流流

Shibo Li, Zhongcheng Wang, Jiahe Cao, Jianhua Yang, Ke Wu

机构 * School of Automation, Northwestern Polytechnical University(西北工业大学自动化学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 研究针对移动机器人在复杂环境下导航问题,提出PIER-Flow策略。通过将MPC专家知识融入常微分方程,利用并行潜在采样等实现单步动作生成,经物理信息训练目标及异步架构提升性能,在模拟和实际部署中均取得良好效果,显著加速规划并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13843 2026-07-14 cs.HC 版本更新 50%

Rethinking the UI of GenUI: A Tale of Two Designs

重新思考GenUI的用户界面:两种设计的故事

Xiang 'Anthony' Chen, Savvas Dimitrios Petridis, Tian Deng, Humad Bari, Ruofei Du, Yang Li

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本研究通过对比两种GenUI设计(非结构化深度优先高保真 vs. 结构化广度优先低保真),探讨如何更好地支持早期0到1设计探索,发现结构化输入和广度优先工作流有优势但存在权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12842 2026-07-14 cs.RO 版本更新 50%

SmoothTurn: Learning to Turn Smoothly for Agile Navigation with Quadrupedal Robots

SmoothTurn: 为四足机器人敏捷导航学习平稳转向

Zunzhi You, Yunke Wang, Haolan Guo, Chang Xu

机构 * School of Computer Science, University of Sydney(悉尼大学计算机科学学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出SmoothTurn框架,通过引入序列目标到达奖励、扩展观测空间和自动目标课程,使四足机器人在高速运行时实现平稳转向,提升敏捷导航能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09656 2026-07-14 cs.RO 版本更新 50%

ReMoSPLAT: Reactive Mobile Manipulation Control on a Gaussian Splat

ReMoSPLAT:高斯点云上的反应式移动操作控制

Nicolas Marticorena, Tobias Fischer, Niko Suenderhauf

机构 * QUT Centre For Robotics, School of Electrical Engineering and Robotics at the Queensland University of Technology(昆士兰理工大学机器人中心,电气工程与机器人学学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 研究移动操纵器在不涉及高成本规划下如何利用高斯点云表示避免碰撞,提出基于二次规划公式的ReMoSPLAT反应式控制器,通过模拟实验验证其可行性,性能可媲美依赖完美信息的控制器,并在真实机器人平台进一步验证。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04404 2026-07-14 cs.RO 50%

A Ground Mobile Robot for Autonomous Terrestrial Laser Scanning-Based Field Phenotyping

一种用于自主地面激光扫描的田间表型分析机器人

Javier Rodriguez-Sanchez, Kyle Johnsen, Changying Li

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) The University of Georgia(佐治亚大学) Bio-Sensing, Automation and Intelligence Laboratory(生物传感、自动化与智能实验室) Agricultural & Biological Engineering(农业与生物工程) The University of Florida(佛罗里达大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本研究开发了一种自主地面机器人系统,利用高分辨率三维激光扫描仪实现田间表型分析,提高了田间作物生长监测的自动化和准确性。

Comments Submitted to Journal of Field Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 记忆与上下文管理 19 篇

2607.11433 2026-07-14 cs.AI 新提交 83%

Omni-Decision: A Progressive Evidence-State Agent System for Omni-Modal QA

全决策:一种用于全模态问答的渐进式证据状态智能体系统

Ming Ma, Yi Zhu, Yiran Zhong, Feida Zhu, Weigao Sun, Junhan Shi, Lingrui Mei, Tianming Yang, Steven Hoi

机构 * Institute of Neuroscience, Chinese Academy of Sciences(中国科学院神经科学研究所) University of Chinese Academy of Sciences(中国科学院大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 记忆与上下文管理 :agent(title);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 研究全模态问答中证据分散问题,提出全决策系统,将问答转化为证据闭合过程,维护结构化证据状态,通过确定性状态更新处理异构观察,提升了准确率,验证了证据状态控制在多步证据寻求中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10608 2026-07-14 cs.AI 新提交 83%

The Compliance Trap: Diagnosing How AI Agents Consume Conflicting Memory

合规陷阱:诊断人工智能代理如何处理冲突记忆

Yixiong Chen, Xinyi Bai, Alan Yuille

机构 * Johns Hopkins University(约翰·霍普金斯大学) Cornell University(康奈尔大学)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究人工智能代理处理冲突记忆的问题,提出E-P-R框架,通过在WebArena和MemTrapBench上实例化发现主要失败始于入口,冲突记忆导致合规陷阱,强调评估记忆增强型代理应考虑其处理记忆的全过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09748 2026-07-14 cs.AI cs.DC cs.LO cs.MA 新提交 79%

Replicating Belief, Not Bits: Epistemic State Replication for Agentic Systems

复制信念,而非比特:智能系统的认知状态复制

Jun He, Deying Yu

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 研究智能分布式系统中确定性逐比特复制不足的问题,提出认知状态复制(ESR)方法,将复制边界从数据可见性转移到知识可见性,定义相关安全性概念并给出协议,通过原型设计和模拟验证了可行性及能减少二次认知故障。

Comments 16 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11357 2026-07-14 cs.AI cs.SE 新提交 79%

OpsMem: Dual-Memory Reasoning with Cross-Memory Resonance for Failure Diagnosis

OpsMem:用于故障诊断的具有跨内存共振的双内存推理

Yongqian Sun, Rongchen Gao, Yu Luo, Wenwei Gu, Shenglin Zhang, Qingyi Guo, Qiuai Fu, Yaoliang Wu, Dan Pei

机构 * Huawei(华为)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 针对现代软件系统故障诊断中缺乏协调诊断状态与操作经验机制的问题,提出双内存框架OpsMem,通过跨内存共振等进行多智能体诊断,实验表明其在华为微服务故障诊断数据集上优于基线,提升了匹配度和相关性。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09794 2026-07-14 cs.AI cs.MA 新提交 74%

Agentic Context Learning with Self-Discovered Specification

通过自我发现的规范进行智能体上下文学习

Jike Zhong, Ming Li, Yuxiang Lai, Ziyan Yang, Jingyu Xie, Jihyung Kil, Zheda Mai, Shao-Yuan Lo, Ren Xiang, Konstantinos Psounis, Yuanyuan Lei

机构 * University of Southern California(南加州大学) University of Florida(佛罗里达大学) Emory University(埃默里大学) Adobe Research(Adobe研究院) The Ohio State University(俄亥俄州立大学) National Taiwan University(国立台湾大学)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI

AI总结 研究上下文学习困难的原因,发现其不仅需内容获取还需规范获取。设计PSCI干预措施,提取并强化局部规范,在多个模型上取得显著提升,验证了规范获取的重要性,表明上下文学习依赖内容与规范获取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11126 2026-07-14 cs.LG 新提交 70%

ToolAtlas: Learning Once, Reusing Everywhere with Tool-Side Memory

ToolAtlas:通过工具端内存实现一次学习、处处复用

Yue Fang, Zhibang Yang, Fangkai Yang, Xiaoting Qin, Liqun Li, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) Microsoft(微软)

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);分类 cs.LG

AI总结 研究针对大语言模型代理依赖外部工具时工具知识难共享问题,提出ToolAtlas框架,通过执行验证探测构建提供商端工具内存,经实验证明该框架能有效提升性能且可跨环境和框架复用,确立了提供商端工具内存范式。

详情

展开后加载摘要…

URL PDF HTML 收藏