arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-10 至 2026-07-10 共收录 14 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 14 篇

2607.08740 2026-07-10 cs.AI cs.PL cs.SE 新提交 84%

Workflow as Knowledge: Semantic Persistence for LLM-Mediated Workflows

作为知识的工作流:大语言模型介导的工作流的语义持久性

Emanuele Quinto, Carlo Andrea Rozzi, Francesco Zanitti

机构 * UNHCR København(联合国难民署哥本哈根办事处) CNR—Istituto Nanoscienze Modena(意大利国家研究委员会-纳米科学研究所摩德纳分所) ZeLe & F ApS København(泽勒与F有限公司哥本哈根分公司)

专题命中 工作流自动化 :workflow(title,abstract);tool use(abstract);分类 cs.AI、cs.SE

AI总结 研究大语言模型介导的工作流,提出受Lisp启发的概念模型,用符号形式等作解释视角,将工作流相关元素表示为持久知识对象,区分派生和推理,初步阐述了工作流的语义持久性。

Comments 39 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08288 2026-07-10 cs.CR cs.AI 新提交 83%

From Legacy Documentation to OSCAL: An MCP-Based Agent Pipeline for Threat-Informed Continuous Compliance in Critical Infrastructure

从遗留文档到OSCAL:基于MCP的代理管道,用于关键基础设施中的威胁情报驱动的持续合规性

Lea Roxanne Muth, Marian Margraf

机构 * Department of Mathematics and Computer Science(数学与计算机科学系)

专题命中 工作流自动化 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究针对关键基础设施运营技术环境无法主动扫描但需主动系统反馈的问题,提出基于MCP的多代理管道,将自然语言描述转换为知识图谱和OSCAL工件,架构解耦推理与检索,降低风险,在场景中取得一定召回率并生成报告,虽有错误但可人工审查。

Comments Accepted for publication at the 2026 IEEE International Conference on Cyber Security and Resilience (IEEE CSR), Lisbon, Portugal, August 3-5, 2026. 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08180 2026-07-10 cs.CR cs.AI 新提交 83%

Out of Sight: Compression-Aware Content Protection against Agentic Crawlers

视线之外:针对智能爬虫的压缩感知内容保护

Xuefei Wang

机构 * Beihang University(北航大学)

专题命中 工作流自动化 :agentic(title);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 研究基于LLM的智能体给在线内容带来的新威胁,提出CAPE框架,通过注入不可见扰动保护文本内容,在低查询预算下有效提升信息损失,实验证明其有效性与通用性,推动智能体时代内容保护研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08257 2026-07-10 cs.AI 新提交 70%

MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters

精神病院:一个用于评估精神科临床问诊的虚拟环境

Yuming Yang, Xiao Sun, Yuanwei Zou, Zhengxiao Wu, Yun Chen, Jiang Zhong, Haoyang Zeng, Jingwang Huang, Kaiwen Wei

机构 * School of Computer Science, Chongqing University(重庆大学计算机科学学院) School of Computer Science, Hunan University(湖南大学计算机科学学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 研究针对大语言模型在精神科临床问诊评估不足的问题,引入MentalHospital虚拟环境,实例化S.O.A.P.工作流程,用双轨协议评估,开发MentalEval,经测试其具有临床保真度且与专家高度一致,指出大语言模型在精神状态评估上落后临床医生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07974 2026-07-10 cs.CL cs.AI 新提交 62%

A Multi-cluster Boundary Learning Method for Out-of-Scope Intent Detection via MiniLM Embedding

一种基于MiniLM嵌入的多簇边界学习方法用于检测超出范围的意图

Yihong Xu, Mingyu Kang, Linyuan Lü

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 针对意图检测中超出范围意图检测的挑战,提出基于MiniLM嵌入的多簇边界学习方法,在单类分类工作流程中检测超出范围意图,实验表明该方法性能最优,所用MiniLM能更好适应相关要求。

Comments To submit

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10062 2026-07-10 cs.AI cs.MA 新提交 57%

Deployment-Time Memorization in Foundation-Model Agents

基础模型智能体中的部署时记忆

Lei, Chen, Guilin Zhang, Kai Zhao, Dalmo Cirne, Andy Olsen, Xu Chu, Zeke Miller, Alet Blanken, Amine Anoun, Jerry Ting

机构 * Lei (Rachel) Chen Guilin Zhang Kai Zhao Dalmo Cirne Andy Olsen Zeke Miller Xu Chu Alet Blanken Amine Anoun Jerry Ting

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究基础模型智能体在部署时记忆的设计选择如何影响个性化效用、提取风险和删除保真度,提出遗忘残差分数并揭示压缩与删除的权衡。

Comments 4 pages, ICML MemFM 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05969 2026-07-10 cs.CR cs.SE 版本更新 57%

Heimdallr: Characterizing and Detecting LLM-Induced Security Risks in GitHub CI Workflows

Heimdallr:在GitHub CI工作流中识别和检测LLM引发的安全风险

Bonan Ruan, Yeqi Fu, Chuqi Zhang, Jiahao Liu, Jun Zeng, Zhenkai Liang

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文研究GitHub CI工作流中LLM引发的安全风险,提出Heimdallr框架,通过流程图规范化和威胁向量检测,实现高精度识别LLM节点和威胁向量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04920 2026-07-10 cs.AI 版本更新 57%

Conversational AI for Rapid Scientific Prototyping: A Case Study on ESA's ELOPE Competition

用于快速科学原型设计的对话式人工智能:以欧空局的ELOPE竞赛为例

Nils Einecke

机构 * Honda Research Institute Europe GmbH(本田欧洲研究机构)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 以欧空局ELOPE竞赛为例,探讨用ChatGPT进行快速科学原型设计。介绍其在竞赛中的表现,包括提供代码、推理等,虽有局限但凸显人机协作潜力,分析优缺点,提出将大语言模型集成到科学工作流程可增强快速原型设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08529 2026-07-10 cs.IR 新提交 50%

Log-Insight: Automating Microservice Incident Diagnosis via Neuro-Symbolic Log Analysis

Log-Insight:通过神经符号日志分析实现微服务事件诊断自动化

Carlos Garcia-Hernandez, Aymane Abdali, Guangyu Wu, Mingxue Wang, Fei Shen, Zhaoyu Pang, Yanbin Zhang

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对大规模微服务系统生产事件诊断难题,提出Log-Insight系统,通过自动化SRE手动分类工作流程,经符号阶段处理后为LLM提供证据合成假设报告,六阶段管道减少大量原始事件,评估显示该系统能高效准确诊断根本原因,还报告了相关故障模式等内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02358 2026-07-10 cond-mat.stat-mech physics.soc-ph 新提交 50%

Contrarian Majority Dynamics: Violation of Detailed Balance and Nonequilibrium Steady States

逆反多数动力学:细致平衡的违反与非平衡稳态

Serge Galam

专题命中 工作流自动化 :agent(abstract)

AI总结 从统计力学角度重新审视含逆反者的Galam多数模型,揭示了其微观动力学、与平均场近似的区别以及非平衡稳态特性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15612 2026-07-10 cs.CE cs.CR q-fin.TR 版本更新 50%

SoK: Market Microstructure for Decentralized Prediction Markets (DePMs)

SoK:去中心化预测市场(DePMs)的市场微观结构

Nahid Rahman, Joseph Al-Chami, Jeremy Clark

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文通过回顾去中心化预测市场(DePMs)的历史和设计,分析了其模块化工作流程及各模块的设计变体,探讨了去中心化、表达性和抗操纵之间的权衡,并指出了研究中的开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10746 2026-07-10 cs.LO 版本更新 50%

Weakest Precondition Rules for Programs with Linear Temporal Specifications

具有线性时态规范的程序的最弱前置条件规则

Gidon Ernst

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究如何将软件模块集成中时态逻辑需求考虑进去,针对现有工具不足,提出一种简单通用能集成到现有验证条件生成器的解决方案来处理结构化程序与时态逻辑集成问题。

Comments Accepted at ISoLA 2026 - SpecifyThis

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22109 2026-07-10 q-fin.CP math.OC q-fin.PM stat.AP stat.CO 版本更新 50%

Low-Turnover Rebalancing for Sparse Index Tracking

用于稀疏指数跟踪的低换手率再平衡

Dimitrios Roxanas

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对稀疏指数跟踪中滚动重建存在的高换手率问题,提出将构建与维护分开的新工作流程,采用混合框架及自融资变量$\Delta w$,在标准普尔500风格案例中实现低换手率跟踪,且维护层可用于外部跟踪器改进。

Comments Rewritten in the language of generalised Bayesian inference and with the main focus on rebalancing and turnover. New case study and protocol

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12497 2026-07-10 cs.CR 版本更新 50%

Demystifying LLM Supply Chain Vulnerabilities in the Wild: Distribution, Root Cause, and Real-World Impact

揭开大语言模型供应链在实际应用中的漏洞:分布、根源及现实世界影响

Shenao Wang, Yanjie Zhao, Zhao Liu, Quanchen Zou, Haoyu Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究首次系统大规模实证分析大语言模型供应链漏洞,分析529个实际漏洞,发现漏洞集中在应用层等,特定漏洞源于独特特征,还研究了现实影响,提炼5条见解,为保障供应链安全提供数据基础与研究方向。

Comments Accepted by Internetware 2026

详情

展开后加载摘要…

URL PDF HTML 收藏