arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 862 篇

2606.20601 2026-06-23 cs.HC cs.AI 新提交 70%

Zhinong AI: A Design-Science Study of an AI-Enabled Agricultural Decision-Support Platform for Smallholder Production

Zhinong AI:面向小农生产的AI赋能农业决策支持平台的设计科学研究

Zhaoyang Li, Jiaqi Liu, Ruijie Zhang

机构 * University of Sanya(三亚大学) Hebei International Studies University(河北国际关系学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本文通过设计科学研究,提出了一个集成信息推送、问答、诊断、日历管理等功能的小农决策支持平台,并构建了分层架构、闭环流程、评估指标和治理框架,为AI农业原型转化为可测试、负责任的基础设施提供了结构化研究框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16839 2026-06-16 cs.SE 新提交 70%

Towards LLM Accelerated Rapid Reviews for Software Tool Discovery -- Case for Log Anomaly Detection

面向软件工具发现的LLM加速快速综述——以日志异常检测为例

Jesse Nyyssölä, Hamza Bin Mazhar, Alexander Bakhtin, Matteo Esposito, Nana Reinikainen, Yuqing Wang, Ying Song, Davide Taibi, Mika Mäntylä

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 提出一种结合LLM筛选和编码代理的流水线,用于快速识别和运行软件工具,在日志异常检测案例中实现高效综述。

Comments 52nd Euromicro Conference on Software Engineering and Advanced Applications (SEAA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12834 2026-06-12 cs.AI 新提交 70%

Fantastic Scientific Agents and How to Build Them: AgentBuild for Rietveld Refinement

神奇的科学智能体及其构建方法:用于Rietveld精修的AgentBuild

Woong Shin, Craig A. Bridges, Marshall T. McDonnell, Rafael Ferreira da Silva

机构 * UT-Battelle, LLC(UT-Battelle有限责任公司) US Department of Energy (DOE)(美国能源部)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出AgentBuild框架,通过科学家编写的合同(包含评分标准、课程和知识库)自动构建科学智能体,用于X射线衍射数据的Rietveld精修,实现可复用的智能体编译而非手动调优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11238 2026-06-12 q-fin.GN cs.AI 新提交 70%

Artificial Intelligence in Ship Finance: Applications, Opportunities, and a Case Study in AI-Augmented Loan Origination

人工智能在船舶金融中的应用:机遇与AI增强贷款发起的案例研究

Lasse Dierich, Orestis Schinas

机构 * ShipFinance.ai HHX.blue GmbH Technical University of Munich(慕尼黑技术大学) University of the Aegean(爱琴海大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨AI在船舶金融中的应用,提出基于大语言模型的模块化架构,用于文档理解、信息提取和工作流自动化,以支持贷款申请流程。

Comments 9 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10241 2026-06-10 cs.AI 新提交 70%

Regimes: An Auditable, Held-Out-Gated Improvement Loop Demonstrated on LongMemEval with ActiveGraph

Regimes: 一种可审计的、保留验证集的改进循环——在ActiveGraph上的LongMemEval演示

Yohei Nakajima

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Regimes,一种基于事件溯源的可审计自主改进循环,通过ActiveGraph运行时实现故障记录、重放和保留集验证,在LongMemEval-S上提升0.05-0.10的准确率。

Comments 30 pages, 5 figures. Code and committed runs: https://github.com/yoheinakajima/regimes

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09674 2026-06-09 cs.AI cs.LO math.CO 新提交 70%

(Auto)formalization is supposed to be easy: Trellis process semantics for spelling out rigorous proofs

(自动)形式化应该很简单:用于详细阐述严格证明的Trellis过程语义

Wesley Pegden

机构 * Department of Mathematical Sciences, Carnegie Mellon University(卡内基梅隆大学数学科学系)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Trellis系统,通过确定性约束工作流和LLM代理迭代细化自然语言证明,实现Lean自动形式化,强调严格证明的可细化性。

Comments 15 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09084 2026-06-09 cs.CR cs.AI 新提交 70%

Context-Fractured Decomposition Attacks on Tool-Using LLM Agents: Exploiting Artifact Provenance Gaps

上下文碎片化解构攻击:利用工具使用LLM代理的工件来源鸿沟

Xiaofeng Lin, Yukai Yang, Daniel Guo, Sahil Arun Nale, Charles Fleming, Guang Cheng

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 针对工具使用LLM代理,提出上下文碎片化解构(CFD)攻击,利用跨上下文工件来源鸿沟实现多步越狱,成功率提升高达28.3个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08661 2026-06-09 cs.CR cs.AI cs.DB 新提交 70%

Data Agents Under Attack: Vulnerabilities in LLM-Driven Analytical Systems

数据代理遭受攻击:LLM驱动的分析系统中的漏洞

Kuncan Wang, Ziting Wang, Peizhuo Lv, Haoyang Li, Guoliang Li, Gao Cong, Wei Dong

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究系统分析了LLM驱动的数据代理的安全漏洞,提出了分层漏洞框架和攻击分类法,并在六个系统上评估了攻击效果,揭示了当前系统的重大安全缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18745 2026-08-20 hep-ex physics.comp-ph 新提交 67%

FAST-HEP: Compiling Declarative Analysis Workflows for High-Energy Physics and Beyond

FAST-HEP:为高能物理及其他领域编译声明式分析工作流

Luke Kreczko

专题命中 工作流自动化 :planning(abstract);workflow(abstract)

AI总结 FAST-HEP的Flow引擎将声明式工作流语言、编译器与运行时结合,编译生成与后端无关的执行计划,支持模块化替换与溯源记录,为高能物理及其他领域提供透明可重复的工作流基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14869 2026-08-18 cs.HC 新提交 67%

RaivenTracks: Branching Provenance for Conversational Visualization Workflows

RaivenTracks:面向对话式可视化工作流的分支溯源系统

Ella Hugie, Alexandra Irger, Grace Guo, Kenneth Moreland, David Pugmire, Scott Klasky, Hanspeter Pfister

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract)

AI总结 RaivenTracks是Raiven可视化管道的工作流感知扩展,通过两级状态管理架构实现可分支的版本树与细粒度撤销/重做,试点研究显示其支持可视化工作流的分支与恢复,为AI驱动科学工作流的溯源监督提供了新方向。

Comments *Ella Hugie and Alexandra Irger are co-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16048 2026-08-18 quant-ph cs.NA math.NA physics.app-ph 新提交 67%

zenDot: An LLM-integrated quantum TCAD platform for semiconductor quantum-device design and optimization automation

zenDot:一款集成大语言模型(LLM)的量子TCAD平台,用于半导体量子器件设计与优化自动化

Zeheng Wang, Yan Liu, Yue Hao, Genquan Han

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 zenDot是集成LLM的量子TCAD平台,可连接器件物理与LLM驱动的设计探索,在Si/SiO₂双量子点验证中完成18次设计迭代,将最差门保真度降低近30倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14207 2026-08-17 cs.RO cs.CV 新提交 67%

MMUSV-Sim: A Perception-Oriented Simulation and Data-Generation Platform for Multi-USV Cooperative Perception

MMUSV-Sim:面向多无人水面艇协同感知的感知导向型仿真与数据生成平台

Ziao Li, Jianxiong Ye, Biao Tang, Leping Zhang, Kun Zuo, Siyu Huang, Chenqiang Gao

机构 * School of Intelligent Systems Engineering, Sun Yat-sen University(中山大学智能工程学院) School of Intelligent Imagery Engineering, Beijing Film Academy(北京电影学院智能影像工程学院)

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 该研究提出基于Unreal Engine 5和Project AirSim的MMUSV-Sim仿真与数据生成平台,用于多USV协同感知,实验表明其生成的数据集可使激光雷达协同BEV船舶检测的AP@0.5达72.74,显著优于单USV方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13063 2026-08-14 cs.AI cs.CL cs.LG 新提交 67%

Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior (or: The Asymptotic AI)

罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)

Sam Mao

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。

Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12375 2026-08-14 cs.DB 新提交 67%

Pipeline Denotational Design: Correct-by-Construction Data Pipelines at Zero Cost

管道指称设计:零成本的构造正确性数据管道

Nikos Karayannidis

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 提出管道指称设计(PDD)方法论,在设计时零成本实现数据管道构造正确性,可验证 AI 生成管道的粒度一致性,已在生产工具链中实现并评估。

Comments Extended version of a work-in-progress paper; the experimental evaluation is in progress and will appear in a later revision. Builds on a companion grain theory paper, arXiv:2601.00995

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09719 2026-08-11 cs.HC 新提交 67%

Mirroring the Past: Exploring How Ancestral Digital Self Influences History Learning

镜像过去:探索祖先数字自我如何影响历史学习

Duo Gong, Fan Sun, Yucen Wang, Yufan Hu, Wen Zhong, Wei Zhang, Pengcheng An

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 该研究针对历史学习中学习者与自身的疏离问题,提出AI生成的“祖先数字自我”教学智能体,经被试内研究发现其可提升体验性指标,但未改善即时学习结果,为相关教育环境设计提供启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07952 2026-08-11 cs.LG cs.AI cs.CR cs.SE 新提交 67%

Persistent Semantic Entities in Tool-Augmented LLM Systems

工具增强型大语言模型系统中的持久语义实体

Zhaohui Wang

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 该研究定义工具增强型LLM系统的持久语义实体(PSEs),证实其在24款不同规模模型中普遍存在,偏好/指令污染难自校正,上下文隔离自验证可降低污染,为智能体系统安全提供关键发现。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). Camera-ready version; 32 pages . The openreview url is https://openreview.net/forum?id=zPjmtawzT8&noteId=CXB95ws5so and ICML poster url is https://icml.cc/virtual/2026/poster/60521

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03534 2026-08-05 cs.CR 新提交 67%

A Challenge-Nonce Freshness Gap in Project Veraison's TPM Reference Schemes, Found by Appraising Application-Layer Action Evidence End-to-End

通过端到端评估应用层行动证据发现Project Veraison的TPM参考方案中存在的挑战随机数新鲜度缺口

Anton Sokolov

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 本文发现Project Veraison的TPM参考方案存在挑战随机数新鲜度缺口,通过端到端测试验证修复方案,使重放Quote的评估结果变为否定,提升了RATS架构的安全性。

Comments 18 pages, 3 figures. Responsible disclosure: veraison/services#427, fixed in PR #432. Artifact and data: doi:10.5281/zenodo.20998730

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28836 2026-08-03 cs.ET cs.MA cs.NI 新提交 67%

The AnyLog Edge Data Fabric

AnyLog 边缘数据架构

Roy Shadmon, Mark Davidson, Eric Aquaronne, Massimiliano Pinto, Ori Shadmon, Moshe Shadmon

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 本文提出 AnyLog 边缘数据架构,该基于智能体与边缘的平台可在源端管理运营数据,通过多项技术让用户无需知晓资源位置即可操作分布式资源,为分布式 SQL 等提供类云操作模式,无单点故障且不依赖集中式基础设施。

Comments Keywords: IoT Data Management, Edge Data Management, Edge Data Fabric, Distributed Query, Edge AI, P2P Data Layer, Decentralized Data Layer. 30 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27918 2026-07-31 math.OC 新提交 67%

OptGraph: Large Language Models Enhanced Evolutionary Optimization Via Graph Retrieval-Augmented Generation

OptGraph:基于图检索增强生成的大语言模型增强进化优化

Xianchao Xiu, Jianhao Li, Huangyue Chen, Wanquan Liu

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 针对现有LLM自动化进化优化的局限,提出引入GraphRAG的OptGraph工作流,通过类型化图复用经验等方法,在基准数据集上较现有框架平均精确准确率提升8.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25326 2026-07-29 cs.GR cs.CG 新提交 67%

Functionally Grading the Slicing Process by Compiling Design Intent into Slicer Projects

通过将设计意图编译到切片器项目中对切片过程进行功能分级

Charles Wade, Devon Beck, Robert MacCurdy

专题命中 工作流自动化 :planning(abstract);workflow(abstract)

AI总结 研究如何对切片过程进行功能分级,核心方法是提出切片器项目编译的自动化工作流程,将异构隐式设计转换为切片器原生项目,主要贡献是通过示例展示该方法并开源实现,连接异构设计与切片器生态系统,助力功能分级FFF制造。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23588 2026-07-28 cs.CV 新提交 67%

JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents

JarvisHub:用于原生画布多模态创意智能体的开放框架

Yunlong Lin, Zixu Lin, Zhaohu Xing, Biqiang Li, Chenxin Li, Haonan Wang, Haitao Wu, Hengyu Liu, Jianghai Chen, Kaituo Feng, Kaixin Li, Shawn Chen, Shijue Huang, Sixiang Chen, Tsung-Yi Ho, Wenxuan Huang, Xiangyan Liu, Xiaomeng Hu, Xuanhua He, Yan Sun, Yunqing Zhao, Zhiqin Yang, Zehan Wang, Zhengyang Tang, Tianyu Pang, Xiangyu Yue

专题命中 工作流自动化 :agent(abstract);tool use(abstract)

AI总结 研究针对创意人工智能从单步到多模态创作转变中现有系统不足的问题,引入JarvisHub框架,以可编辑画布为核心,通过三层架构让智能体实现持续、人工可控的创意自动化创作。

Comments 15 pages, 9 figures. Project page: https://www.jarvishub.site/ Code github: https://github.com/LYL1015/JarvisHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21608 2026-07-27 cs.SE cs.AI cs.CL cs.CY 新提交 67%

From Obligation to Specification: A Survey on Validating EU AI Act Requirements in RE

从义务到规范:关于在需求工程中验证欧盟人工智能法案要求的调查

T. Y. Emmy Lai, Sven Giesselbach, Matthias Koch, Héctor Allende-Cid

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究围绕欧盟人工智能法案生效后组织面临的新义务,通过混合方法探索性研究,评估组织准备及对大语言模型智能验证工具的看法,发现虽法案相关但结构化机制缺失,该工具在映射义务等方面有前景但需保障措施,还概述了闭环方法最低要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20453 2026-07-24 cs.CL cs.AI cs.LG 新提交 67%

A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction

一种用于将大语言模型零样本适应谵妄预测的知识注入框架

Jessica Sena, Shesadree Priyadarshani, Miguel Contreras, Bharat Gandhi, Scott Siegel, Subhash Nerella, Parisa Rashidi

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对大语言模型零样本适应谵妄预测中领域知识不足问题,提出轻量级知识注入框架。在推理时用外部临床知识报告增强数据摘要,无需微调或检索。实验表明该方法能提升模型性能,缩小与前沿模型差距,且收益依赖临床意义内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18316 2026-07-22 cs.SE cs.AI cs.CL 新提交 67%

Binding Drift in Multi-Step Tool-Augmented Agents

多步工具增强智能体中的绑定漂移

Rahul Suresh Babu, Shashank Indukuri

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究多步工具增强智能体中实体绑定随时间的变化,区分绑定漂移与错误传播。通过实验发现实体锁定会放大错误操作,实用的重新验证器可减少错误,自然设置下基线智能体有漂移现象,且持久性和重新验证不可互换。

Comments 14 pages, 5 tables, 1 figure. Equal contribution by both authors. Code and data: https://github.com/shashank-indukuri/binding-drift

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18039 2026-07-21 cs.IR 新提交 67%

Evidence-in-the-Loop: Trace-Driven Optimization for Customer-Service LLM Agents

循证优化:面向客户服务语言模型代理的跟踪驱动优化

Chunming Wu, Dafei Qiu, Congde Yuan, Charles Quan, Jun Wu, Suipeng Li, Mo Wu, Gavin Xie, Hope Chen, Max Yao

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 研究面向客户服务语言模型代理的优化,提出循证客户服务代理工作流程,通过多种技术构建证据,结合政策引导编排。贡献混合RAG证据构建、循证问题/行动决策、跟踪驱动的RAG和重排器改进三种部署模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13306 2026-07-03 cs.GT 新提交 67%

EconCSLib: AI-Assisted Lean Formalization for Economics & Computation research

EconCSLib: 人工智能辅助的经济学与计算研究Lean形式化

Nikhil Garg

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 提出EconCSLib,一个基于Lean 4的库和工作流,利用语言模型辅助形式化经济学与计算领域的研究论文,通过人-AI-Lean协作流程实现论文声明到形式化语句的翻译与验证。

Comments Accepted to EC'26 Workshop on AI-Driven Research in EconCS (AI-EconCS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24177 2026-06-24 cs.SE cs.AI cs.CL cs.MA 新提交 67%

Agon: An Autonomous Large-Scale Omnidisciplinary Research System Built on Prompt Economy

Agon:基于提示经济学的自主大规模全学科研究系统

Youran Sun, Xingyu Ren, Chugang Yi, Jiaxuan Guo, Kejia Zhang, Jianda Du, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) The Chinese University of Hong Kong(香港中文大学) Stanford University(斯坦福大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 提出Agon研究编排系统,通过提示经济学循环实现大规模自主研究,将可验证任务自动化,不可验证判断留给人类,并分类了系统失败类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21167 2026-06-23 cs.PL cs.LO 新提交 67%

AI-Assisted Completion of CertiGC Proofs: An Experience Report

AI辅助完成CertiGC证明:经验报告

Shengyi Wang

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 本文报告使用Codex辅助完成CertiGC垃圾收集器证明的经验,通过引入记录后向边不变量修复证明,并审计清理了过时条件。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22774 2026-06-23 physics.optics 新提交 67%

Autonomous Generation of Metamaterial Databases Based on Multimodal Agents

基于多模态代理的元材料数据库自主生成

Shilong Qin, Zhicai Yu, Xuan Zheng, Yan Zhang, Aodi Yang, Kezhan Zhao, Qi Cheng Chen, Jian Wei You, Tie Jun Cui

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract)

AI总结 提出MetaDataGenAgent多模态多代理框架,通过文献到仿真的自动化流程,从非结构化科学文献中提取并生成元材料结构-响应数据库,实现远场波束偏转、近场全息成像等功能。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11722 2026-06-11 cs.LG cs.AI cs.CL 新提交 67%

ICA Lens: Interpreting Language Models Without Training Another Dictionary

ICA Lens: 无需训练另一本词典即可解释语言模型

Sida Liu, Feijiang Han

机构 * Independent Researcher(独立研究员) University of Maryland(马里兰大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出ICALens,基于独立成分分析(ICA)高效提取语言模型表示中可解释方向,无需训练稀疏自编码器,在SAEBench上表现竞争力。

Comments Ongoing Project

详情

展开后加载摘要…

URL PDF HTML 收藏