arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3188 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 3188 篇

2606.13449 2026-06-12 cs.SE cs.AI 新提交 86%

Toward Instructions-as-Code: Understanding the Impact of Instruction Files on Agentic Pull Requests

面向指令即代码:理解指令文件对智能体拉取请求的影响

Ali Arabat, Mohammed Sayagh

机构 * École de Technologie Supérieure

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 通过分析148个项目的15549个智能体PR,发现指令文件对合并率、代码变更量和合并工作量无一致正面影响,但成功项目指令文件更长且结构更清晰,提出“指令即代码”研究方向。

Comments 5 pages, 8 figures, 23rd International Conference on Mining Software Repositories, April 13--14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10106 2026-06-10 cs.SE cs.AI 新提交 86%

What makes a harness a harness: necessary and sufficient conditions for an agent harness

什么使一个工具成为工具:智能体工具的必要和充分条件

Sanderson Oliveira de Macedo

机构 * Federal Institute of Goiás(戈亚斯联邦理工学院)

专题命中 软件智能体 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文通过概念分析,定义了智能体工具的必要和充分条件,并提供了包含/排除测试,以区分智能体工具与智能体框架、SDK、IDE插件等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26112 2026-05-26 cs.AI cs.LG 86%

From Model Scaling to System Scaling: Scaling the Harness in Agentic AI

从模型扩展到系统扩展:扩展智能体AI中的“缰绳”

Shangding Gu

机构 * UC Berkeley(伯克利大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);tool use(abstract);分类 cs.AI、cs.LG

AI总结 本文提出智能体AI的下一个瓶颈是系统扩展而非仅模型扩展,通过设计可审计、持久、模块化和可验证的架构(称为“缰绳”),并研究上下文治理、可信记忆和动态技能路由三大瓶颈,以推动智能体行为从模型能力向长期任务执行转化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24453 2026-05-26 cs.SE cs.AI 86%

Code2UML: Agentic LLMs with context engineering for scalable software visualization

Code2UML: 基于上下文工程的可扩展软件可视化的智能体LLM

Alin-Gabriel Văduva, Anca-Ioana Andreescu, Simona-Vasilica Oprea, Adela Bâra

机构 * Bucharest University of Economic Studies(布加勒斯特经济大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract,abstract_cn);分类 cs.AI、cs.SE

AI总结 提出一种基于五个专门智能体和确定性IR压缩层的智能体架构,用于从源代码仓库自动生成UML图,在12个开源仓库和7种UML图上验证了高语法有效性(平均91.5%)和结构质量(平均81.7/100),且质量不随规模下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18684 2026-05-19 cs.SE cs.AI 86%

Reversa: A Reverse Documentation Engineering Framework for Converting Legacy Software into Operational Specifications for AI Agents

Reversa:一个用于将遗留软件转换为AI代理操作规范的反向文档工程框架

Sanderson Oliveira de Macedo, Ronaldo Martins da Costa

机构 * Federal Institute of Goias(戈亚斯联邦理工学院) Federal University of Goias(戈亚斯联邦大学)

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出Reversa框架,旨在通过反向文档工程将遗留软件转换为AI代理可操作的规范,通过多代理流水线流程提取隐含规则,生成可追溯的操作规范,并提出评估协议以衡量覆盖率、可追溯性、置信度、效用和成本。

Comments Preprint. Includes a generative AI use statement

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15815 2026-05-18 cs.SE cs.CL cs.MA 86%

BootstrapAgent: Distilling Repository Setup into Reusable Agent Knowledge

BootstrapAgent: 将仓库设置提炼为可重用的代理知识

Sihan Fu, Oucheng Liu, Shiyuan Wang, Jin Shi, Chengkun Wei

机构 * Zhejiang University(浙江大学) The Australian National University(澳大利亚国立大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 软件智能体 :agent(title,abstract);planning(abstract);multi-agent(abstract);分类 cs.CL、cs.SE

AI总结 BootstrapAgent通过提炼仓库初始化过程中的启发式知识,生成可验证的代理合同,提升代码代理在 unfamiliar repositories 的任务成功率和效率。

Comments 19 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03551 2026-05-14 cs.SE cs.AI cs.HC 86%

AgenticFlict: A Large-Scale Dataset of Merge Conflicts in AI Coding Agent Pull Requests on GitHub

AgenticFlict:一个大规模的人工智能编码代理拉取请求中合并冲突数据集

Daniel Ogenrwot, John Businge

机构 * University of Nevada Las Vegas(内华达大学拉斯维加斯分校)

专题命中 软件智能体 :agent(title,abstract);agentic(abstract,abstract_cn);分类 cs.AI、cs.SE

AI总结 本文提出AgenticFlict数据集,用于研究AI编码代理生成的合并冲突问题,揭示了AI生成代码中合并冲突的频率和影响,强调了对AI辅助软件开发中集成挑战的理解需求。

Comments Accepted at the 3rd ACM International Conference on AI-Powered Software (AIware 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11229 2026-05-13 cs.CR cs.AI cs.SE 86%

Comment and Control: Hijacking Agentic Workflows via Context-Grounded Evolution

评论与控制:通过上下文引导进化劫持代理工作流

Neil Fendley, Zhengyu Liu, Aonan Guan, Jiacheng Zhong, Yinzhi Cao

机构 * Johns Hopkins University Applied Physics Lab(约翰霍普金斯大学应用物理实验室) Johns Hopkins University(约翰霍普金斯大学) Wyze Labs(Wyze实验室)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出JAW框架,通过上下文引导进化方法劫持自动化平台上的代理工作流,揭示代理工作流中因输入操控导致的安全风险,并展示了对GitHub和n8n的广泛影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17464 2026-04-21 cs.SE cs.AI 86%

Project Prometheus: Bridging the Intent Gap in Agentic Program Repair via Reverse-Engineered Executable Specifications

普罗米修斯计划:通过反向工程可执行规范弥合代理程序修复中的意图差距

Yongchao Wang, Zhiqiu Huang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出普罗米修斯框架,通过规范推断而非代码生成解决代理程序修复中的意图差距问题,实现了93.97%的正确补丁率和74.4%的救援率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03515 2026-04-14 cs.SE cs.AI cs.ET 86%

Inside the Scaffold: A Source-Code Taxonomy of Coding Agent Architectures

在框架内:基于源代码的编码代理架构分类

Benjamin Rombaut

专题命中 软件智能体 :agent(title,abstract);tool use(abstract);planning(abstract);分类 cs.AI、cs.SE

AI总结 本文通过分析13个开源编码代理框架的源代码,提出了一种基于架构的分类方法,揭示了控制策略、工具使用和资源管理的多样性,为研究代理行为和设计新框架提供了可复用的参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27524 2026-03-31 cs.SE cs.AI 86%

Safer Builders, Risky Maintainers: A Comparative Study of Breaking Changes in Human vs Agentic PRs

更安全的构建者,危险的维护者:人类与代理PR中破坏性变更的比较研究

K M Ferdous, Dipayan Banik, Kowshik Chowdhury, Shazibul Islam Shamim

机构 * Kennesaw State University(肯尼索州立大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 本文比较了人类与代理PR中破坏性变更的频率和任务情境,发现代理在维护任务中风险更高,存在'信心陷阱'问题。

Comments Accepted at 23rd International Conference on Mining Software Repositories (MSR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23761 2026-01-23 cs.SE cs.AI cs.MA 86%

TDFlow: Agentic Workflows for Test Driven Development

TDFlow: 为测试驱动开发设计的代理工作流

Kevin Han, Siddharth Maddikayala, Tim Knappe, Om Patel, Austen Liao, Amir Barati Farimani

机构 * Carnegie Mellon University(卡内基梅隆大学) UC San Diego(南加州大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 TDFlow通过测试驱动的工作流实现人类水平的测试解析,提升软件修复性能。

Comments Published in the 19th Conference of the European Chapter of the Association for Computational Linguistics (EACL 2026 Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08301 2025-11-12 cs.AI cs.SE 86%

Smarter Together: Creating Agentic Communities of Practice through Shared Experiential Learning

Valentin Tablan, Scott Taylor, Gabriel Hurtado, Kristoffer Bernhem, Anders Uhrenholt, Gabriele Farei, Karo Moilanen

机构 * The Memory Company(记忆公司) Moonsong Labs, Inc.(Moonsong实验室)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI、cs.SE

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25282 2025-10-09 cs.AI cs.HC cs.SE 86%

Toward Causal-Visual Programming: Enhancing Agentic Reasoning in Low-Code Environments

Jiexi Xu, Jiaqi Liu, Lanruo Wang, Su Liu

机构 * School of Information \& Computer Science University of California, Irvine Irvine, CA, USA Independent Researcher University of Texas at Dallas Dallas, TX, USA Georgia Institute of Technology Atlanta, GA, USA

专题命中 软件智能体 :agentic(title);agent(abstract);AI agent(abstract);workflow(abstract)

Comments 5 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05441 2025-10-08 cs.SE cs.AI 86%

UnitTenX: Generating Tests for Legacy Packages with AI Agents Powered by Formal Verification

Yiannis Charalambous, Claudionor N. Coelho, Luis Lamb, Lucas C. Cordeiro

机构 * The University of Manchester, UK(曼彻斯特大学,英国) ECE Department, Santa Clara University, US(圣克拉拉大学电子与计算机工程系,美国)

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17343 2025-09-23 cs.SE cs.AI 86%

Agentic AI for Software: thoughts from Software Engineering community

Abhik Roychoudhury

机构 * NUS(国立新加坡大学) SonarSource SA

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI、cs.SE

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03864 2025-05-08 cs.MA cs.AI cs.LG 86%

From Glue-Code to Protocols: A Critical Analysis of A2A and MCP Integration for Scalable Agent Systems

Qiaomu Li, Ying Xie

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11502 2025-04-17 cs.SE cs.LG 86%

Timing Analysis Agent: Autonomous Multi-Corner Multi-Mode (MCMM) Timing Debugging with Timing Debug Relation Graph

Jatin Nainani, Chia-Tung Ho, Anirudh Dhurka, Haoxing Ren

专题命中 软件智能体 :agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.LG、cs.SE

Comments 7 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10388 2025-01-27 cs.CY cs.AI cs.CL cs.GT cs.MA 86%

Beyond the Sum: Unlocking AI Agents Potential Through Market Forces

Jordi Montes Sanabria, Pol Alvarez Vecino

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

Comments 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17134 2024-10-29 cs.SE cs.AI 86%

RepairAgent: An Autonomous, LLM-Based Agent for Program Repair

Islem Bouzenia, Premkumar Devanbu, Michael Pradel

专题命中 软件智能体 :agent(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18122 2026-03-20 cs.AI cs.HC cs.PL cs.SY eess.SY 86%

Don't Vibe Code, Do Skele-Code: Interactive No-Code Notebooks for Subject Matter Experts to Build Lower-Cost Agentic Workflows

不要编写代码,而是构建骨架代码:面向领域专家的交互式无代码笔记本以构建低成本的代理工作流

Sriram Gopalakrishnan

机构 * JP Morgan Chase & Co.(摩根大通公司)

专题命中 软件智能体 :agentic(title,comments);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 Skele-Code通过自然语言和图形界面帮助非技术人员构建工作流,通过增量交互式笔记本开发减少token成本,生成模块化且易扩展的工作流。

Comments Main paper 9 pages. Topics: Agentic Coding, HCI, LLMs, Workflows

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13536 2026-08-17 cs.OS 版本更新 86%

Don't Let AI Agents YOLO Your Files: Information and Control in Agent-Native Filesystems

别让AI代理占用你的文件:将信息和控制移交给文件系统以实现代理安全和自主性

Shawn Wanxiang Zhong, Junxuan Liao, Jing Liu, Mai Zheng, Andrea C. Arpaci-Dusseau, Remzi H. Arpaci-Dusseau

专题命中 软件智能体 :agent(title,abstract);AI agent(title)

AI总结 本文研究了AI代理对文件系统的滥用问题,提出YoloFS文件系统通过三种技术提升代理的安全性和自主性,减少用户交互并提高任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26298 2026-05-27 cs.CR cs.OS 86%

Sandlock: Confining AI Agent Code with Unprivileged Linux Primitives

Sandlock: 使用非特权Linux原语限制AI代理代码

Cong Wang, Yusheng Zheng

专题命中 软件智能体 :AI agent(title,abstract);agent(title)

AI总结 提出Sandlock,一种轻量级Linux进程沙箱,通过静态策略编译和窄监督器分离实现无root、无cgroups、无镜像的进程隔离,支持动态网络决策和可逆文件系统效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16916 2026-03-19 cs.GT cs.MA 86%

Noncooperative Human-AI Agent Dynamics

非合作人机智能体动力学

Dylan Waldner, Vyacheslav Kungurtsev, Mitchelle Ashimosi

专题命中 软件智能体 :AI agent(title,abstract);agent(title)

AI总结 本文研究了人工智能代理与人类决策者在战略环境中的非合作互动动力学,通过不同预期效用与前景理论代理的组合,探讨混合群体竞争中的涌现行为。

Comments 41 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11274 2026-08-13 cs.CR cs.AI 新提交 85%

Agent Safety Should Be a Runtime Contract

智能体安全应成为运行时契约

Albus W. Ng, Yi Han, Jusheng Zhang, Wenhao Wang

专题命中 软件智能体 :agent(title,abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究指出将AI安全仅在训练阶段植入的范式不足,提出智能体安全应是兼具预防与证据层面的运行时契约,通过四类公开证据支撑该立场并给出研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09277 2026-08-11 cs.AI cs.PL 新提交 85%

P$^{3}$: Joint Program-and-Proof Planning for Verified Code Generation

P³:用于验证代码生成的程序与证明联合规划

Zenan Li, Ziran Yang, Peiyang Song, Zhaoyu Li, Kaiyu Yang

机构 * Apodex Princeton University(普林斯顿大学) Caltech(加州理工学院) University of Toronto(多伦多大学)

专题命中 软件智能体 :planning(title,abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 P³是一种用于验证代码生成的程序与证明联合规划的LLM智能体工作流,在三个基准上的求解率优于基线,还降低了API成本与运行时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28200 2026-07-31 physics.app-ph cond-mat.mtrl-sci cs.AI 新提交 85%

Vibe-FDTR: An agent-oriented framework for reproducible frequency-domain thermoreflectance data analysis

Vibe-FDTR:一种面向智能体的可复现频域热反射数据分析框架

Fuwei Yang, Weiheng Li, Bai Song

专题命中 软件智能体 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 Vibe-FDTR是面向智能体的FDTR数据分析框架,结合领域代码包与智能体技能,在基准测试中表现优异,可降低计算成本与执行时间,助力低门槛可信热计量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13196 2026-07-16 cs.SE 新提交 85%

From Human-Centric to Agentic Code Review: The Impact of Different Generations of Generative AI Technology on Review Quality

从以人类为中心到智能体代码审查:不同代际生成式人工智能技术对审查质量的影响

Suzhen Zhong, Shayan Noei, Bram Adams, Ying Zou

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.SE

AI总结 研究不同代际生成式人工智能技术对代码审查质量的影响,通过分析102万条GitHub拉取请求,识别三种人工智能审查者采用模式,将审查讨论建模为交互序列,发现智能体协作模式虽能提高效率,但未提升质量,为设计高效代码审查过程提供实证指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04613 2026-07-07 cs.AI cs.CR 新提交 85%

Governed Individuation: Cryptographically Decoupling an Agent's Learning from Its Authority

受治理的个体化:通过密码学方式将智能体的学习与其授权方解耦

Xue Qin, Simin Luan, Cong Yang, Zhijun Li

机构 * School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院)

专题命中 软件智能体 :agent(title,abstract);autonomous agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 研究智能体在部署中学习时,运行系统是否仍受操作员授权限制的问题。提出受治理的个体化方法,通过绑定身份摘要和基于语义效果的动作门控保证限制,证明学习等不会扩大权限,实证验证了该方法效果。

Comments Technical companion report. 25 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22417 2026-06-23 cs.AI 新提交 85%

Code Isn't Memory: A Structural Codebase Index Inside a Coding Agent

代码不是内存:编码代理中的结构化代码库索引

Ishaan Bhola, Adithyan Krishnan, Sravanth Kurmala, Mukunda NS

机构 * TransformerOptimus

专题命中 软件智能体 :agent(title,abstract);agentic(abstract,abstract_cn);分类 cs.AI

AI总结 通过消融实验和跨框架对比,研究在固定编码代理框架中增加结构化代码库索引对成本与解决率的影响,发现索引能显著提升定位和解决率且不增加成本。

Comments Code and data: https://github.com/TransformerOptimus/supercoder-eval

详情

展开后加载摘要…

URL PDF HTML 收藏