arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3188 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 3188 篇

2607.00911 2026-07-02 cs.SE 新提交 88%

From Registry to Repository: How AI Agent Skills Are Written, Adapted, and Maintained

从注册表到仓库:AI代理技能如何编写、适配和维护

Haoyu Gao, Jai Lal Lulla, Hong Yi Lin, Sebastian Baltes, Christoph Treude, Mansooreh Zahedi

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 本研究首次对AI代理技能作为工程制品进行实证分析,通过挖掘公共注册表和GitHub仓库中的技能,发现技能重用多为一次性复制,定制化主要适配本地环境,而行为契约几乎不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26721 2026-06-26 cs.SE cs.HC 新提交 88%

Knowledge-Based Pull Requests: A Trusted Workflow for Agent-Mediated Knowledge Collaboration

基于知识的拉取请求:一种可信的智能体中介知识协作工作流

Xinyu Zhang, Weiwei Sun

专题命中 软件智能体 :agent(title,abstract);workflow(title,abstract);分类 cs.SE

AI总结 提出知识型拉取请求(KPR)工作流,通过分离知识采纳与实现合并,利用智能体蒸馏外部知识并再生代码,以降低跨信任边界的软件协作成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07448 2026-06-08 cs.SE 新提交 88%

Agentic Very Much! Adoption of Coding Agent in New GitHub Projects

Agentic Very Much! 新GitHub项目中编码助手的采用

Romain Robbes, Théo Matricon, Thomas Degueule, Andre Hora, Stefano Zacchiroli

专题命中 软件智能体 :agentic(title,title_cn);agent(title);分类 cs.SE

AI总结 研究新创建的GitHub项目中编码助手的采用情况,发现采用率是之前研究的两倍以上,且AI辅助提交比例显著更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27575 2026-06-02 cs.AI 88%

Agyn: An Open-Source Platform for AI Agents with Scalable On-Demand Execution, Agent Definition as a Code, and Zero-Trust Access

Agyn:一个面向AI代理的开源平台,具有可扩展的按需执行、代理即代码定义和零信任访问

Nikita Benkovich, Vitalii Valkov

机构 * Agyn, Inc.(Agyn公司) Mila AI e-Lab

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 提出Agyn开源平台,通过信号驱动的有状态无服务器运行时、Terraform代理定义和零信任安全模型,解决AI代理在生产中的隔离、治理和扩展问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21129 2026-04-24 cs.MA cs.AI cs.DC 88%

AGNT2: Autonomous Agent Economies on Interaction-Optimized Layer 2 Infrastructure

AGNT2:交互优化的第二层基础设施上的自主代理经济

Anbang Ruan, Xing Zhang

机构 * NetX Foundation(NetX基金会)

专题命中 软件智能体 :agent(title,abstract);autonomous agent(title);AI agent(abstract);分类 cs.AI

AI总结 AGNT2提出一种三层架构,专为链上代理和微服务协调设计,通过侧车部署模式、P2P状态通道和依赖感知的rollup,解决代理经济中的执行层问题,包括序列化、状态、结算及数据可用性带宽缺口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00299 2026-04-02 cs.SE 88%

When is Generated Code Difficult to Comprehend? Assessing AI Agent Python Code Proficiency in the Wild

生成代码难以理解的条件是什么?评估AI代理在真实世界中的Python代码能力

Nanthit Temkulkiat, Chaiyong Ragkhitwetsagul, Morakot Choetkiertikul, Ruksit Rojpaisarnkit, Raula Gaikovina Kula

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 本研究通过分析AI生成的Python代码,发现其主要为初级水平,但特定任务可能需要高级技能来理解和维护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14373 2026-03-17 cs.SE 88%

Trust Over Fear: How Motivation Framing in System Prompts Affects AI Agent Debugging Depth

信任胜过恐惧:系统提示中的动机框架如何影响AI代理调试深度

Wu Ji

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 研究探讨了信任与恐惧动机框架对AI代理调试深度的影响,发现信任框架能显著提升问题发现和调查步骤,而恐惧框架无明显效果,揭示了动机框架对AI行为的关键作用。

Comments 13 pages, 2 tables, 23 references. Code and data: https://github.com/wuji-labs/nopua

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07749 2026-02-10 cs.AI 88%

Geo-Code: A Code Framework for Reverse Code Generation from Geometric Images Based on Two-Stage Multi-Agent Evolution

Geo-Code: 一种基于双阶段多智能体演化的几何图像反向代码生成框架

Zhenyu Wu, Yanxi Long, Jian Li, Hua Huang

机构 * School of Artificial Intelligence, Beijing Normal University, Beijing, China(人工智能学院,北京师范大学,北京,中国)

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 Geo-Code提出一种基于双阶段多智能体演化的几何图像反向代码生成框架,通过像素级锚定和度量驱动的代码演化提升几何重建精度和视觉一致性。

Comments ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12134 2026-01-21 cs.HC cs.AI 88%

Human-Human-AI Triadic Programming: Uncovering the Role of AI Agent and the Value of Human Partner in Collaborative Learning

人类-人类-人工智能三元编程:揭示人工智能代理和人类合作伙伴在协作学习中的作用

Taufiq Daryanto, Xiaohan Ding, Kaike Ping, Lance T. Wilhelm, Yan Chen, Chris Brown, Eugenia H. Rho

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 本文提出人类-人类-人工智能三元编程,通过实验表明三元协作能提升协作学习和社会存在感,且人类在AI建议前更注重理解,凸显AI辅助而非替代人类协作的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03556 2026-01-08 cs.SE 88%

Do Autonomous Agents Contribute Test Code? A Study of Tests in Agentic Pull Requests

自主代理是否贡献测试代码?对代理拉取请求中测试的调查

Sabrina Haque, Sarvesh Ingale, Christoph Csallner

专题命中 软件智能体 :agentic(title,abstract);autonomous agent(title);agent(abstract);分类 cs.SE

AI总结 研究分析了代理拉取请求中测试代码的出现频率及影响因素,揭示了测试代码对PR规模和处理时间的影响,为自主软件开发研究提供实证依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11398 2025-12-15 cs.SE cs.MA 88%

AutoFSM: A Multi-agent Framework for FSM Code Generation with IR and SystemC-Based Testing

AutoFSM:一种基于IR和SystemC的多智能体FSM代码生成框架

Qiuming Luo, Yanming Lei, Kunzhong Wu, Yixuan Cao, Chengjian Liu

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 AutoFSM通过引入结构化中间表示和SystemC建模,提升了FSM代码生成的可靠性与可扩展性,实验表明其在测试基准中表现优于现有框架。

Comments This version corrects a typo in the section title ("Intruction" -> "Introduction") that appears in the published version

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17153 2025-11-19 cs.SE 88%

UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging

Cheryl Lee, Chunqiu Steven Xia, Longji Yang, Jen-tse Huang, Zhouruixin Zhu, Lingming Zhang, Michael R. Lyu

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

Comments Accepted by EMNLP'25, Main Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17720 2025-08-26 cs.SE 88%

RepoTransAgent: Multi-Agent LLM Framework for Repository-Aware Code Translation

Ziqi Guan, Xin Yin, Zhiyuan Peng, Chao Ni

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15212 2025-02-24 cs.AI 88%

Measuring AI agent autonomy: Towards a scalable approach with code inspection

Peter Cihon, Merlin Stein, Gagan Bansal, Sam Manning, Kevin Xu

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

Comments NeurIPS Socially Responsible Language Modelling Research (SoLaR) Workshop 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07822 2024-12-12 cs.AR cs.LG 88%

MAGE: A Multi-Agent Engine for Automated RTL Code Generation

Yujie Zhao, Hejia Zhang, Hanxian Huang, Zhongming Yu, Jishen Zhao

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05311 2024-12-10 cs.AR cs.AI 88%

DRC-Coder: Automated DRC Checker Code Generation Using LLM Autonomous Agent

Chen-Chia Chang, Chia-Tung Ho, Yaguang Li, Yiran Chen, Haoxing Ren

专题命中 软件智能体 :agent(title,abstract);autonomous agent(title);multi-agent(abstract);分类 cs.AI

Comments Proceedings of the 2025 International Symposium on Physical Design (ISPD '25), March 16--19, 2025, Austin, TX, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06849 2026-08-13 cs.AI cs.CL 版本更新 88%

Causal Agent based on Large Language Model

基于大语言模型的因果智能体

Kairong Han, Kun Kuang, Ziyu Zhao, Junjian Ye, Fei Wu

专题命中 软件智能体 :agent(title,summary_cn);分类 cs.AI、cs.CL

AI总结 该研究针对LLM难以处理因果问题的挑战,提出Causal Agent框架,构建CausalTQA基准,实验显示其在多层级因果问题及真实数据集上性能优于SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13285 2026-07-16 cs.AI cs.SE 新提交 88%

Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable

Harness手册:使不断演进的智能体框架具有可读性、可导航性和可编辑性

Ruhan Wang, Yucheng Shi, Zongxia Li, Zhongzhi Li, Yue Yu, Junyao Yang, Kishan Panaganti, Haitao Mi, Dongruo Zhou, Leoweiliang

机构 * Tencent(腾讯) Indiana University(印第安纳大学) University of Maryland, College Park(马里兰大学帕克分校) University of Georgia(佐治亚大学) National University of Singapore(新加坡国立大学)

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);planning(abstract);agentic(abstract)

AI总结 研究智能体框架演进中行为定位难的问题,提出通过Harness手册和行为引导的渐进式披露,以行为为中心自动合成框架表示并辅助规划,提高行为定位和编辑计划质量,助力复杂智能体系统发展。

Comments 29 pages, 6 figures. Project page: https://ruhan-wang.github.io/Harness-Handbook/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22110 2026-06-23 cs.SE cs.AI cs.HC 新提交 88%

TraceView: Interactive Visualization of Agentic Program Repair Trajectories

TraceView: 智能体程序修复轨迹的交互式可视化

Amirali Sajadi, Tu Nguyen, Kimmie Huynh, Esteban Parra, Preetha Chatterjee

机构 * Belmont University(贝尔蒙特大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);tool use(abstract);workflow(abstract)

AI总结 提出TraceView工具,通过交互式可视化和语义关系标注,帮助开发者诊断LLM-based自动程序修复代理的失败原因,支持轨迹扫描与理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05400 2026-05-08 cs.SE cs.AI cs.HC 88%

Mise en Place for Agentic Coding: Deliberate Preparation as Context Engineering Methodology

代理编程的准备:作为情境工程方法论的刻意准备

Andrew Zigler

机构 * LinearB

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 本文提出了一种三阶段的代理编程准备方法,通过情境 grounding、协作规范和任务分解,提升 AI 编程的效率与质量,通过 hackathon 实验验证了准备阶段的重要性。

Comments 5 pages. Accepted at VibeX 2026, the 1st International Workshop on Vibe Coding and Vibe Researching, co-located with EASE 2026, Glasgow, June 9-12 2026. Camera-ready version. Research artifact: https://doi.org/10.5281/zenodo.19868258

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08638 2025-06-25 cs.AI cs.CL 88%

TRAIL: Trace Reasoning and Agentic Issue Localization

Darshan Deshpande, Varun Gangal, Hersh Mehta, Jitin Krishnan, Anand Kannappan, Rebecca Qian

机构 * Patronus AI

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);workflow(abstract);multi-agent(abstract)

Comments Dataset: https://huggingface.co/datasets/PatronusAI/TRAIL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07531 2025-01-14 cs.SE cs.AI 88%

Evaluating Agent-based Program Repair at Google

Pat Rondon, Renyao Wei, José Cambronero, Jürgen Cito, Aaron Sun, Siddhant Sanyam, Michele Tufano, Satish Chandra

专题命中 软件智能体 :agent(title,abstract);tool use(abstract);planning(abstract);agentic(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17381 2026-06-29 econ.EM stat.ML 版本更新 88%

An Auditable AI Agent Loop for Empirical Economics: A Case Study in Forecast Combination

一个可审计的AI代理循环用于实证经济学:以预测组合为例

Minchul Shin

专题命中 软件智能体 :agent(title,abstract);AI agent(title);workflow(abstract)

AI总结 提出一个开源代理循环架构,结合搜索后留出评估,使实证规范搜索透明化,在预测组合案例中独立代理搜索找到优于原始研究基准的方法。

Comments 36 pages, no figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20312 2026-05-21 cs.CR cs.LO cs.MA 88%

Pramana: A Protocol-Layer Treatment of Claim Verification in Autonomous Agent Networks

Pramana:自主代理网络中声明验证的协议层处理

Ravi Kiran Kadaboina

专题命中 软件智能体 :agent(title,abstract);autonomous agent(title,abstract)

AI总结 本文提出Pramana协议层,通过定义缺失的线缆格式,为自主代理网络中的声明验证提供结构化方法,结合经典印度认识论中的四种知识类型,确保验证过程的确定性和可追溯性。

Comments 23 pages, 4 figures, 5 tables, 42 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00917 2026-04-02 cs.SE cs.AI cs.LG 88%

Investigating Autonomous Agent Contributions in the Wild: Activity Patterns and Code Change over Time

在真实世界中研究自主代理的贡献:活动模式与代码变更趋势

Razvan Mihai Popescu, David Gros, Andrei Botocan, Rahul Pandita, Prem Devanbu, Maliheh Izadi

机构 * Delft University of Technology(代尔夫特理工大学) University of California, Davis(加利福尼亚大学戴维斯分校)

专题命中 软件智能体 :agent(title,abstract);autonomous agent(title);分类 cs.AI、cs.LG、cs.SE

AI总结 本文通过分析11万条开源拉取请求数据,研究自主编码代理在开源项目中的活动模式及代码变更,探讨其对代码质量、团队动态和软件维护性的影响。

Comments MSR 2026 Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17538 2025-12-22 cs.NI cs.CR 88%

Binding Agent ID: Unleashing the Power of AI Agents with accountability and credibility

绑定代理ID:通过问责与可信性释放AI代理的潜力

Zibin Lin, Shengli Zhang, Guofu Liao, Dacheng Tao, Taotao Wang

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract)

AI总结 BAID通过结合生物认证、去中心化身份管理和zkVM认证协议,为AI代理提供可验证的身份绑定,解决自主代理的问责与可信性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23946 2025-10-24 cs.AI cs.LG cs.MA cs.SE 88%

Lessons Learned: A Multi-Agent Framework for Code LLMs to Learn and Improve

Yuanzhe Liu, Ryan Deng, Tim Kaler, Xuhao Chen, Charles E. Leiserson, Yao Ma, Jie Chen

机构 * Rensselaer Polytechnic Institute(拉特兰理工学院) Massachusetts Institute of Technology(麻省理工学院) Michigan State University(密歇根州立大学) MIT-IBM Watson AI Lab, IBM Research(MIT-IBM沃森人工智能实验室,IBM研究院)

专题命中 软件智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI、cs.LG、cs.SE

Comments NeurIPS 2025. Code is available at https://github.com/MITIBM-FastCoder/LessonL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06379 2024-06-11 cs.CE 88%

FinVerse: An Autonomous Agent System for Versatile Financial Analysis

Siyu An, Qin Li, Junru Lu, Di Yin, Xing Sun

专题命中 软件智能体 :agent(title,abstract);autonomous agent(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.05253 2019-05-15 cs.CR 88%

Features and Operation of an Autonomous Agent for Cyber Defense

Michael J. De Lucia, Allison Newcomb, Alexander Kott

专题命中 软件智能体 :agent(title,abstract);autonomous agent(title,abstract)

Journal ref CSIAC Journal, v.7, n.1, April 2019, pp.6-13

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22711 2026-06-23 cs.SE cs.AI 新提交 87%

Beyond Simpson's Paradox: A Cascade of Confounders in AI Agent Pull-Request Co-Authorship

超越辛普森悖论:AI 智能体拉取请求合著中的级联混杂因素

Haoran Yu, Xiaochong Jiang, Lifei Liu, Su Wang, Pin Qian, Yihang Chen

机构 * Independent Researcher(独立研究者) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 软件智能体 :agent(title,abstract);AI agent(title);分类 cs.AI、cs.SE;agentic(comments)

AI总结 本研究通过分层分析和多级控制,揭示了AI编码智能体拉取请求合著与合并率之间的关联主要由智能体组成、仓库选择和PR结构等混杂因素驱动,而非因果关系。

Comments 5 pages. Accepted at the KDD 2026 Workshop on Agentic Software Engineering (SE 3.0)

详情

展开后加载摘要…

URL PDF HTML 收藏