arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-08-21 至 2026-08-21 共收录 4 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 软件智能体 4 篇

2608.19799 2026-08-21 cs.CL cs.SE 新提交 84%

SWE-bench Science: Can Coding Agents Resolve Engineering Tasks in Science?

SWE-bench Science:编码智能体能解决科学领域的工程任务吗?

Zhipeng Xu, Jiahao Lu, Yining Zheng, Yuxin Wang, Xipeng Qiu

专题命中 软件智能体 :coding agent(title,abstract);repository(abstract);分类 cs.SE、cs.CL

AI总结 本研究推出SWE-bench Science基准,含20个领域98个仓库的119项任务,评估发现最优智能体pass@1低于50%,揭示科学软件工程的挑战,分析四类失败机制并经消融实验明确科学知识的作用,为编码智能体研究提供测试平台。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03392 2026-08-21 cs.SE 版本更新 83%

Self-Evolving Coding Agents

自进化编码智能体

Hao Zhou, Haichuan Hu, Ye Shang, Quanjun Zhang

专题命中 软件智能体 :coding agent(title,abstract);repository(abstract);分类 cs.SE

AI总结 本综述系统梳理自进化编码智能体领域,明确其与传统智能体的区别,提出分类法,分析该领域的挑战,为设计更优智能系统奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20195 2026-08-21 cs.SE cs.AI cs.HC 新提交 81%

From Agent Behaviour to Agent-Friendly Documentation: An Empirical Study of How Coding Agents Discover, Read, and Write Technical Documentation

从智能体行为到智能体友好型文档:关于编码智能体如何发现、阅读和编写技术文档的实证研究

Zhijun Gao, Jing Chen

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.AI

AI总结 本研究通过SWE-chat和AIDev两个数据集,揭示编码智能体的文档交互规律,发现面向智能体的制品占主导,文档与代码编辑关联弱,验证序列缺失,文档滞后代码,且"智能体友好型"文档的可操作性、可验证性缺乏行为支持。

Comments 14 pages, 1 figure, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19816 2026-08-21 cs.CY 新提交 50%

Understanding as an Explicit and Assessable Component of Frontier AI Safety Decisions

将理解作为前沿AI安全决策的明确且可评估的组成部分

Stephen Barrett, Robin Bloomfield, Alexandra Chirilă, Mamoon Masud, David Meredith Hardy, Phillip Mulvana

专题命中 软件智能体 :coding agent(abstract)

AI总结 该研究提出一种基于Assurance 2.0框架的临时方法,用于明确且可评估前沿AI安全决策中的理解,经两种场景测试,该方法可应用且能驱动工程工作。

详情

展开后加载摘要…

URL PDF HTML 收藏