arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-22 至 2026-07-22 共收录 11 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 3 篇

2607.19104 2026-07-22 cs.SE cs.AI 新提交 81%

SciCodePile: A 128GB Corpus and Executable Benchmark for Challenging Scientific Code Generation

SciCodePile:用于具有挑战性的科学代码生成的128GB语料库和可执行基准测试

Weifeng Sun, Ye Fan, Yuchen Chen, Gou Tan, Jieke Shi, Yuan Yidi, Swee Liang Wong, Jonathan Pan, David Lo

机构 * Singapore Management University(新加坡管理大学) Nanjing University(南京大学) SUN YAT-SEN University(孙中山大学) Home Team Science & Technology Agency(家庭团队科技局)

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.AI

AI总结 研究大型语言模型处理科学代码的能力,提出SciCodePile语料库及可执行基准测试,评估15个模型在三项任务上的表现,发现科学代码生成极具挑战,同时展示了该语料库在训练上的效用,代码和数据可获取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18886 2026-07-22 cs.SE 新提交 70%

TraceDev: A Traceability-Driven Multi-agent Framework for Requirement-to-Code Development

TraceDev:一种用于需求到代码开发的可追溯性驱动的多智能体框架

Mingyu Chen, Yakun Zhang, Zihao Xie, Yixing Luo, Jinrui Xu, Cuiyun Gao, Kaiqi Zhao, Yunming Ye

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 针对现有方法在自然语言需求到代码转换中存在的不足,提出TraceDev多智能体框架,通过五个特定角色智能体及可追溯性图,实现自动化软件开发,在两个数据集上的评估结果证明了其在需求到代码生成上的有效性。

Comments Accepted by ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18348 2026-07-22 cs.LG cs.AI 新提交 62%

An Analysis of Residual-Stream Geometry Across Transformer Depth

跨Transformer深度的残差流几何分析

Sunit Bhattacharya, Ravi Shankar Kolli

机构 * ProRata AI(ProRata人工智能公司)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 研究跨Transformer深度的残差流几何规律,提出以转换为中心的分析方法,通过相对位移等测量揭示规律,如相对位移与层有关、旋转幅度恒定等,构建了测量框架,表明深度曲线依赖模型且条件稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 4 篇

2607.18859 2026-07-22 cs.AI 新提交 74%

PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents

PhoenixRepair:重新思考软件代理中的修复策略探索

Tianyue Jiang, Yanlin Wang, Xin He, Daya Guo, Jiachi Chen, Ming Wen, Ensheng Shi, Xilin Liu, Yuchi Ma, Guanbin Li

机构 * Zhejiang University(浙江大学) Huazhong University of Science and Technology(华中科技大学) Huawei CodeArts Model Team(华为代码艺术模型团队)

专题命中 软件智能体 :software agent(title);分类 cs.AI

AI总结 研究针对现有软件代理修复策略探索不足的问题,提出PhoenixRepair多代理框架,通过多位置采样、迭代反思优化等扩大搜索空间,实验表明该框架在解决率和故障定位精度上有提升,实现了7.8%的相对改进及76.0%的最高解决率Pass@1。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18742 2026-07-22 cs.SE 新提交 57%

Beyond Text Editing: Algebraic Manipulation of Source Code

超越文本编辑:源代码的代数操作

Kevin Pulo

专题命中 软件智能体 :coding agent(abstract);分类 cs.SE

AI总结 研究提出源代码代数方法,通过逻辑代数操作修改代码库,概述其操作属性。实验表明大语言模型代理用此方法完成代码更改成功率更高、令牌数更少,为代码编辑提供新方向,推动相关研究。

Comments Accepted for publication in the Visions and Emerging Results Track of the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), 14-18 September 2026, Benevento, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18347 2026-07-22 cs.SE cs.CR cs.MA 新提交 57%

A Decision-Centered Reference Architecture for Trustworthy Agentic Commerce

用于可信代理商务的以决策为中心的参考架构

Dimitrios S. Sfiris

专题命中 软件智能体 :software agent(abstract);分类 cs.SE

AI总结 研究针对代理商务问题,提出以决策为中心的与协议无关的架构,含规范信封等多种机制,通过开源实现、多场景和消融评估,支持受保护依赖项检测等多项功能,但未涵盖部分关键特性。

Comments 23 pages, 3 figures. Includes ancillary reproducibility materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18575 2026-07-22 cs.CR 新提交 50%

RECEIPT: Deterministic, Reward-Hacking-Resistant Verification for White-Box Agentic XSS Discovery

RECEIPT:用于白盒代理式XSS发现的确定性、抗奖励攻击验证

Muxi Lyu, Karen Shieh, Yiwei Hou, Hao Wang, Koushik Sen, David Wagner

专题命中 软件智能体 :coding agent(abstract)

AI总结 研究针对白盒代理式XSS发现中编码代理声明不可信的问题,提出RECEIPT验证框架,通过环境隔离等手段使发现可信,经实验评估,在预算内发现多个未知漏洞,相比其他方式能确认更多真实利用且无假阳性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 代码评测 1 篇

2607.18462 2026-07-22 cs.SE 新提交 57%

Beyond Resolved Rate: A Non-Functional Quality Study

超越解决率:非功能性质量研究

Xin Sun, Daniel Ståhl, Kristian Sandahl, Christoph Kessler

专题命中 代码评测 :repository(abstract);分类 cs.SE

AI总结 研究对比新旧模型在存储库级修复任务中生成补丁的非功能性质量,通过两个案例研究,用CodeQL等工具评估,发现新模型解决实例更多,但非功能性指标无一致改善,旨在推动对模型软件工程能力的全面评估。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 3 篇

2607.19096 2026-07-22 cs.AI cs.CL 新提交 62%

Supra Cognitive Modes: A Routed Architecture for Agent Memory

超认知模式:一种用于智能体记忆的路由架构

Joshua Tobkin, David Yang

机构 * Supra Research(超研)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI

AI总结 研究智能体记忆工作负载,提出超认知模式(SCM)架构,通过共享摄取底层及相关机制处理查询,在三个基准上进行表征,给出参考运行成绩等,展示了一种路由配置及故障模式,验证了相关设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18356 2026-07-22 cs.SE cs.AI 新提交 62%

CODENS: Transforming Code Changes into Living, Accessible, and Queryable Documentation

CODENS:将代码变更转化为生动、可访问且可查询的文档

Abdelhak Kelious, Chyrine Tahri, Eliot Bardet

机构 * CAPSENS

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究如何在快速发展代码库中维护文档,提出CODENS系统,它从拉取请求构建知识图,经语义提取等操作,通过三种检索模式展示知识,保留变更历史并集成评估指标,在项目中评估效果良好,但在文档综合方面有挑战。

Comments Accepted at the 26th ACM Symposium on Document Engineering (DocEng 2026). DOI: 10.1145/3820755.3832807

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18285 2026-07-22 cs.LG cs.AI 新提交 62%

Edge-Efficient Transformer for End-to-End RF Spectrum Monitoring

用于端到端射频频谱监测的边缘高效变压器

Zhifan Song, Haralampos-G. Stratigopoulos, Hassan Aboushady

机构 * Sorbonne Université, CNRS, LIP6(索邦大学、法国国家科学研究中心、巴黎第六大学信息与自动化实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 提出用于端到端射频频谱监测的E-SpecFormer,引入LiTAN注意力机制,有四种可扩展变体。在相关数据集测试中,Nano变体参数少、速度快,准确率高,以低成本超越现有边缘模型,是物联网设备实时频谱智能的高效解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏