arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 542 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 程序修复 542 篇

2607.28871 2026-08-03 cs.SE cs.AI 新提交 62%

Validation Evidence in LLM Repair Agents: How Much of What Passes Actually Tests the Bug?

LLM修复智能体中的验证证据:通过的测试究竟在多大程度上能检验缺陷?

Xiaonan Xu, Wenjing Wu

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 本研究以BSG-VA方法分析LLM修复智能体的验证证据,发现近半数阳性测试无缺陷区分信息,缺陷对比反馈可减少证据不足的部署,其效果幅度仍需进一步验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22580 2026-08-03 cs.SE cs.AI 版本更新 62%

RePaCA: Leveraging Reasoning Large Language Models for Static Automated Patch Correctness Assessment

RePaCA:利用推理型大语言模型实现静态自动化补丁正确性评估

Marcos Fuster-Pena, David de-Fitero-Dominguez, Antonio Garcia-Cabot, Eva Garcia-Lopez

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 RePaCA是利用推理型大语言模型的静态APCA技术,经强化学习微调后在Defects4J测试集上达83.1%准确率,泛化能力优于现有方法,可准确识别过拟合补丁并提升可解释性。

Comments Final published version in the Neurocomputing journal. Volume 701, 7 November 2026, 134583. DOI: https://doi.org/10.1016/j.neucom.2026.134583

Journal ref Neurocomputing (7 November 2026), Volume 701, 134583

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19843 2026-07-23 cs.SE cs.AI 新提交 62%

Beyond Fail-to-Pass: Iterative Hardening of Co-Generated Bug Reproduction Tests and Fixes

超越未通过测试:协同生成的错误重现测试与修复的迭代强化

Yuhao Tan, Zhibang Yang, Fangkai Yang, Yuan Yao, Yu Kang, Lu Wang, Pu Zhao, Xin Zhang, Xiaoxing Ma, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * Nanjing University(南京大学) Peking University(北京大学) Microsoft(微软公司)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 研究自动化程序修复中错误重现测试问题,指出仅用未通过到通过标准不足。提出CoHarden框架,先生成测试再迭代强化测试与修复,实验证明该框架在解决率等方面优于现有基线。

Comments 29 pages, 5 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13111 2026-07-16 cs.SE cs.AI 新提交 62%

SemaDiff: Identifying Semantic-Changing Commits with Generated Code and Tests

SemaDiff:使用生成的代码和测试识别语义变化的提交

Maha Ayub, Michael Konstantinou, Ahmed Khanfir, Nikolaos Tsantalis, Mike Papadakis

机构 * SnT, University of Luxembourg(卢森堡大学SnT分校) RIADI, ENSI, University of Manouba(突尼斯曼努巴大学RIADI与ENSI分校) Concordia University(康科德大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究软件仓库挖掘中区分语义保留与变化提交的问题,提出SemaDiff方法,通过行为分析、生成额外调用方法及依赖类等,实现对提交的语义判断,实验表明该方法能较准确地区分,语义变化提交检测精度高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04232 2026-07-07 cs.SE cs.CL 新提交 62%

Teaching Code LLMs to Reason with Intermediate Formal Specifications

使用中间形式规范训练代码语言模型进行推理

Minh Le-Anh, Cuong Chi Le, Tien N. Nguyen

机构 * FPT Software AI Center(FPT软件人工智能中心) University of Texas at Dallas(德克萨斯大学达拉斯分校) Hanoi Univ. of Science and Tech.(河内科学技术大学) Texas, USA(得克萨斯州,美国) Hanoi, Vietnam(河内,越南)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.CL

AI总结 研究可执行检查点规范生成,介绍SpecCoder框架从多种程序学习,能选正确规范拒错误执行。引入HumanExec基准测试,实验表明其提升了检查点规范质量及下游正确性推理和修复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20412 2026-07-07 cs.SE cs.AI cs.OS 版本更新 62%

kAgent: An execution-guided crash resolution agent for the Linux kernel

kAgent:一种用于Linux内核的执行引导式崩溃修复代理

Alex Mathai, Chenxi Huang, Suwei Ma, Jihwan Kim, Hailie Mitchell, Aleksandr Nogikh, Petros Maniatis, Franjo Ivančić, Junfeng Yang, Baishakhi Ray

机构 * Department of Computer Science, Columbia University(哥伦比亚大学计算机科学系) Google Inc.(谷歌公司) Google DeepMind(谷歌DeepMind)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 研究针对Linux内核崩溃修复难题,以内核开发者修复方式为灵感构建kAgent及支持工具栈,通过检查日志等步骤修复崩溃,消融特性定量分析,评估显示其能有效修复多种崩溃。

Comments Accepted to ICML, 2026; in the Deep Learning for Code Workshop. This paper was previously circulated as "CrashFixer"

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22647 2026-06-23 cs.CR cs.LG cs.SE 新提交 62%

RAVEN: Agentic RAG for Automated Vulnerability Repair

RAVEN:用于自动化漏洞修复的智能体检索增强生成框架

Varun Gadey, Zijie Liu, Alexandra Dmitrienko

机构 * University of Duisburg-Essen(杜伊斯堡- Essen大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.LG

AI总结 提出RAVEN框架,集成智能体RAG管道与可控迭代修复,利用开源LLM实现跨类型、跨语言的自动化漏洞修复,在160个真实CVE上达到83.13%修复成功率。

Comments 17 Pages, 4 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08717 2026-06-08 cs.SE cs.AI 版本更新 62%

Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents

调试调试器:面向软件工程智能体的失败锚定结构化恢复

Chenyu Zhao, Shenglin Zhang, Yihang Lin, Wenwei Gu, Zhimin Chen, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

机构 * Nankai University(南开大学) Tsinghua University(清华大学) Microsoft(微软)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出PROBE框架,通过遥测层、诊断层和指导门将运行时证据转化为结构化恢复指导,在代码修复、工作流恢复等场景中诊断准确率65.37%,恢复率21.79%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03194 2026-05-27 cs.CL cs.SE 62%

BeyondSWE: Can Current Code Agent Survive Beyond Single-Repo Bug Fixing?

BeyondSWE:当前代码代理能否超越单仓库错误修复?

Guoxin Chen, Fanzhe Meng, Jiale Zhao, Minghao Li, Daixuan Cheng, Huatong Song, Jie Chen, Yuzhi Lin, Hui Chen, Xin Zhao, Ruihua Song, Chang Liu, Cheng Chen, Kai Jia, Ji-Rong Wen

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.CL

AI总结 提出BeyondSWE基准测试,评估代码代理在跨仓库、领域特定、依赖迁移和文档生成等复杂软件工程任务上的表现,发现现有代理在利用外部信息进行精确代码修改方面仍存在显著不足。

Comments Benchmark: https://huggingface.co/datasets/AweAI-Team/BeyondSWE. Repo: https://github.com/AweAI-Team/BeyondSWE. Scaffold: https://github.com/AweAI-Team/AweAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06723 2026-04-09 cs.SE cs.AI 62%

Fine-grained Approaches for Confidence Calibration of LLMs in Automated Code Revision

细粒度方法用于LLMs在自动代码修订中的置信度校准

Hong Yi Lin, Chunhua Liu, Haoyu Gao, Patanamon Thongtanunam, Christoph Treude

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 本文提出细粒度置信度校准方法,通过局部Platt缩放提升自动代码修订任务中模型的置信度校准效果,降低校准误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05963 2026-04-08 cs.SE cs.LG 62%

QiMeng-PRepair: Precise Code Repair via Edit-Aware Reward Optimization

QiMeng-PRepair: 通过编辑感知奖励优化实现精确代码修复

Changxin Ke, Rui Zhang, Jiaming Guo, Yuanbo Wen, Li Ding, Shuo Wang, Xuyuan Zhu, Xiong Peng, Di Huang, Zidong Du, Xing Hu, Qi Guo, Yunji Chen

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器芯片国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Institute of Microelectronics, CAS(中国科学院微电子研究所)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG

AI总结 本文提出PRepair框架,通过Self-Breaking和Self-Repairing组件减少过度编辑,提升代码修复精度,实验显示在fix_1@1指标下精度提升31.4%。

Comments Accepted to ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15921 2026-03-18 cs.SE cs.AI 62%

VIBEPASS: Can Vibe Coders Really Pass the Vibe Check?

VIBEPASS:振动编码器真的能通过振动检查吗?

Srijan Bansal, Jiao Fangkai, Yilun Zhou, Austin Xu, Shafiq Joty, Semih Yavuz

机构 * Salesforce AI Research(Salesforce AI研究院) Nanyang Technological University(南洋理工大学)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 本文研究了振动编码器在自主软件工程中的能力,发现故障定位推理是瓶颈,而非代码生成或测试有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04936 2026-03-11 cs.PL cs.SE 62%

Floating-Point Usage on GitHub: A Large-Scale Study of Statically Typed Languages

GitHub上的浮点数使用:静态类型语言的大规模研究

Andrea Gilot, Tobias Wrigstad, Eva Darulova

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.PL

AI总结 本文通过大规模研究GitHub仓库中的浮点数使用,揭示了现实世界中浮点数运算的广泛应用,并发布数据集以帮助改进自动推理技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15701 2026-03-10 cs.AR cs.CL cs.LG 62%

HDLxGraph: Bridging Large Language Models and HDL Repositories via HDL Graph Databases

HDLxGraph: 通过HDL图数据库连接大型语言模型和HDL仓库

Pingqing Zheng, Jiayin Qin, Fuqi Zhang, Niraj Chitla, Zishen Wan, Shang Wu, Yu Cao, Caiwen Ding, Yang, Zhao

专题命中 程序修复 :repository(abstract);分类 cs.CL、cs.LG

AI总结 HDLxGraph通过整合HDL图特性与RAG,提升LLM在HDL任务中的搜索、调试和完成准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18403 2025-12-23 cs.SE cs.AI 62%

The Debugging Decay Index: Rethinking Debugging Strategies for Code LLMs

调试衰减指数:重新思考代码LLM的调试策略

Muntasir Adnan, Carlos C. N. Kuhn

机构 * Open Source Institute(开源研究所) University of Canberra(堪培拉大学)

专题命中 程序修复 :code generation(abstract);分类 cs.SE、cs.AI

AI总结 本文提出调试衰减指数(DDI)框架,通过战略重置方法优化代码生成系统的调试策略,揭示AI调试的局限性并提升迭代生成效率。

Journal ref Sci Rep 15, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14683 2025-12-09 cs.SE cs.AI 62%

Unified Software Engineering Agent as AI Software Engineer

统一软件工程代理作为AI软件工程师

Leonhard Applis, Yuntong Zhang, Shanchao Liang, Nan Jiang, Lin Tan, Abhik Roychoudhury

机构 * National University of Singapore(新加坡国立大学) Purdue University(普渡大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

AI总结 本文提出统一软件工程代理USEagent,旨在通过协调多种能力提升软件开发效率,通过USEbench验证其效果,发现其在复杂任务中表现优于现有代理。

Comments Leonhard Applis and Yuntong Zhang contributed equally to this work. To appear in ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20617 2025-11-26 cs.SE cs.PL 62%

Translating Large-Scale C Repositories to Idiomatic Rust

将大规模C仓库翻译为idiomatic Rust

Saman Dehghan, Tianran Sun, Tianxiang Wu, Zihan Li, Reyhaneh Jabbarvand

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.PL

AI总结 Rustine是一种高效自动化的C到idiomatic Rust翻译工具,实现了高质量的功能等价性,比现有方法更安全、更idiomatic且更易读。

Comments 21 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04134 2025-10-07 cs.LG cs.AI 62%

PhaseFormer: From Patches to Phases for Efficient and Effective Time Series Forecasting

Yiming Niu, Jinliang Deng, Yongxin Tong

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Beihang University(北航) Department of Computer Science and Engineering(计算机科学与工程系) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 程序修复 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02407 2025-09-10 cs.SE cs.LG 62%

Challenging Bug Prediction and Repair Models with Synthetic Bugs

Ali Reza Ibrahimzada, Yang Chen, Ryan Rong, Reyhaneh Jabbarvand

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG

Comments Published in SCAM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15822 2025-08-05 cs.SE cs.AI 62%

Do AI models help produce verified bug fixes?

Li Huang, Ilgiz Mustafin, Marco Piccioni, Alessandro Schena, Reto Weber, Bertrand Meyer

机构 * Constructor Institute of Technology(构造技术研究所)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08173 2025-06-11 cs.SE cs.AI 62%

Repeton: Structured Bug Repair with ReAct-Guided Patch-and-Test Cycles

Nguyen Phu Vinh, Anh Chung Hoang, Chris Ngo, Truong-Son Hy

机构 * Uppsala University Sweden Hanoi University of Science \& Technology Vietnam Knovel Engineering Lab Singapore The University of Alabama at Birmingham USA Uppsala University Hanoi University of Science \& Technology Knovel Engineering Lab The University of Alabama at Birmingham Institute for Clarity in Documentation Dublin Ohio USA Inria Paris-Rocquencourt Rocquencourt France Rajiv Gandhi University Doimukh Arunachal Pradesh India Tsinghua University Haidian Qu Beijing Shi China Palmer Research Laboratories San Antonio Texas USA Institute for Clarity in Documentation Inria Paris-Rocquencourt Rajiv Gandhi University Tsinghua University Palmer Research Laboratories

专题命中 程序修复 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04987 2025-06-06 cs.SE cs.AI 62%

A Multi-Dataset Evaluation of Models for Automated Vulnerability Repair

Zanis Ali Khan, Aayush Garg, Qiang Tang

机构 * Luxembourg Institute of Science and Technology (LIST)(卢森堡科学技术研究所)

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

Comments Preprint has been accepted in ARES AI&CCPS (International Workshop on Artificial Intelligence, Cyber and Cyber-Physical Security)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23422 2025-05-30 cs.SE cs.AI 62%

From Knowledge to Noise: CTIM-Rover and the Pitfalls of Episodic Memory in Software Engineering Agents

Tobias Lindenbauer, Georg Groh, Hinrich Schütze

机构 * School of Computation, Information and Technology, Technical University of Munich(计算、信息与技术学院,慕尼黑技术大学) CIS & MCML, LMU Munich(计算机科学与机器学习实验室,慕尼黑大学)

专题命中 程序修复 :repository(abstract);分类 cs.SE、cs.AI

Comments Short Paper, REALM '25 camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00057 2025-04-28 cs.LG cs.AI cs.CV 62%

VisTabNet: Adapting Vision Transformers for Tabular Data

Witold Wydmański, Ulvi Movsum-zada, Jacek Tabor, Marek Śmieja

机构 * Faculty of Mathematics and Computer Science, Jagiellonian University(数学与计算机科学学院,杰兹维日大学)

专题命中 程序修复 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07027 2025-04-10 cs.SE cs.CR cs.LG 62%

Using ML filters to help automated vulnerability repairs: when it helps and when it doesn't

Maria Camporese, Fabio Massacci

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13966 2025-02-21 cs.SE cs.LG 62%

Where's the Bug? Attention Probing for Scalable Fault Localization

Adam Stein, Arthur Wayne, Aaditya Naik, Mayur Naik, Eric Wong

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02629 2025-02-13 cs.CR cs.AI cs.CL 62%

Layer-Level Self-Exposure and Patch: Affirmative Token Mitigation for Jailbreak Attack Defense

Yang Ouyang, Hengrui Gu, Shuhang Lin, Wenyue Hua, Jie Peng, Bhavya Kailkhura, Meijun Gao, Tianlong Chen, Kaixiong Zhou

专题命中 程序修复 :code generation(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 4 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05006 2025-02-13 cs.SE cs.AI 62%

COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis

Weiqing Yang, Hanbin Wang, Zhenghao Liu, Xinze Li, Yukun Yan, Shuo Wang, Yu Gu, Minghe Yu, Zhiyuan Liu, Ge Yu

专题命中 程序修复 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17323 2025-02-12 cs.LG cs.AI 62%

xPatch: Dual-Stream Time Series Forecasting with Exponential Seasonal-Trend Decomposition

Artyom Stitsyuk, Jaesik Choi

专题命中 程序修复 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17218 2025-01-09 cs.SE cs.CR cs.LG 62%

To Err is Machine: Vulnerability Detection Challenges LLM Reasoning

Benjamin Steenhoek, Md Mahbubur Rahman, Monoshi Kumar Roy, Mirza Sanjida Alam, Hengbo Tong, Swarna Das, Earl T. Barr, Wei Le

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏