arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-08-03 至 2026-08-03 共收录 16 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4 篇

2607.28683 2026-08-03 cs.SE cs.AI 新提交 84%

Metaphor-Induced Algorithmic Steering: Cross-Domain Procedural Transfer in LLM Code Generation

隐喻诱导的算法引导:LLM代码生成中的跨领域过程迁移

Zhibo Hu, Chen Wang, Yanfeng Shu, Hye-young Paik, Liming Dong, Liming Zhu

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.AI

AI总结 本研究提出MASC框架,发现隐喻会诱导LLM代码生成模型迁移低效率过程模式,可高检测率识别此类隐喻技能与低效率实现,揭示其通过源场景过程模式迁移运作的机制。

Comments 12 pages, 11 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29529 2026-08-03 cs.SE 新提交 80%

AuditCoder: Responsibility-Preserving Task Graphs for Auditable Code Generation and Bounded Repair

AuditCoder:用于可审计代码生成与有界修复的责任保留任务图

Kangjie Huang, Chen Lyu

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE;repository(comments)

AI总结 AuditCoder通过带契约注释的任务图为代码生成保留责任标识,结合保守定位器与有界修复,在APPS、ClassEval数据集上取得优于CoT+重试的可审计代码生成效果。

Comments Preprint. 37 pages, 5 figures. Code and data are available at the project repository

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29389 2026-08-03 cs.LG cs.SE 新提交 76%

Simulation Code Generation for Fluid Systems using Large Language Models: Benchmarking Models and Prompting Strategies

基于大语言模型的流体系统仿真代码生成:模型与提示策略的基准测试

Jan Marius Stürmer, Jascha Knack, Tobias Koch, Andreas Weinmann

机构 * German Aerospace Centre (DLR)(德国航空航天中心) Technische Hochschule Würzburg-Schweinfurt(维尔茨堡-施韦因富特应用技术大学)

专题命中 代码生成 :code generation(title);分类 cs.SE、cs.LG

AI总结 本研究通过系统比较10种大语言模型与6种提示策略,评估其将流体系统模型图表示转换为WNTR、Modelica代码的能力,为相关设计流程提供指导,同时指出仿真保真度仍存差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29209 2026-08-03 cs.LG cs.AI 新提交 62%

SAF-OPD: Stable Advantage Fusion for On-Policy Distillation

SAF-OPD:面向策略内蒸馏的稳定优势融合

Yifan Ding, Xincheng Wei, Yoshua Y. Li, Ziheng Li, Yuquan Lu, Siyu Zhang, Dongsheng Ma, Rongxiang Weng, Xunliang Cai, Yun Chen

机构 * Shanghai University of Finance and Economics(上海财经大学) Meituan(美团) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Peking University(北京大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出SAF框架解决RLVR与OPD固定系数融合的熵崩溃问题,通过四阶段机制优化优势融合,在7个推理与代码生成基准上提升模型性能与训练稳定性。

Comments Working in progress

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 4 篇

2607.28815 2026-08-03 cs.SE 新提交 83%

Preventing Premature Commitment in Coding Agents with an Evidence-Conditioned Execution Layer

通过证据条件执行层防止编码智能体的过早提交

Yisen Xu, Chenglin Li, Zehao Wang, Jinqiu Yang, Tse-Hsun Chen

专题命中 软件智能体 :coding agent(title,abstract);repository(abstract);分类 cs.SE

AI总结 ECLoop是介于编码智能体与仓库间的证据条件执行层,可防止过早提交,在SWE-bench Verified上提升Pass@1指标4.8-11.8个百分点,同时降低平均token消耗。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29658 2026-08-03 cs.SE 新提交 79%

Reusing Past Repairs Through Hierarchical Trajectory Abstraction for Coding Agents

通过分层轨迹抽象复用编码智能体的过往修复工作

Yisen Xu, Jiayuan Zhou, Ruiqi Pan, Tse-Hsun Chen

专题命中 软件智能体 :coding agent(title);repository(abstract);分类 cs.SE

AI总结 本研究提出STAIR框架,通过分层轨迹抽象复用编码智能体过往修复经验,在SWE-bench Verified上显著提升修复智能体的Pass@1指标,且计划可跨智能体泛化。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28928 2026-08-03 cs.SE 新提交 79%

Automated Testing and Repair for Verified Compilers Generated by a Coding Agent

基于编码智能体生成的验证编译器的自动化测试与修复

Martin Rinard

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE

AI总结 该研究针对编码智能体生成的验证编译器,提出了基于智能体的自动化测试与修复系统,经评估其在Axon编译器上无奖励黑客攻击问题,可有效开展测试与修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28825 2026-08-03 cs.SE 新提交 57%

Building a Process-Modeling Tool using Agentic AI: An Experience Report on PM4Py-UCM

使用智能体AI构建流程建模工具:PM4Py-UCM的经验报告

Daniel Amyot

专题命中 软件智能体 :coding agent(abstract);分类 cs.SE

AI总结 本文通过AI辅助构建开源流程建模工具PM4Py-UCM的深入案例,提出相关工具包与分类法,总结了开发经验教训及验证策略。

Comments 17 pages, 9 figures, 4 tables, submitted to a conference

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 程序修复 3 篇

2607.29422 2026-08-03 cs.SE cs.AI cs.CR 新提交 62%

AgenticRepair: Multi-Faceted Program Context Engineering for Agentic Vulnerability Repair

AgenticRepair:面向智能体漏洞修复的多维度程序上下文工程

Michael Fu, Qiyue Mei, Patanamon Thongtanunam, Kla Tantithamthavorn

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 针对现有智能体漏洞修复方法缺乏多维度程序上下文工程的问题,提出AgenticRepair框架,协调三个LLM子智能体构建三类上下文,在SEC-Bench上取得73%的修复成功率,显著优于基线。

Comments Under Review at IEEE TSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28871 2026-08-03 cs.SE cs.AI 新提交 62%

Validation Evidence in LLM Repair Agents: How Much of What Passes Actually Tests the Bug?

LLM修复智能体中的验证证据:通过的测试究竟在多大程度上能检验缺陷?

Xiaonan Xu, Wenjing Wu

专题命中 程序修复 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 本研究以BSG-VA方法分析LLM修复智能体的验证证据,发现近半数阳性测试无缺陷区分信息,缺陷对比反馈可减少证据不足的部署,其效果幅度仍需进一步验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28855 2026-08-03 cs.GR cs.CV 新提交 50%

Learning Manifolds in High-D Point Embedding for Anisotropic Surface Approximation from Unstructured Point Clouds

用于非结构化点云各向异性曲面逼近的高维点嵌入学习流形

Hongbo Li, Haikuan Zhu, Xiaohu Guo, Wenping Wang, Jing Hua, Zichun Zhong

专题命中 程序修复 :repository(abstract)

AI总结 该研究提出HD-PEA框架,通过高维点嵌入等技术实现非结构化点云的各向异性曲面逼近,在多数据集上验证了其泛化性与可用性,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 代码评测 2 篇

2607.29626 2026-08-03 cs.AI 新提交 57%

AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimizers

AgentHPOBench:用于评估LLM智能体作为序列超参数优化器的基准

Tianyu Huai, Tingshuo Fan, Xinchi Chen, Yining Zheng, Yuxin Wang, Shuang Chen, Jie Zhou, Xuanjing Huang

专题命中 代码评测 :code generation(abstract);分类 cs.AI

AI总结 AgentHPOBench是含30个任务的序列基准,用于评估LLM智能体的超参数优化能力,实验显示其在多领域有优化能力,但在迭代优化等方面存在局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29417 2026-08-03 cs.CR 新提交 50%

Enforcing Cryptographic Distributed-VCS Access Control with No Trust on Servers

在不信任服务器的情况下实施密码学分布式版本控制系统访问控制

Xin Xu, Zhen Yang, Quanwei Cai, Jingqiang Lin, Liangqin Ren, Bo Chen, Yongfeng Huang

专题命中 代码评测 :repository(abstract)

AI总结 针对现有分布式VCS访问控制需中央服务器参与、写权限细粒度控制缺失的问题,提出基于ABE和ABS的DVAC方案,借助以太坊智能合约实现无中央服务器的文件粒度读写访问控制,原型开销较小且可与Git集成。

Comments Accepted manuscript. 15 pages, 7 figures. Published in Journal of Information Security and Applications, Vol. 93 (2025), Article 104103

Journal ref Journal of Information Security and Applications, 93 (2025), 104103

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仓库级理解 2 篇

2607.28775 2026-08-03 cs.SE 新提交 79%

Repository-Aware Metamorphic Relation Generation for Augmented Reality Applications using Large Language Models

基于大型语言模型的增强现实应用的仓库感知变形关系生成

Dibyendu Brinto Bose, Jiawei Qin, Chris Brown

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE

AI总结 本文提出一种结合仓库级上下文与推理编排的流水线,利用大型语言模型生成优化的变形关系,在142个移动AR仓库数据集上验证了该方法可构建可靠的领域相关测试预言,能有效检测代码变异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28654 2026-08-03 cs.CG 新提交 50%

Arranging circles of radii 1,2,...,n around a central circle: a Supnick TSP and certified finite optima

将半径为1,2,…,n的圆围绕一个中心圆排列:一个Supnick旅行商问题与已验证的有限最优解

Maurizio Falconi

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究针对半径1到n的圆围绕中心圆排列的优化问题,证明其最优循环顺序为Supnick顺序,验证3≤n≤14的全局最优解,提出R*(n)的渐近形式猜想。

Comments 10 pages, 2 figures; source code and certificate artifacts available at https://github.com/falker47/ringmin

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 程序分析与验证 1 篇

2607.29291 2026-08-03 cs.SC cs.LO 新提交 50%

SAT Certificates for the Matrix-Multiplication Challenges over F2: All Ten `Expected-UNSAT` Instances Are Satisfiable, and a Type-3-Free Rank-23 Scheme

F₂上矩阵乘法挑战的SAT证书:全部10个“预期不可满足”实例均可满足,以及一个无3型项的秩23方案

Nick Palladinos

专题命中 程序分析与验证 :repository(abstract)

AI总结 该研究针对F₂上的矩阵乘法SAT基准,发现10个预期不可满足的Challenge-2公式实际可满足,还构造了无3型项的秩23方案,生成了21个实例的SAT证书且可快速复现。

详情

展开后加载摘要…

URL PDF HTML 收藏