arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12097 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4087 篇

0907.3714 2014-11-20 hep-ph physics.comp-ph 71%

Optimising Code Generation with haggies

Thomas Reiter

专题命中 代码生成 :code generation(title)

Comments 66 pages, 5 figures, program files for download at http://www.nikhef.nl/~thomasr/

Journal ref Comput.Phys.Commun.181:1301-1331,2010

详情

展开后加载摘要…

URL PDF HTML 收藏
1407.6932 2014-07-28 cs.DC 71%

OMP2HMPP: HMPP Source Code Generation from Programs with Pragma Extensions

Albert Saà-Garriga, David Castells-Rufas, Jordi Carrabina

专题命中 代码生成 :code generation(title)

Comments Proceedings of HIP3ES Workshop, Vienna, January, 21st 2014

详情

展开后加载摘要…

URL PDF HTML 收藏
1307.6488 2013-07-25 physics.comp-ph cs.MS gr-qc 71%

From Physics Model to Results: An Optimizing Framework for Cross-Architecture Code Generation

Marek Blazewicz, Ian Hinder, David M. Koppelman, Steven R. Brandt, Milosz Ciznicki, Michal Kierzynka, Frank Löffler, Erik Schnetter, Jian Tao

专题命中 代码生成 :code generation(title)

Comments 18 pages, 4 figures, accepted for publication in Scientific Programming

详情

展开后加载摘要…

URL PDF HTML 收藏
1107.0538 2011-07-05 cs.DC 71%

Automatic Multi-GPU Code Generation applied to Simulation of Electrical Machines

Antonio Wendell De Oliveira Rodrigues, Frédéric Guyomarc'H, Jean-Luc Dekeyser, Yvonnick Le Menach

专题命中 代码生成 :code generation(title)

Comments Compumag 2011

详情

展开后加载摘要…

URL PDF HTML 收藏
1104.0628 2011-04-05 cs.MS 71%

Automated code generation for discontinuous Galerkin methods

Kristian B. Ølgaard, Anders Logg, Garth N. Wells

专题命中 代码生成 :code generation(title)

Journal ref SIAM J. Sci. Comput. 31(2), 2008, pp. 849-864

详情

展开后加载摘要…

URL PDF HTML 收藏
0809.0949 2009-12-01 cs.IT cs.DS math.IT 71%

Efficient Implementation of the Generalized Tunstall Code Generation Algorithm

Michael B. Baer

专题命中 代码生成 :code generation(title)

Comments 5 pages, 5 figures, accepted to ISIT 2009

详情

展开后加载摘要…

URL PDF HTML 收藏
hep-ph/0309251 2009-12-01 hep-ph 71%

Code generation (automatized programming) of symbolic formulae for helicity amplitudes

P. Cherzor

专题命中 代码生成 :code generation(title)

Comments 13 pages, LaTeX, axodraw.sty

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26469 2026-08-18 cs.SE 版本更新 70%

An Empirical Study of Speculative Decoding on Software Engineering Tasks

对软件工程任务中投机解码的实证研究

Yijia Li, Junkai Chen, Xing Hu, Xin Xia

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 本文通过实证研究评估了投机解码在软件工程任务中的有效性,发现其在代码生成、修复和编辑任务中表现各异,模型基于方法适合生成,模型无关方法更适合仓库级任务,且任务重复性提升模型无关方法性能。

Comments Accepted by ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26453 2026-08-11 cs.LG 版本更新 70%

Optimizing CUDA like a Human: Micro-Profiling Tools as Expert Surrogates for LLM-Based GPU Kernel Optimization

像人类一样优化CUDA:微剖析工具作为基于LLM的GPU内核优化的专家替代品

Jiading Gai, Shuai Zhang, Kaj Bostrom, Jin Huang, Vihang Patil, Haoyang Fang, Bernie Wang, Huzefa Rangwala, George Karypis

机构 * Amazon(亚马逊) Siemens(西门子) University of Minnesota(明尼苏达大学)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.LG

AI总结 提出KernelPro闭环多智能体系统,通过LLM代码生成与硬件剖析反馈及可插拔瓶颈检测工具迭代优化GPU内核,在KernelBench上实现2.42x/4.69x/5.30x加速比,并首次兼顾能效优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04270 2026-08-06 cs.SE cs.MA 新提交 70%

CURATE: Leveraging LLM Agents to Compose, Catalog, and Deploy Reproducible Workflows

CURATE:利用大语言模型智能体构建、编目和部署可复现工作流

Nolan Cutler, Chia-Chen Kuo, Nanda Velugoti, Kathryn Newhart, Renato Figueiredo

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

AI总结 该研究提出CURATE多智能体系统,覆盖工作流全生命周期,通过模块目录支持FAIR原则,用Claude Opus 4.8原型验证,完成6项含基准工作流复现及环境工程工作流开发的实验。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20690 2026-08-06 cs.CL 版本更新 70%

Learning to Detect UI Principle Violations via Reinforcement Learning

通过强化学习学习检测用户界面原则违规

Nishi Mehta, Swathi Alse, Himani Kumawat, Yue Yu, Pratik Jayarao

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) Carnegie Mellon University(卡内基梅隆大学)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.CL

AI总结 研究小型语言模型和编码代理生成的网页前端代码违反界面质量原则的问题,通过统一多来源的界面质量原则,构建数据集并利用强化学习训练轻量级视觉语言模型作为评判器,提升检测效果并发布相关方法支持评估和后续工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25199 2026-07-31 q-fin.CP cs.AI 版本更新 70%

RIDGE: An Autonomous Framework for Validation and Method Discovery in LLM-Generated Option Pricing

RIDGE:一个用于验证和发现大语言模型生成的期权定价方法的自主框架

Liexin Cheng, Xue Cheng, Shuaiqiang Liu, Cornelis W. Oosterlee

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI

AI总结 针对大语言模型生成的期权定价实现,介绍自主验证框架RIDGE,通过多种测试和检查优化定价实现与验证方法,应用于五个随机波动率模型,消除缺陷并带来新定价方法。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18886 2026-07-22 cs.SE 新提交 70%

TraceDev: A Traceability-Driven Multi-agent Framework for Requirement-to-Code Development

TraceDev:一种用于需求到代码开发的可追溯性驱动的多智能体框架

Mingyu Chen, Yakun Zhang, Zihao Xie, Yixing Luo, Jinrui Xu, Cuiyun Gao, Kaiqi Zhao, Yunming Ye

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 针对现有方法在自然语言需求到代码转换中存在的不足,提出TraceDev多智能体框架,通过五个特定角色智能体及可追溯性图,实现自动化软件开发,在两个数据集上的评估结果证明了其在需求到代码生成上的有效性。

Comments Accepted by ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00594 2026-07-21 cs.AI 版本更新 70%

Agent psychometrics: Task-level performance prediction in agentic coding benchmarks

代理心理测量:在代理编码基准中的任务级性能预测

Chris Ge, Daria Kryvosheieva, Daniel Fried, Uzay Girit, Kaivalya Hariharan

机构 * Massachusetts Institute of Technology(麻省理工学院) Fulcrum Carnegie Mellon University(卡内基梅隆大学)

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI

AI总结 本文提出了一种基于任务级性能预测的代理编码基准评估框架,结合IRT理论与任务特征,区分LLM和支架能力,以更准确预测未见基准和组合的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13757 2026-07-08 cs.CR cs.AI 新提交 70%

SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents

SEVRA-BENCH:审查智能体中的社会工程漏洞

Rui Melo, Riccardo Fogliato, Sean Zhou, Pratiksha Thaker, Zhiwei Steven Wu

机构 * Carnegie Mellon University(卡内基梅隆大学) Microsoft Core AI(微软核心人工智能) Amazon AWS(亚马逊AWS) Databricks

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI

AI总结 提出SEVRA-BENCH基准,通过社会工程攻击框架评估LLM代码审查智能体拒绝恶意PR的能力,发现闭源与开源模型间存在显著安全差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20881 2026-06-23 cs.AI 新提交 70%

When Do Intrinsic Rewards Work for Code Reasoning? A Comprehensive Study

内在奖励何时对代码推理有效?一项全面研究

Xiaolong Jin, Xuandong Zhao, Wenbo Guo, Xiangyu Zhang, Dawn Song

机构 * Purdue University(普渡大学) UC Berkeley(加州大学伯克利分校) UC Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 代码生成 :code generation(abstract);code model(abstract);分类 cs.AI

AI总结 通过系统实验,发现基于确定性的内在奖励方法在代码生成中早期有效但最终导致模型崩溃,且作为RLVR预训练无显著优势,并给出实用建议。

Comments 18 pages, 45 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03108 2026-06-15 cs.AI 版本更新 70%

EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning

EvoTrainer: 协同进化LLM策略与训练框架以实现自主智能体强化学习

Guhong Chen, Yingcheng Shi, Yongbin Li, Binhua Li, Xander Xu, Hu Wei, Shiwen Ni, Min Yang, Jieping Ye

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) Tongyi Lab , Alibaba Group(通义实验室,阿里巴巴集团) Alibaba Group(阿里巴巴集团) SUAT(深圳大学)

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI

AI总结 提出EvoTrainer框架,通过协同进化LLM策略和训练端框架,基于经验反馈自动诊断、修正并积累可复用技能,在数学推理、编程竞赛和仓库级软件工程任务上匹配或超越人工设计的RL基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15094 2026-06-09 cs.SE 版本更新 70%

Parameter-Efficient Multi-Task Fine-Tuning in Code-Related Tasks

代码相关任务中的参数高效多任务微调

Md Zahidul Haque, Saima Afrin, Antonio Mastropaolo

专题命中 代码生成 :code generation(abstract);code model(abstract);分类 cs.SE

AI总结 研究多任务QLoRA微调在代码生成、翻译和总结中的效果,发现其在1.5B、3B和7B规模上达到或优于单任务QLoRA和全微调,大模型平衡正确性与质量更佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25246 2026-06-02 cs.AI 70%

FrontierOR: Benchmarking LLMs' Capacity for Efficient Algorithm Design in Large-Scale Optimization

FrontierOR:基准测试大语言模型在大规模优化中高效算法设计的能力

Minwei Kong, Chonghe Jiang, Ao Qu, Wenbin Ouyang, Zhaoming Zeng, Xiaotong Guo, Zhekai Li, Junyi Li, Yi Fan, Xinshou Zheng, Xi Jing, Yikai Zhang, Zhiwei Liang, Seonghoo Kim, Runqing Yang, Zijian Zhou, Sirui Li, Han Zheng, Wangyang Ying, Ou Zheng, Chonghuan Wang, Jinglong Zhao, Hanzhang Qin, Cathy Wu, Paul Pu Liang, Jinhua Zhao, Hai Wang

机构 * Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工联盟研究技术) Massachusetts Institute of Technology(麻省理工学院) Northeastern University(东北大学) Uber Shanghai Jiaotong University(上海交通大学) Boston University(波士顿大学) Emory University(埃默里大学) Northwestern University(西北大学) National University of Singapore(国立新加坡大学) Microsoft(微软) University of Texas at Dallas(德克萨斯大学达拉斯分校) Singapore Management University(新加坡管理学院)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.AI

AI总结 提出FrontierOR基准,系统评估大语言模型在现实大规模优化问题中设计可扩展算法(而非仅生成求解器代码)的能力,发现最强模型仅在31%案例中优于Gurobi。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20926 2026-06-02 cs.SE 70%

Learning Reasoning World Models for Parallel Code

学习并行代码的推理世界模型

Gautam Singh, Arjun Guha, Bhavya Kailkhura, Harshitha Menon

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

AI总结 提出Parallel-Code World Models (PCWMs),通过推理LLM直接预测并行代码的工具输出,以解决并行代码训练数据稀缺问题,在数据竞争预测和性能分析任务上取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16561 2026-05-19 cs.PL cs.CR 70%

Compile-time Security Analysis and Optimization of Sensitive String Producers

编译时敏感字符串生成器的安全分析与优化

Mike Samuel, Tom Palmer, Shaw Summa, Robert Grayson

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.PL

AI总结 本文提出一种通用安全内容编译框架,通过扩展内容语言并整合到通用编程语言中,减少安全与不安全惯用法的词法距离,提升运行性能并提供开发者面向的诊断信息。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06464 2026-05-12 cs.SE 70%

To What Extent Does Agent-generated Code Require Maintenance? An Empirical Study

代理生成的代码需要多少维护?一项实证研究

Shota Sawada, Tatsuya Shirai, Yutaro Kashiwa, Ken'ichi Yamaguchi, Hiroshi Iwata, Hajimu Iida

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

AI总结 研究通过分析AI生成与人工编写代码的维护情况,发现AI代码维护频率较低,主要修改类型为功能扩展,而人工代码则以修复bug为主,人类开发者主导了大部分维护工作。

Comments 6 pages, 2 figures, 2 tables. Accepted at the 30th International Conference on Evaluation and Assessment in Software Engineering (EASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18165 2026-04-30 cs.AI cs.CL cs.LG cs.SE 70%

Saber: An Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model

Saber: 一种高效的采样方法,具有自适应加速和回溯增强的重新遮蔽,用于扩散语言模型

Yihong Dong, Zhaoyu Ma, Xue Jiang, Zhiyuan Fan, Jiaru Qian, Yongmin Li, Jianha Xiao, Zhi Jin, Rongyu Cao, Binhua Li, Fei Huang, Yongbin Li, Ge Li

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Tongyi Lab, Alibaba Group(阿里云实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出Saber算法,通过动态调整每步未遮蔽令牌数量和回溯机制提升代码生成的推理速度和输出质量,实验显示在多个基准上Pass@1准确率提升1.9%,推理速度提升251.4%。

Comments Accepted to ACL 2026 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10516 2026-04-28 cs.CL 70%

Structure-Grounded Knowledge Retrieval via Code Dependencies for Multi-Step Data Reasoning

通过代码依赖关系进行结构化知识检索以实现多步数据推理

Xinyi Huang

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.CL

AI总结 本文提出SGKR框架,通过函数调用依赖关系构建图结构,提升多步数据推理任务中知识检索的准确性与相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17330 2026-04-14 cs.SE 70%

Agentic Verification of Software Systems

软件系统的代理验证

Haoxin Tu, Huan Zhao, Yahui Song, Mehtab Zafar, Ruijie Meng, Abhik Roychoudhury

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.SE

AI总结 本文提出AutoRocq代理,通过与Rocq定理证明器协作实现程序验证,采用迭代优化提升证明质量,实验显示在SV-COMP和Linux内核模块上具有良好的自动验证效果。

Comments Camera-ready version appeared in the Proceedings of the ACM International Conference on the Foundations of Software Engineering (FSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09664 2026-04-08 cs.SE cs.AI cs.CL cs.PL 70%

CodeMind: Evaluating Large Language Models for Code Reasoning

CodeMind: 评估大型语言模型的代码推理能力

Changshu Liu, Yang Chen, Reyhaneh Jabbarvand

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出CodeMind框架,通过独立执行推理、规范推理和动态语义推理任务评估LLM的代码推理能力,发现LLM在处理复杂代码时性能下降,且bug修复性能与代码推理任务无关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27646 2026-03-31 cs.CL hep-lat hep-ph physics.comp-ph physics.optics 70%

PRBench: End-to-end Paper Reproduction in Physics Research

PRBench: 物理研究中的端到端论文复现

Shi Qiu, Junyi Deng, Yiwei Deng, Haoran Dong, Jieyu Fu, Mao Li, Zeyu Li, Zhaolong Zhang, Huiwen Zheng, Leidong Bao, Anqi Lv, Zihan Mo, Yadi Niu, Yiyang Peng, Yu Tian, Yili Wang, Ziyu Wang, Zi-Yu Wang, Jiashen Wei, Liuheng Wu, Aoran Xue, Leyi Yang, Guanglu Yuan, Xiarui Zhan, Jingjun Zhang, Zifan Zheng, Pengfei Liu, Linrui Zhen, Kaiyang Li, Qichang Li, Ziheng Zhou, Guo-En Nian, Yunwei Xiao, Qing-Hong Cao, Linjie Dai, Xu Feng, Peng Gao, Ying Gu, Chang Liu, Jia Liu, Ming-xing Luo, Yan-Qing Ma, Liang-You Peng, Huichao Song, Shufeng Wang, Chenxu Wang, Tao Wang, Yi-Nan Wang, Chengyin Wu, Pengwei Zhao, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Beijing Computational Science Research Center(北京计算科学研究中心)

专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.CL

AI总结 PRBench通过30个物理领域专家任务评估AI在复现科学论文中的能力,发现现有模型在数据准确性和代码正确性上表现不佳,揭示了系统性失败模式。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13170 2026-03-24 cs.CL 70%

Putting on the Thinking Hats: A Survey on Chain of Thought Fine-tuning from the Perspective of Human Reasoning Mechanism

戴上思考帽子:从人类推理机制视角对链式思考微调的综述

Xiaoshu Chen, Sihang Zhou, Ke Liang, Duanyang Yuan, Haoyuan Chen, Xiaoyu Sun, Lingyuan Meng, Xinwang Liu

机构 * College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学) College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学)

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.CL

AI总结 本文从人类推理机制角度综述了链式思考微调,分析其通过六顶思考帽子框架分类方法,并探讨未来研究方向及现有数据集与模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20795 2026-03-23 cs.CL 70%

Test-Time Alignment for Large Language Models via Textual Model Predictive Control

通过文本模型预测控制对大型语言模型进行测试时对齐

Kuang-Da Wang, Teng-Ruei Chen, Yu Heng Hung, Guo-Xun Ko, Shuoyang Ding, Yueh-Hua Wu, Yu-Chiang Frank Wang, Chao-Han Huck Yang, Wen-Chih Peng, Ping-Chun Hsieh

机构 * National Yang Ming Chiao Tung University NVIDIA National Taiwan University

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.CL

AI总结 本文提出TMPC方法,通过文本模型预测控制解决测试时对齐问题,通过分层强化学习原理改进生成过程,提升不同任务的性能。

Comments Accepted for ICLR 2026. Project page: https://rl-bandits-lab.github.io/TMPC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13201 2026-03-17 q-bio.GN cs.AI cs.MA 70%

Benchmarking LLM-based agents for single-cell omics analysis

对基于大语言模型的代理在单细胞组学分析中的性能评估

Yang Liu, Lu Zhou, Xiawei Du, Ruikun He, Xuguang Zhang, Rongbo Shen, Yixue Li

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.AI

AI总结 本文提出一个评估系统,用于严格评估代理在单细胞组学分析中的能力,发现Grok3-beta在测试框架中表现最佳,多代理框架通过角色分工提升协作与执行效率。

Comments please see clear figures in this version. 6 main figures; 13 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏