arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-05-15 至 2026-05-15 共收录 12 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 12 篇

2605.14478 2026-05-15 cs.SE cs.AI cs.CL 85%

When Retrieval Hurts Code Completion: A Diagnostic Study of Stale Repository Context

当检索伤害代码补全:对过时仓库上下文的诊断研究

Haojun Weng, Qianqian Yang, Hao Fu, Haobin Pan, Xinwei Lv

机构 * Independent Researcher, California, USA(加利福尼亚独立研究员) Independent Researcher, Beijing, China(北京独立研究员)

专题命中 代码生成 :repository(title,abstract);code generation(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文研究过时仓库片段是否对代码生成造成影响,通过对比不同检索条件发现,仅使用过时片段会显著增加错误引用,而加入当前证据可缓解问题。

Comments 31 pages, 2 tables. Submitted to Information and Software Technology (Elsevier)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21104 2026-05-15 cs.LG cs.PL 81%

BRIDGE: Building Representations In Domain Guided Program Synthesis

BRIDGE: 在领域引导的程序合成中构建表示

Robert Joseph George, Carson Eisenach, Udaya Ghai, Dominique Perrault-Joncas, Anima Anandkumar, Dean Foster

机构 * California Institute of Technology(加州理工学院) Amazon(亚马逊)

专题命中 代码生成 :program synthesis(title,abstract);分类 cs.LG、cs.PL

AI总结 BRIDGE通过多艺术ifacts程序合成框架提升Lean验证正确性,结合代码、规范和定理证明领域,提高生成效率和正确率。

Comments 41 pages, 10 figures, 3 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13864 2026-05-15 cs.PL 74%

Source-to-Source Transformations for GPU Code Generation

面向GPU代码生成的源到源转换

Julien de Castelnau, Thomas Koehler, Arthur Charguéraud, Clément Pit-Claudel

专题命中 代码生成 :code generation(title);分类 cs.PL

AI总结 本研究提出OptiGPU系统,通过源到源转换实现GPU编程的强安全性保障,减少传统方法在安全性和低层控制间的权衡,通过证明保留编译提升验证效率。

Comments Master's thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14215 2026-05-15 cs.AI cs.LG q-bio.QM 62%

GenCircuit-RL: Reinforcement Learning from Hierarchical Verification for Genetic Circuit Design

GenCircuit-RL:基于分层验证的遗传电路设计强化学习

Noah Flynn

机构 * University of California, Berkeley, CA, USA(加州大学伯克利分校)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出GenCircuit-RL框架,通过分层验证奖励和课程学习提升遗传电路设计的正确性与功能推理能力,实验表明其在功能推理任务中成功率提升14-16个百分点。

Comments Link: https://icml.cc/virtual/2026/poster/61789

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13935 2026-05-15 cs.LG cs.CL 62%

Beyond Mode-Seeking RL: Trajectory-Balance Post-Training for Diffusion Language Models

超越模式寻求强化学习:扩散语言模型的轨迹平衡后训练

Saba Ahmadi, Prasanna Parthasarathi, Yufei Cui

机构 * Noah’s Ark Lab(Noah’s Ark 实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.LG

AI总结 本文提出TraFL方法,通过轨迹平衡目标提升扩散语言模型的后训练效果,在多个基准测试中均优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14539 2026-05-15 cs.CL 57%

Learning from Failures: Correction-Oriented Policy Optimization with Verifiable Rewards

从失败中学习:具有可验证奖励的纠正导向策略优化

Mengjie Ren, Jie Lou, Boxi Cao, Xueru Wen, Hongyu Lin, Xianpei Han, Le Sun, Xing Yu, Yaojie Lu

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室) University of Chinese Academy of Sciences(中国科学院大学) Xiaohongshu Inc(小红书公司)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出CIPO方法,通过将失败轨迹转化为纠正监督,提升大语言模型的推理和纠错能力,在11个基准测试中优于基线方法。

Comments Work on progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14503 2026-05-15 cs.SE 57%

Not All RAGs Are Created Equal: A Component-Wise Empirical Study for Software Engineering Tasks

并非所有RAG都同等有效:面向软件工程任务的组件级实证研究

Qiang Ke, Yanjie Zhao, Hongjin Leng, Shengming Zhao, Haoyu Wang

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文通过实证研究分析RAG组件对软件工程任务的影响,发现检索端组件尤其是检索算法对系统性能影响更大,BM25在多种任务中表现稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08374 2026-05-15 cs.AI 57%

MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs

MemQ:将Q学习整合到基于溯源DAG的自进化记忆代理中

Junwei Liao, Haoting Shi, Ruiwen Zhou, Jiaqian Wang, Shengtao Zhang, Wei Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Bo Tang, Weinan Zhang, Muning Wen

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学) Xidian University(西安电子科技大学) University of Science and Technology of China(中国科学技术大学) MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 MemQ通过在溯源DAG中传播信用权重,改进记忆Q值的评估,提升多步任务的泛化能力,尤其在产生深层相关溯源链的任务中表现突出。

Comments 22 pages, 11 figures (containing 43 individual image panels total)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14089 2026-05-15 cs.AI 57%

SkillFlow: Flow-Driven Recursive Skill Evolution for Agentic Orchestration

SkillFlow: 以流程驱动的递归技能进化用于代理编排

Mingda Zhang, Tiesunlong Shen, Haoran Luo, Wenjin Liu, Zikai Xiao, Erik Cambria, Xiaoying Tang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 SkillFlow通过流程驱动的递归技能进化解决代理编排中的策略崩溃、梯度方差高和无指导技能进化问题,实现高效任务编排。

Comments 49 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13898 2026-05-15 cs.SE 57%

Bidirectional Empowerment of Metamorphic Testing and Large Language Models: A Systematic Survey

双向赋能:变形测试与大语言模型的相互促进:系统综述

Zheng Zheng, Zenghui Zhou, Yinwang Xu, Daixu Ren, Tsong Yueh Chen

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文系统综述了93项研究,探讨变形测试与大语言模型之间的双向赋能关系,提出分类框架,分析其在验证、评估和自动化测试中的应用。

Comments Daixu Ren is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14718 2026-05-15 cs.CR 50%

Adapting AlphaEvolve to Optimize Fully Homomorphic Encryption on TPUs

将AlphaEvolve适应于优化TPUs上的全同态加密

Shruthi Gorantala, Jianming Tong, Asra Ali, Baiyu Li, Jonathan Katz, Jeremy Kun, Thomas Steinke, Abhradeep Thakurta, Julian Walker, Amir Yazdanbakhsh

专题命中 代码生成 :code generation(abstract)

AI总结 本文提出利用AlphaEvolve自动化优化TPUs上的全同态加密内核,通过进化搜索提升TFHE和CKKS方案的执行效率,减少延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06759 2026-05-15 cs.CR cs.HC 50%

"Tab, Tab, Bug": Security Pitfalls of Next Edit Suggestions in AI-Integrated IDEs

Tab,Tab,Bug:AI集成IDE中Next Edit Suggestions的安全隐患

Yunlong Lyu, Yixuan Tang, Peng Chen, Tian Dong, Xinyu Wang, Zhiqiang Dong, Hao Chen

专题命中 代码生成 :code generation(abstract)

AI总结 本文研究了AI集成IDE中的Next Edit Suggestions安全问题,揭示了其复杂的上下文检索机制和潜在攻击向量,通过实验室测试和在线调查发现NES易受上下文污染和交易性编辑影响,需加强安全教育和防护措施。

详情

展开后加载摘要…

URL PDF HTML 收藏