An Iterative Test-and-Repair Framework for Competitive Code Generation
面向竞争性代码生成的迭代测试与修复框架
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 FixAudit通过迭代测试与修复循环改进代码生成,通过共享模型和专门角色联合训练,提升代码质量与测试覆盖率。
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
面向竞争性代码生成的迭代测试与修复框架
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 FixAudit通过迭代测试与修复循环改进代码生成,通过共享模型和专门角色联合训练,提升代码质量与测试覆盖率。
令人惊讶的简单自蒸馏方法提升代码生成能力
机构 * Apple(苹果公司)
专题命中 代码生成 :code generation(title,abstract);分类 cs.CL
AI总结 提出简单自蒸馏(SSD)方法,仅利用模型自身输出进行微调,无需验证器或强化学习,显著提升代码生成性能,并揭示其通过重塑token分布解决精度-探索冲突的机制。
HardSecBench: 对大型语言模型在硬件代码生成中的安全意识的基准测试
机构 * University of Science and Technology of China(中国科学技术大学) ; Xi’an Jiaotong University(西安交通大学) ; Nanjing University(南京大学) ; ZTE Corporation(中兴通讯)
专题命中 代码生成 :code generation(title,abstract);分类 cs.AI
AI总结 提出HardSecBench基准,包含924个任务覆盖Verilog RTL和固件C代码,评估LLM在硬件代码生成中的安全性,发现模型常满足功能需求但存在安全风险。
图表规范:用于促进VLM在图表到代码生成中推理的结构表示
机构 * Waseda University(早稻田大学) ; University of Science and Technology of China(中国科学技术大学) ; NanKai University(南开大学)
专题命中 代码生成 :code generation(title,abstract)
AI总结 本文提出图表规范,通过结构化中间表示提升VLM在图表到代码生成中的结构保真度,实验显示其在数据效率和性能上优于现有方法。
Comments Accepted by Neurocomputing
自动推导合一算法:演绎程序合成的一个案例研究
专题命中 代码生成 :program synthesis(title,abstract)
AI总结 该研究聚焦于合一算法的自动推导,以演绎程序合成方式,将编程视为定理证明任务。通过推广和自动化手动证明,新程序能依给定环境替换合一符号表达式,确定输出替换,还能处理不可合一情况,且怀疑带环境的算法更易自动合成。
Comments 92 pages
Journal ref Journal of Symbolic Computation, January-February 2027
SecureCode:用于训练安全意识代码生成模型的生产级多轮数据集
专题命中 代码生成 :code generation(title);分类 cs.CL、cs.AI、cs.LG
AI总结 研究针对AI编码助手生成漏洞代码问题,提出SecureCode数据集,涵盖网络应用安全和AI/ML安全领域,有特定对话结构,经质量保证,发布统一数据集、开源模型及评估框架,是首个提供相关覆盖的公共数据集。
Comments 30 pages, 12 figures, 10 tables. Dataset available at https://huggingface.co/datasets/scthornton/securecode. Code and validation tools at https://github.com/scthornton/securecode
UI2Code^N: 将UI到代码生成视为交互式视觉优化
机构 * Zhejiang University(浙江大学)
专题命中 代码生成 :code generation(title,abstract)
AI总结 提出将UI截图转代码任务重构为交互式视觉优化问题,采用基于偏好的强化学习方法RVPO优化视觉排名,在UI起草、润色和编辑任务上达到SOTA。
Comments 27 pages
CharTide: 数据中心的图表到代码生成通过三视角微调和查询驱动进化
机构 * Nanjing University(南京大学) ; LLM Team, Shopee Pte. Ltd.(Shopee 联邦学习团队) ; East China Normal University(华东师范大学) ; Nanjing University of Science and Technology(南京理工大学) ; Central South University(中南大学)
专题命中 代码生成 :code generation(title,abstract)
AI总结 提出CharTide框架,通过三视角微调解耦视觉感知与代码逻辑,并引入基于信息不变性的查询驱动强化学习进行数据验证,在多个基准上超越GPT-4o。
Comments Accepted to ACL 2026 Main
PennySynth:基于RAG的数据合成用于自动量子代码生成
机构 * eBRAIN Lab, Division of Engineering, New York University Abu Dhabi (NYUAD)(eBRAIN实验室,工程系,纽约大学阿布扎比分校) ; Center for Quantum and Topological Systems (CQTS), NYUAD Research Institute(量子与拓扑系统中心(CQTS),NYUAD研究所) ; Department of Computer Science and Engineering, NYU Tandon School of Engineering(计算机科学与工程系,纽约大学坦顿工程学院)
专题命中 代码生成 :code generation(title);分类 cs.CL、cs.AI
AI总结 提出PennySynth框架,通过检索增强生成和代码感知嵌入,利用13,389个PennyLane指令-代码对数据集,在QHack竞赛中实现52%-68%的pass@5,显著提升量子代码生成的结构有效性和功能正确性。
Comments Accepted at the IEEE International Conference on Quantum Computing and Engineering (QCE), 2026
通过概念感知一致性学习提高大语言模型中的代码理解能力
专题命中 代码生成 :code generation(title);分类 cs.SE、cs.PL
AI总结 研究针对大语言模型对基本编程概念理解浅的问题,引入结合概念感知调整的反事实代码增强框架,经多模型和基准综合评估,证明此方法能引导大语言模型增强概念理解,有效提升其在代码相关任务中的表现。
Comments To appear at IJCAI 2026
从预训练或微调的大语言模型进行无奖励代码对齐:揭示代码生成中的权衡
机构 * York University Canada(加拿大约克大学)
专题命中 代码生成 :code generation(title);分类 cs.SE、cs.AI
AI总结 本研究通过实证分析,探讨了在代码生成任务中,对预训练或微调后的大语言模型进行无奖励对齐(DPO和BoNBoN)的效果,发现预训练到对齐的路径提升更大,但微调版本基线更高。
Journal ref The ACM International Conference on the Foundations of Software Engineering (FSE) 2026
SEA-TS:面向时间序列预测算法自主代码生成的自我进化智能体
机构 * Ecoflow Inc.(Ecoflow公司)
专题命中 代码生成 :code generation(title);分类 cs.AI
AI总结 提出SEA-TS框架,通过度量优势MCTS、代码审查与运行提示优化、全局可引导推理三大机制,自主迭代生成、验证和优化时间序列预测算法代码,在四个数据集上优于TimeMixer等基线。
面向非专家用户的定制化拥塞控制:基于大语言模型的CCA代码生成与eBPF部署
机构 * School of Computing, University of Nebraska-Lincoln(内布拉斯加大学林肯分校计算机学院)
专题命中 代码生成 :code generation(title);分类 cs.LG
AI总结 提出NECC框架,利用大语言模型和eBPF接口,使非专家用户能轻松建模、实现和部署定制化拥塞控制算法,首次解决定制化CCA实现问题。
Comments Accepted manuscript (AAM) of IEEE ICC 2025 paper. DOI: 10.1109/ICC52391.2025.11160790
Journal ref Proc. IEEE International Conference on Communications (ICC), 2025
基于大语言模型的、由规范引导的无死锁通信协议精化合成
专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.SE、cs.AI
AI总结 该研究提出Syntropy框架,结合多方会话类型规范与大语言模型合成无死锁通信协议精化,经评估其有效性达95.6%-99.5%,可生成多样且语法正确的协议精化方案。
从混合量词属性中递归程序合成
专题命中 代码生成 :program synthesis(title)
AI总结 本文提出了一种基于反例引导和预防性剪枝的递归程序合成方法,通过斯科伦化将混合量词问题转化为$\forall^*$-合成问题,提升合成效率。
像人类一样优化CUDA:微剖析工具作为基于LLM的GPU内核优化的专家替代品
机构 * Amazon(亚马逊) ; Siemens(西门子) ; University of Minnesota(明尼苏达大学)
专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.LG
AI总结 提出KernelPro闭环多智能体系统,通过LLM代码生成与硬件剖析反馈及可插拔瓶颈检测工具迭代优化GPU内核,在KernelBench上实现2.42x/4.69x/5.30x加速比,并首次兼顾能效优化。
通过强化学习学习检测用户界面原则违规
机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 代码生成 :code generation(abstract);coding agent(abstract);分类 cs.CL
AI总结 研究小型语言模型和编码代理生成的网页前端代码违反界面质量原则的问题,通过统一多来源的界面质量原则,构建数据集并利用强化学习训练轻量级视觉语言模型作为评判器,提升检测效果并发布相关方法支持评估和后续工作。
RIDGE:一个用于验证和发现大语言模型生成的期权定价方法的自主框架
专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI
AI总结 针对大语言模型生成的期权定价实现,介绍自主验证框架RIDGE,通过多种测试和检查优化定价实现与验证方法,应用于五个随机波动率模型,消除缺陷并带来新定价方法。
Comments 33 pages
代理心理测量:在代理编码基准中的任务级性能预测
机构 * Massachusetts Institute of Technology(麻省理工学院) ; Fulcrum ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI
AI总结 本文提出了一种基于任务级性能预测的代理编码基准评估框架,结合IRT理论与任务特征,区分LLM和支架能力,以更准确预测未见基准和组合的性能。
EvoTrainer: 协同进化LLM策略与训练框架以实现自主智能体强化学习
机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) ; Tongyi Lab , Alibaba Group(通义实验室,阿里巴巴集团) ; Alibaba Group(阿里巴巴集团) ; SUAT(深圳大学)
专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.AI
AI总结 提出EvoTrainer框架,通过协同进化LLM策略和训练端框架,基于经验反馈自动诊断、修正并积累可复用技能,在数学推理、编程竞赛和仓库级软件工程任务上匹配或超越人工设计的RL基线。
代码相关任务中的参数高效多任务微调
专题命中 代码生成 :code generation(abstract);code model(abstract);分类 cs.SE
AI总结 研究多任务QLoRA微调在代码生成、翻译和总结中的效果,发现其在1.5B、3B和7B规模上达到或优于单任务QLoRA和全微调,大模型平衡正确性与质量更佳。
基于大语言模型的程序语义不等价博弈
机构 * University of Edinburgh(爱丁堡大学) ; Cisco Systems(思科系统)
专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG、cs.PL
AI总结 本研究提出基于语义不等价博弈(SInQ)的方法,通过生成器与评估器智能体半对抗训练合成代码推理数据,在跨语言漏洞检测等基准上显著提升LLMs的代码语义理解能力。
MetaLint: 代码检查的易到难泛化
机构 * Carnegie Mellon University(卡内基梅隆大学)
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.LG
AI总结 MetaLint通过元学习框架将代码检查转化为指令遵循任务,能根据自然语言规范评估代码是否符合最佳实践,实现无需重新训练的泛化能力,且在不同编程语言和场景中表现优异。
修订还是重新解决?多LLM流水线中第二轮收益的分解
机构 * School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI
AI总结 本文通过控制实验分解多LLM流水线的第二轮收益,发现其收益取决于任务结构、草稿质量和信息类型,不同任务需不同策略。
Comments In Proceedings Of COLM 2026
Routesplain:面向软件相关任务的可信赖且可干预的路由方法
机构 * Columbia University(哥伦比亚大学) ; Oracle AI
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.LG
AI总结 Routesplain是首个面向软件相关任务的LLM路由工具,通过提取可解释概念路由,在8项软件任务上的16种LLM中,其性能优于单个模型且不逊于黑盒基线,可提升响应质量并降低成本。
Comments Accepted to COLM 2026
通过多路径推理和反馈驱动优化实现自动化可视化代码合成
机构 * AI Research, Enhans, Seoul, South Korea Innovation \& Technology, KAIST, Daejeon, South Korea Department of Computer Science, University of California, Berkeley, CA, United States Department of Electrical
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI
AI总结 VisPath通过多路径推理和反馈驱动优化,提升自动化可视化代码生成的可靠性与准确性。
Comments Accepted by International Conference on Pattern Recognization (ICPR 2026)
Journal ref Pattern Recognition. ICPR 2026. Lecture Notes in Computer Science, vol 16812. Springer, Cham
评估用于基于自然语言的SQL和API调用生成的检索增强生成变体
机构 * IU International University of Applied Sciences(国际应用科学大学)
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI
AI总结 本文评估了三种RAG变体在生成SQL和API调用任务中的性能,发现CoRAG在混合文档环境下表现最佳,检索策略设计对自然语言接口至关重要。
Comments preprint of conference submission
多智能体系统中的潜在协作
机构 * University of Washington(华盛顿大学)
专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出LatentMAS框架,使LLM智能体在连续潜在空间直接协作,无需文本中介,实现更高精度、更低开销和更快推理。
Comments ICML2026 Spotlight, Project: https://github.com/Gen-Verse/LatentMAS
CodeEvo:通过混合和迭代反馈以交互驱动方式合成以代码为中心的数据
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; The University of Hong Kong(香港大学) ; New York University(纽约大学) ; Carnegie Mellon University(卡内基梅隆大学) ; Shanghai Innovation Institute(上海创新研究院)
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI
AI总结 为解决高质量指令-代码对获取难题,提出双智能体架构CodeEvo,审查器制定模式并结合混合验证协议,构建CodeEvo-100K数据集,实验表明基于此数据微调的模型在代码生成基准测试中表现出色。
Comments ACL 2026 (Oral)
通过潜在蒸馏探索大语言模型
机构 * State Key Laboratory of General Artificial Intelligence, BIGAI, Beijing, China(人工智能通用基础理论国家重点实验室,BIGAI,北京,中国) ; School of Information Science and Technology, ShanghaiTech University, Shanghai, China(信息科学与技术学院,上海交通大学,上海,中国)
专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出Exploratory Sampling方法,通过蒸馏模型引导生成过程,提升语义多样性与推理效率,在数学、科学和代码生成中表现优异。
Comments 25 pages, 5 figures. Accepted in ICML 2026