arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-08-10 至 2026-08-10 共收录 16 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4 篇

2608.06848 2026-08-10 cs.CR cs.SE 新提交 79%

Understanding and Improving Model Editing for Secure Code Generation

理解与改进用于安全代码生成的模型编辑

Weifeng Sun, Quanjun Zhang, Yuchen Chen, Chengran Yang, Gou Tan, David Lo

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本研究系统探究模型编辑用于安全代码生成,提出SafeEdit方法缓解模型编辑的安全与功能权衡,其与CoSec结合可提升安全代码生成性能。

Comments ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07317 2026-08-10 cs.SE cs.AI 新提交 62%

Towards Assurance Closure in AI-Native Large-Scale Agile Software Development

面向AI原生大规模敏捷软件开发中的保证闭合

Ricardo Britto

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI

AI总结 针对AI原生大规模敏捷软件开发中保证推理机器可操作的缺口,提出基于共享语义保证层的高层架构及六项对应能力,以实现保证闭合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06829 2026-08-10 cs.SE 新提交 57%

How Reasoning Shapes Social Bias in LLM-Generated Code?

推理如何塑造大语言模型生成代码中的社会偏见?

Weifeng Sun, Jieke Shi, Zhou Yang, Yuchen Chen, Hongyan Li, Meng Yan, David Lo

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 该研究首次系统探究基于推理的代码生成中的社会偏见,发现推理可降低偏见但会影响代码质量,进而提出ProbeDebias框架,有效检测并缓解代码偏见,同时保持较高质量。

Comments ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05208 2026-08-10 cs.CV cs.LG 版本更新 57%

Symbolic Graphics Programming with Large Language Models

基于大语言模型的符号图形编程

Yamei Chen, Haoquan Zhang, Yangyi Huang, Zeju Qiu, Kaipeng Zhang, Yandong Wen, Weiyang Liu

机构 * The Chinese University of Hong Kong(香港中文大学) Westlake University(西湖大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)

专题命中 代码生成 :program synthesis(abstract);分类 cs.LG

AI总结 本文针对大语言模型生成符号图形程序(SGP)能力不足的问题,提出带可验证奖励的强化学习方法,在Qwen-2.5-7B上实现与前沿系统相当的SVG生成性能,揭示SGP是跨模态 grounding 的有效视角。

Comments Accepted by Transactions on Machine Learning Research. (32 pages, 12 figures.) This version refines the paper structure, adds experimental results. Project page: https://spherelab.ai/SGP-Gen/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 4 篇

2603.17399 2026-08-10 cs.SE cs.LG 81%

Bootstrapping Coding Agents: The Specification Is the Program

通过代码代理进行 Bootstrap:规范即程序

Martin Monperrus

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.LG

AI总结 研究通过代码代理实现自我提升,基于规范重新实现程序,体现元循环属性,强调规范的重要性。

Comments To appear in IEEE Software

Journal ref IEEE Software, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07147 2026-08-10 cs.AI 新提交 79%

DiDPO: Diff-in-Diff Policy Optimization for Coding Agent Training

DiDPO:用于编码智能体训练的差异内差异策略优化

Xucong Wang, Zhe Zhao, Liheng Yu, Di Wu, Xiaofeng Cao, Pengkun Wang

机构 * University of Science and Technology of China (USTC)(中国科学技术大学) Stanford University(斯坦福大学) Suzhou Institute for Advanced Research, USTC(中国科学技术大学苏州高等研究院) Tongji University(同济大学)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.AI

AI总结 针对编码智能体训练的细粒度信用分配难题,提出DiDPO方法,在Qwen2.5-7B-Coder上性能超可比方法10%以上,开源了支持多种RL方法的verl-code代码库。

Comments 16 pages, 6 figures, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06811 2026-08-10 cs.SE cs.AI 新提交 62%

Coupling Planning with Episodic Memory in LLM Agents for Software Issue Resolution

在软件问题解决的大语言模型智能体中耦合规划与情景记忆

Jiahao Zhang, Yifan Zhang, Yu Huang

专题命中 软件智能体 :repository(abstract);分类 cs.SE、cs.AI

AI总结 本文提出PMCoder智能体,通过双向耦合分层阶段规划器与情景记忆解决软件问题,在SWE-bench Verified等数据集上显著提升问题解决能力,且性能可迁移至其他场景。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29678 2026-08-10 cs.CL cs.DC cs.PF 版本更新 57%

TokTier: Exact Stateful CPU+GPU Tokenization for Agentic LLM Serving

TokTier:面向智能体大语言模型服务的精确有状态分词方案

Zhenyu Zhang, Zhichao Cao

机构 * Arizona State University(亚利桑那州立大学)

专题命中 软件智能体 :coding agent(abstract);分类 cs.CL

AI总结 本研究提出TokTier,一种面向智能体LLM服务的精确有状态分词方案,通过增量修复、GPU加速分词等技术,将首次令牌生成时间降低16%-34%,饱和请求速率提升至1821次/秒,性能远超现有方案。

Comments 26 pages. Code: https://github.com/asu-idi/toktier

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 测试生成 1 篇

2604.09222 2026-08-10 cs.SD cs.AI 版本更新 57%

GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking

GRM:通过梯度比掩码实现音频大语言模型的效用感知越权攻击

Yunqiang Wang, Hengyuan Na, Di Wu, Miao Hu, Guocong Quan

机构 * Sun Yat-Sen University(中山大学)

专题命中 测试生成 :repository(abstract);分类 cs.AI

AI总结 本文提出GRM框架,通过频率选择性扰动在音频大语言模型中实现效用感知的越权攻击,实验表明其在攻击成功率与效用平衡方面优于基线方法。

Comments Accpeted by MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 6 篇

2608.06471 2026-08-10 cs.CR cs.AI cs.SE 新提交 81%

CyberForge: Verified Vulnerability Injection at Repository Level for Cybersecurity Agent Training

CyberForge:用于网络安全智能体训练的、基于代码仓库级别的经验证漏洞注入框架

Amine Lbath, Manan Suri, Aurelien Delaitre, Vadim Okun, Massih-Reza Amini, Ram D. Sriram, Dinesh Manocha

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 本研究提出CyberForge框架,通过向真实C/C++项目注入漏洞生成经验证的代码仓库级安全训练数据,微调后可提升智能体在SEC-bench和PatchEval上的漏洞修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05204 2026-08-10 cs.AI cs.LG 版本更新 62%

SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse

SkillTrace:面向LLM智能体技能复用的多溯源审计

Jialuo Chen, Minghe Wang, Lingqi Jiang, Jianan Ma, Xinhao Deng, Xiaohu Du, Ruixiao Lin, Yunhao Feng, Linkang Du, Jingyi Wang

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SKILLTRACE框架,通过提取三种溯源审计LLM智能体技能复用,在SKILLTRACE-BENCH上取得高指标,野外审计显示其能生成更具操作性的复用审查队列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25637 2026-08-10 cs.DL cs.AI cs.SI 版本更新 57%

F(AI)2R: Who Did What, and Who Checked? Verifiable AI Provenance as an Executable Skill

F(AI)2R:谁做了什么,谁进行了检查?可验证的人工智能溯源作为一项可执行技能

Florian Krebs

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究将F(AI)2R实验的溯源模型扩展为aiprov,涵盖任何含人工智能工件。方法被打包为可执行技能,由人工智能代理操作,能解析操作员身份,把关图一致性并发布论文版本,以自身为例展示溯源记录。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15790 2026-08-10 cs.LG stat.ML 版本更新 57%

Certified Interpolation Oversampling: Per-Instance Safety Guarantees for Imbalanced Learning

带安全认证的插值过采样:不平衡学习中针对单个样本的安全保证

Pankaj Yadav, Vivek Vijay

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文提出带安全认证的插值过采样(CISO)框架,为不平衡学习生成带安全属性的样本,在多数据集实验中表现与SMOTE相当且无评估失败,揭示了保真度与安全的连续权衡关系。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06682 2026-08-10 math.NT 新提交 50%

Squarefree numbers in short intervals: explicit and formalized

短区间中的无平方因子数:显式结果与形式化

Mayank Pandey

专题命中 仓库级理解 :repository(abstract)

AI总结 作者将短区间无平方因子数的相关结果显式化并在Lean 4中形式化,给出了特定参数下的误差界,阐述了指数显式化及形式化的相关工作。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01361 2026-08-10 astro-ph.HE astro-ph.GA 版本更新 50%

Search for neutrino emission from blazar $γ$-ray flares accounting for possible neutrino time delays

搜寻与blazar γ射线暴相关的高能中微子辐射,考虑中微子可能的时间延迟

Egor Podlesnyi, Foteini Oikonomou

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究通过分析中微子与γ射线暴的时间延迟,探索blazar高能中微子辐射的可能性。

Comments 16 pages (11+5), 12 figures (9+3), 7 tables (2+5); published in the Open Journal of Astrophysics

Journal ref OJA, 9, 10.33232/001c.166774 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 程序分析与验证 1 篇

2606.23512 2026-08-10 cs.SE 版本更新 57%

Source-Free Detection and Impact Analysis of Compiler Optimization Problems in Mobile Applications

移动应用中编译器优化问题的无源检测与影响分析

Han Hu, Xiaoheng Xie, Bo Sun, Jian Gu, Gang Fan, Li Li

专题命中 程序分析与验证 :repository(abstract);分类 cs.SE

AI总结 提出无源框架OptDetect,直接从二进制文件检测编译器优化问题,无需源码或构建元数据,准确率达93.0%,发现30.5%的库使用低优化级别,修复后CPU指令减少10-63%。

详情

展开后加载摘要…

URL PDF HTML 收藏