Understanding and Improving Model Editing for Secure Code Generation
理解与改进用于安全代码生成的模型编辑
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 本研究系统探究模型编辑用于安全代码生成,提出SafeEdit方法缓解模型编辑的安全与功能权衡,其与CoSec结合可提升安全代码生成性能。
Comments ISSTA 2026
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
理解与改进用于安全代码生成的模型编辑
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 本研究系统探究模型编辑用于安全代码生成,提出SafeEdit方法缓解模型编辑的安全与功能权衡,其与CoSec结合可提升安全代码生成性能。
Comments ISSTA 2026
面向AI原生大规模敏捷软件开发中的保证闭合
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI
AI总结 针对AI原生大规模敏捷软件开发中保证推理机器可操作的缺口,提出基于共享语义保证层的高层架构及六项对应能力,以实现保证闭合。
推理如何塑造大语言模型生成代码中的社会偏见?
专题命中 代码生成 :code generation(abstract);分类 cs.SE
AI总结 该研究首次系统探究基于推理的代码生成中的社会偏见,发现推理可降低偏见但会影响代码质量,进而提出ProbeDebias框架,有效检测并缓解代码偏见,同时保持较高质量。
Comments ASE 2026
基于大语言模型的符号图形编程
机构 * The Chinese University of Hong Kong(香港中文大学) ; Westlake University(西湖大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)
专题命中 代码生成 :program synthesis(abstract);分类 cs.LG
AI总结 本文针对大语言模型生成符号图形程序(SGP)能力不足的问题,提出带可验证奖励的强化学习方法,在Qwen-2.5-7B上实现与前沿系统相当的SVG生成性能,揭示SGP是跨模态 grounding 的有效视角。
Comments Accepted by Transactions on Machine Learning Research. (32 pages, 12 figures.) This version refines the paper structure, adds experimental results. Project page: https://spherelab.ai/SGP-Gen/
通过代码代理进行 Bootstrap:规范即程序
机构 * KTH Royal Institute of Technology(皇家理工学院)
专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.LG
AI总结 研究通过代码代理实现自我提升,基于规范重新实现程序,体现元循环属性,强调规范的重要性。
Comments To appear in IEEE Software
Journal ref IEEE Software, 2026
DiDPO:用于编码智能体训练的差异内差异策略优化
机构 * University of Science and Technology of China (USTC)(中国科学技术大学) ; Stanford University(斯坦福大学) ; Suzhou Institute for Advanced Research, USTC(中国科学技术大学苏州高等研究院) ; Tongji University(同济大学)
专题命中 软件智能体 :coding agent(title,abstract);分类 cs.AI
AI总结 针对编码智能体训练的细粒度信用分配难题,提出DiDPO方法,在Qwen2.5-7B-Coder上性能超可比方法10%以上,开源了支持多种RL方法的verl-code代码库。
Comments 16 pages, 6 figures, work in progress
在软件问题解决的大语言模型智能体中耦合规划与情景记忆
专题命中 软件智能体 :repository(abstract);分类 cs.SE、cs.AI
AI总结 本文提出PMCoder智能体,通过双向耦合分层阶段规划器与情景记忆解决软件问题,在SWE-bench Verified等数据集上显著提升问题解决能力,且性能可迁移至其他场景。
Comments 12 pages, 5 figures
TokTier:面向智能体大语言模型服务的精确有状态分词方案
机构 * Arizona State University(亚利桑那州立大学)
专题命中 软件智能体 :coding agent(abstract);分类 cs.CL
AI总结 本研究提出TokTier,一种面向智能体LLM服务的精确有状态分词方案,通过增量修复、GPU加速分词等技术,将首次令牌生成时间降低16%-34%,饱和请求速率提升至1821次/秒,性能远超现有方案。
Comments 26 pages. Code: https://github.com/asu-idi/toktier
GRM:通过梯度比掩码实现音频大语言模型的效用感知越权攻击
机构 * Sun Yat-Sen University(中山大学)
专题命中 测试生成 :repository(abstract);分类 cs.AI
AI总结 本文提出GRM框架,通过频率选择性扰动在音频大语言模型中实现效用感知的越权攻击,实验表明其在攻击成功率与效用平衡方面优于基线方法。
Comments Accpeted by MM 2026
CyberForge:用于网络安全智能体训练的、基于代码仓库级别的经验证漏洞注入框架
专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI
AI总结 本研究提出CyberForge框架,通过向真实C/C++项目注入漏洞生成经验证的代码仓库级安全训练数据,微调后可提升智能体在SEC-bench和PatchEval上的漏洞修复性能。
SkillTrace:面向LLM智能体技能复用的多溯源审计
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
AI总结 本文提出SKILLTRACE框架,通过提取三种溯源审计LLM智能体技能复用,在SKILLTRACE-BENCH上取得高指标,野外审计显示其能生成更具操作性的复用审查队列。
F(AI)2R:谁做了什么,谁进行了检查?可验证的人工智能溯源作为一项可执行技能
专题命中 仓库级理解 :repository(abstract);分类 cs.AI
AI总结 研究将F(AI)2R实验的溯源模型扩展为aiprov,涵盖任何含人工智能工件。方法被打包为可执行技能,由人工智能代理操作,能解析操作员身份,把关图一致性并发布论文版本,以自身为例展示溯源记录。
带安全认证的插值过采样:不平衡学习中针对单个样本的安全保证
专题命中 仓库级理解 :repository(abstract);分类 cs.LG
AI总结 本文提出带安全认证的插值过采样(CISO)框架,为不平衡学习生成带安全属性的样本,在多数据集实验中表现与SMOTE相当且无评估失败,揭示了保真度与安全的连续权衡关系。
Comments 39 pages
短区间中的无平方因子数:显式结果与形式化
专题命中 仓库级理解 :repository(abstract)
AI总结 作者将短区间无平方因子数的相关结果显式化并在Lean 4中形式化,给出了特定参数下的误差界,阐述了指数显式化及形式化的相关工作。
Comments 4 pages
搜寻与blazar γ射线暴相关的高能中微子辐射,考虑中微子可能的时间延迟
专题命中 仓库级理解 :repository(abstract)
AI总结 该研究通过分析中微子与γ射线暴的时间延迟,探索blazar高能中微子辐射的可能性。
Comments 16 pages (11+5), 12 figures (9+3), 7 tables (2+5); published in the Open Journal of Astrophysics
Journal ref OJA, 9, 10.33232/001c.166774 (2026)
移动应用中编译器优化问题的无源检测与影响分析
专题命中 程序分析与验证 :repository(abstract);分类 cs.SE
AI总结 提出无源框架OptDetect,直接从二进制文件检测编译器优化问题,无需源码或构建元数据,准确率达93.0%,发现30.5%的库使用低优化级别,修复后CPU指令减少10-63%。