arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-28 至 2026-07-28 共收录 8 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 软件智能体 8 篇

2607.22711 2026-07-28 cs.LG cs.AI cs.SE 新提交 82%

CORVUS: Context Optimization and Reduction Via Underlying Synchronization for LLM Coding Agents

CORVUS:通过底层同步实现大语言模型编码代理的上下文优化与缩减

Mingwei Zheng, David OBrien, Siwei Cui, Pardis Pashakhanloo, Rajdeep Mukherjee, Myeongsoo Kim, Sachit Kuhar

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 研究针对大语言模型编码代理传统轨迹架构问题,提出CORVUS架构解耦文件读取与观察,通过维护同步注册表注入当前内容,经实验评估,该架构能减少输入令牌、缩短提示并减少推理周期,保持通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22807 2026-07-28 cs.SE cs.CL 新提交 81%

The Best Programming Language for Tokenmaxxing: An Investigation of Coding Agent Behavior Across Programming Languages

用于Tokenmaxxing的最佳编程语言:跨编程语言的编码代理行为研究

Zixuan Wu, Carolyn Jane Anderson, Arjun Guha

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.CL

AI总结 研究跨Python、Java、Rust和OCaml的编码代理行为,通过评估五个模型发现不同语言的令牌消耗有显著差异。分析代理轨迹结构与内容,揭示其在不熟悉语言中的行为特点,指出按语言的令牌效率对多语言代理基准测试和开发有指导意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22569 2026-07-28 cs.AI cs.SE 新提交 81%

Execution-Grounded Security Testing for Coding Agents in Software Engineering Pipelines

软件工程流水线中编码代理的基于执行的安全测试

Yifei Ge, Weisong Sun, Jinkun Xiao, Yuchen Chen, Yebo Feng, Peizhuo Lv, Xia Feng, Chunrong Fang, Zhihong Zhao, Zhenyu Chen, Yang Liu

机构 * Nanjing University(南京大学) Nanyang Technological University(南洋理工大学) Hainan University(海南大学)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.AI

AI总结 研究针对软件工程流水线中编码代理的安全问题,提出基于执行的红队测试框架,利用沙盒证据探测安全边界,将不安全操作嵌入工作负载并借助执行预言机优化,通过实验大幅增加不安全执行验证率,凸显编码代理需更强安全测试。

Comments Preprint. 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22585 2026-07-28 cs.AI 新提交 79%

The Scaffold Effect in Coding Agents: Harness Choice as a Hidden Variable in Coding-Agent Evaluation

编码智能体中的支架效应:在编码智能体评估中利用选择作为隐藏变量

Naman Vats, Oleg Golev

机构 * Alibaba(阿里巴巴) Agentic AI Foundation(Agentic人工智能基金会) OpenCode Contributors(OpenCode贡献者团队) Harbor Framework Team(Harbor框架团队)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.AI

AI总结 研究编码智能体评估中工具选择对结果的影响,通过在三个开源工具上评估两个模型,发现工具选择会使解决任务的令牌数有40倍差异,失败指纹有工具级偏差,建议按通过率选工具-模型对并报告相关指标,还发布了相关数据和脚本。

Comments 7 pages, 2 figures, 6 tables. Preliminary work; under review at the 5th DL4C Workshop @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02544 2026-07-28 cs.SE 版本更新 79%

Developer Experience with AI Coding Agents: HTTP Behavioral Signatures in Documentation Portals

与AI代码代理的开发者体验:文档门户中的HTTP行为签名

Oleksii Borysenko

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE

AI总结 本文研究AI代码代理对技术文档访问的影响,发现HTTP行为特征在文档门户中具有可识别性,提出改进开发者文档设计和反馈机制的实践方案。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24604 2026-07-28 cs.CL cs.AI 新提交 73%

Looping Is Not Reliability: State-Bound Evidence and Typed Revision Contracts for Agentic Code Repair

循环并非可靠性保障:智能代码修复的状态约束证据与类型化修订契约

Xueping Gao, Jianwei Yang, Qiang Yang

机构 * Alibaba Cloud(阿里云)

专题命中 软件智能体 :repository(abstract);coding agent(abstract);分类 cs.CL、cs.AI

AI总结 研究编码智能体中生成-测试-修订循环的可靠性问题,通过实验揭示相关差距及问题,提出证据约束的类型化循环契约并实例化其可机械执行子集,实现规范与工件,非证明修复能力提升等。

Comments 11 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22677 2026-07-28 cs.DL cs.AI 新提交 70%

SetGo: Metadata Readiness for Scientific AI Datasets

SetGo:科学人工智能数据集的元数据就绪性

Sean R. Wilkinson, Polina Shpilker, Wesley Brewer

专题命中 软件智能体 :repository(abstract);coding agent(abstract);分类 cs.AI

AI总结 研究针对科学AI数据集元数据就绪性评估工具缺失的问题,提出开源工具SetGo,能从六个维度评估修复元数据,揭示通用工具未发现的缺陷,提升公平性分数,还可集成大语言模型支持自动化工作流程。

Comments 6 pages; accepted at SSDBM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07809 2026-07-28 cs.CL cs.LG 版本更新 62%

No Optimal Language Set Exists for Multilingual Instruction Tuning: Insights from a Linguistically-Informed Study

多语言指令微调不存在最优语言集:基于语言信息研究的见解

Gürkan Soykan, Gözde Gül Şahin

专题命中 软件智能体 :repository(abstract);分类 cs.CL、cs.LG

AI总结 研究多语言指令微调中语言集选择问题,通过评估基于多种特征的语言信息选择策略与随机基线对比,发现固定预算下无通用语言选择策略,性能因任务和模型而异,超阈值加语言会致性能下降,还讨论了相关影响和评估陷阱。

Comments 7 pages, 4 figures Updated the title and revised the manuscript for submission to the Workshop on Insights from Negative Results in NLP (Insights 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏