arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-06-24 至 2026-06-24 共收录 15 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 3 篇

2503.13505 2026-06-24 cs.CL cs.AI cs.LG 版本更新 82%

Ensemble Learning for Large Language Models in Text and Code Generation: A Survey

面向文本与代码生成的大语言模型集成学习综述

Mari Ashiga, Wei Jie, Fan Wu, Vardan Voskanyan, Fateme Dinmohammadi, Paul Brookes, Jingzhi Gong, Zheng Wang

机构 * School of Computing and Engineering, University of West London(西伦敦大学计算机与工程学院) Turing Intelligence Technology Limited(图灵智能科技有限公司) School of Computer Science, University of Leeds(利兹大学计算机科学学院)

专题命中 代码生成 :code generation(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文综述了七种大语言模型集成方法(权重合并、知识融合、混合专家、奖励集成、输出集成、路由和级联),分析了它们在文本与代码生成中提升多样性、输出质量和应用灵活性的能力。

Comments Accepted by IEEE TAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23690 2026-06-24 cs.SE cs.AI 新提交 62%

Beyond the Autoregressive Horizon: A Comprehensive Survey of Diffusion Models, World Modelling, and State Space Models for Code

超越自回归视野:扩散模型、世界模型和状态空间模型在代码领域的综合综述

Kishan Maharaj, Ashita Saxena, Srikanth Tamilselvam

机构 * IBM

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI

AI总结 综述扩散模型、代码世界模型和状态空间模型在代码生成中的潜力,以克服自回归模型在全局规划、长程依赖和执行语义方面的局限,并展望“系统2”代码生成智能体。

Comments 14 Pages, 1 Table, 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10607 2026-06-24 cs.LG cs.AI 62%

MONAQ: Multi-Objective Neural Architecture Querying for Time-Series Analysis on Resource-Constrained Devices

MONAQ:面向资源受限设备的时间序列分析多目标神经架构查询

Patara Trirat, Jae-Gil Lee

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 MONAQ通过多目标神经架构查询框架,结合大语言模型能力,实现对时间序列数据的高效处理与部署,实验表明其模型性能优于传统方法。

Comments EMNLP 2025 (Findings), Project Page: https://kaist-dmlab.github.io/MONAQ

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 5 篇

2606.24453 2026-06-24 cs.AI cs.CL 新提交 81%

Bayesian control for coding agents

编码智能体的贝叶斯控制

Theodore Papamarkou, Vladislav Smirnov, Viktor Mazanov, Artem Vazhentsev, Preslav Nakov, Timothy Baldwin, Artem Shelmanov

机构 * PolyShape National Technical University of Athens(雅典国家技术大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.CL、cs.AI

AI总结 将编码智能体的编排建模为成本敏感的序贯假设检验,贝叶斯控制器动态决策证据收集、候选优化、验证或停止,在昂贵验证下最有效,且信念状态提供可解释的正确性分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24429 2026-06-24 cs.SE cs.AI 新提交 81%

Detecting AI Coding Agents in Open Source: A Validated Multi-Method Census of 180 Million Repositories

检测开源中的AI编码代理:对1.8亿个仓库的多方法普查验证

Arsham Khosravani, Audris Mockus

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.AI

AI总结 提出多层面检测框架,整合配置扫描、提交消息分析等四种方法,发现单一信号低估AI代理活动达30倍,揭示不同检测渠道捕获的代理群体几乎不重叠。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23752 2026-06-24 cs.SE 新提交 79%

ESAA-Conversational: An Event-Sourced Memory Layer for Continuity, Handoff, and Curation Across Heterogeneous LLM Coding Agents

ESAA-Conversational:一种用于异构LLM编码智能体之间连续性、交接和策管的事件溯源记忆层

Elzo Brito dos Santos Filho

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE

AI总结 提出ESAA-Conversational架构,通过事件溯源实现跨多个LLM编码智能体的共享会话记忆,解决会话状态漂移问题,支持连续性、交接和策管。

Comments 11 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21894 2026-06-24 cs.SE cs.AI 新提交 62%

Skills for the future software profession: beyond agentic AI!

未来软件职业的技能:超越智能体AI!

Sungmin Kang, Baishakhi Ray, Abhik Roychoudhury

机构 * National University of Singapore(新加坡国立大学) Columbia University(哥伦比亚大学)

专题命中 软件智能体 :coding agent(abstract);分类 cs.SE、cs.AI

AI总结 本文通过2026年在纽约和新加坡举行的两场圆桌会议,总结未来软件工程师所需的核心技能,强调验证与确认在智能体处理实现时的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24820 2026-06-24 cs.CL 新提交 57%

SHERLOC: Structured Diagnostic Localization for Code Repair Agents

SHERLOC: 代码修复智能体的结构化诊断定位

Hovhannes Tamoyan, Sean Narenthiran, Erik Arakelyan, Mira Mezini, Boris Ginsburg

机构 * NVIDIA(英伟达) Santa Clara, CA 95051, USA(美国加利福尼亚州圣克拉拉) TU Darmstadt(达姆施塔特工业大学) National Research Center for Applied Cybersecurity ATHENE(国家应用网络安全研究中心 ATHENE)

专题命中 软件智能体 :repository(abstract);分类 cs.CL

AI总结 提出SHERLOC框架,通过推理LLM与紧凑仓库工具及自恢复机制,实现无需微调的结构化诊断定位,在SWE-Bench上达到最优定位精度,并提升修复率、降低令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 代码评测 2 篇

2605.26144 2026-06-24 cs.SE cs.AI cs.CV 版本更新 81%

VISTA: An End-to-End Benchmark for Visual Spec-to-Web-App Coding Agents

VISTA:面向视觉规格到网页应用编码智能体的端到端基准

JunJia Guo, Yuhang Yao, Jiawei, Zhou, Jingdi Chen

机构 * University of Arizona(亚利桑那大学) Zoom Stony Brook University(石溪大学)

专题命中 代码评测 :coding agent(title);code generation(abstract);分类 cs.SE、cs.AI

AI总结 提出VISTA基准,通过多维度输入条件和评估指标,衡量基于LLM的智能体从视觉规格生成功能完整、视觉一致的网页应用的能力。

Comments Project page: https://kaboider.github.io/VIS_APP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18542 2026-06-24 cs.CL 版本更新 57%

Business as Rulesual: A Benchmark and Framework for Business Rule Flow Modeling with LLMs

业务即规则:面向LLM的业务规则流建模基准与框架

Chen Yang, Ruping Xu, Ruizhe Li, Bin Cao, Jing Fan

机构 * Zhejiang University of Technology(浙江工业大学) Zhejiang Key Laboratory of Visual Information Intelligent Processing(浙江省视觉信息智能处理重点实验室) University of Aberdeen(阿伯丁大学) University of Birmingham(伯明翰大学)

专题命中 代码评测 :code generation(abstract);分类 cs.CL

AI总结 提出BREX基准(409份真实业务文档与2855条专家标注规则)和ExIde框架,通过可执行伪代码生成显式建模规则依赖,在13个LLM上验证了可执行接地作为归纳偏置的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 5 篇

2606.23984 2026-06-24 cs.SE 新提交 57%

Domain-Driven Design in Practice: A Mining Study of Maintenance and Evolution in Open-Source Repositories

领域驱动设计实践:开源仓库中维护与演化的挖掘研究

Weixing Zhang, Bowen Jiang, Yuhong Fu, Haowei Cheng, Mario Herb, Anne Koziolek

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过挖掘GitHub仓库,研究领域驱动设计战术构建块的分布、演化及其对软件维护质量的影响,量化边界上下文违规的规模与维护关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04993 2026-06-24 cs.SE 版本更新 57%

Code Lifespan Survival Analysis (CLSA): Predicting the Survival of Source Code Lines Using AST-Aware Mining

代码寿命生存分析(CLSA):使用AST感知挖掘预测源代码行的存活

Pavel Gurov

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出代码寿命生存分析(CLSA)框架,在单行粒度上通过Cox比例风险模型和AST结构、行熵等静态特征预测代码删除风险,发现行熵对成熟代码有强保护作用,仓库身份是最大影响因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24037 2026-06-24 q-bio.NC 新提交 50%

The Morality Game: An online multiplayer platform to standardize, expedite, and expand research on cooperation

道德游戏:一个标准化、加速和扩展合作研究的在线多人平台

Gregory N. Stanley, Alan Yang, Liam Tsimhoni, Roujia Wang, Ekdatha Arramreddy, Rohan Desai, Shulin Pan, Michael Ahn, Vijairam G. Moorthy, William Mathias, Mai Xu, James Kessler, Yahan Xing, Yang Li, Duoming Bian

专题命中 仓库级理解 :repository(abstract)

AI总结 提出道德游戏平台,通过基于博弈论的实验标准化和加速合作与道德研究,支持零编码配置实验、自动数据收集与分析,促进结果比较和可重复性。

Comments 28 pages, 4 figures. Platform available at https://moralitygame.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24531 2026-06-24 cs.DC 新提交 50%

Unified Position-Invariant Random Access Through Two Compression Layers via Absolute-Offset Coordinates: A Bit-Perfect Device-Resident Proof

统一位置不变随机访问通过两个压缩层基于绝对偏移坐标:一个比特完美的设备驻留证明

Yakiv Shavidze

专题命中 仓库级理解 :repository(abstract)

AI总结 提出ACEAPEX格式,通过绝对偏移坐标实现熵层和匹配层的统一位置不变随机访问,单坐标即可比特完美解码任意块,验证表明16KB块寻址仅需0.334ms。

Comments 5 pages, 3 tables. Code and harness at https://github.com/yasha1971-coder/aceapex

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23848 2026-06-24 cs.RO 新提交 50%

Enforcing Human-like Kinematics in Dexterous Piano Playing via Adversarial Posture Regularization

通过对抗姿态正则化在灵巧钢琴演奏中强制执行类人运动学

Bin Qiu, Yanming Shao, Guanyu Cai, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 仓库级理解 :repository(abstract)

AI总结 提出对抗姿态正则化(APR)方法,利用少量非对齐的人类演奏数据,通过对抗目标匹配策略姿态分布与人类先验,使高自由度灵巧手在物理仿真中弹钢琴时呈现更自然的姿势。

详情

展开后加载摘要…

URL PDF HTML 收藏