arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-09 至 2026-07-09 共收录 4 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 4 篇

2605.03195 2026-07-09 cs.AI cs.SE 版本更新 62%

Terminus-4B: Can a Smaller Model Replace Frontier LLMs at Agentic Execution Tasks?

Terminus-4B:一个较小的模型能否在智能体执行任务中取代前沿大语言模型?

Spandan Garg, Vikram Nitin, Yufan Huang

机构 * Microsoft USA(微软公司)

专题命中 代码评测 :coding agent(abstract);分类 cs.SE、cs.AI

AI总结 研究智能体终端执行任务中较小模型能否取代前沿大语言模型。提出经监督微调及强化学习训练的Terminus-4B模型,评估发现其能减少主智能体令牌使用量约30%,不影响性能,还缩小与前沿模型差距甚至超越其性能。

Comments The current article involves some product IP issues and needs to be withdrawn and re-approved

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06796 2026-07-09 cs.LG cs.AI 新提交 62%

Enhancing deep learning models for time series classification via knowledge distillation

通过知识蒸馏增强用于时间序列分类的深度学习模型

Javidan Abdullayev, Maxime Devanne, Jonathan Weber, Germain Forestier

机构 * IRIMAS, University of Haute Alsace(IRIMAS,法国高等教育高级阿列省大学) Faculty of IT, Monash University(信息技术学院,莫纳什大学)

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

AI总结 研究知识蒸馏用于时间序列分类的有效性,在FCN、Inception和ConvTran三种架构上评估,修改组件后在UCR Archive数据集测试,发现对中等复杂度学生模型效果最佳,不同模型经蒸馏有不同程度参数减少和性能提升,并提供实现代码。

Comments Published version. Open access under CC BY 4.0. 24 pages, 11 figures

Journal ref Knowledge and Information Systems, Volume 68, Article 215, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07400 2026-07-09 cs.SE 新提交 57%

Evaluating Static and Process Evidence for Code Authorship in Programming Education

评估编程教育中代码作者身份的静态和过程证据

Marek Horváth

专题命中 代码评测 :repository(abstract);分类 cs.SE

AI总结 研究编程教育中代码作者身份问题,通过任务感知评估对比不同环境,发现竞赛数据信号强,教育数据集弱,添加过程特征可提升其性能,表明过程模式能补充最终代码信号,模型适合作教师决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17648 2026-07-09 cs.CL 版本更新 57%

Simulstream: Open-Source Toolkit for Evaluation and Demonstration of Streaming Speech-to-Text Translation Systems

Simulstream:用于评估和演示流式语音到文本翻译系统的开源工具包

Marco Gaido, Sara Papi, Mauro Cettolo, Matteo Negri, Luisa Bentivogli

机构 * Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会)

专题命中 代码评测 :repository(abstract);分类 cs.CL

AI总结 研究流式语音到文本翻译在评估上的问题,提出开源框架simulstream,支持长语音的增量和重新翻译解码,能进行质量和延迟评估及实时可视化比较,填补了相关统一解决方案的空白。

详情

展开后加载摘要…

URL PDF HTML 收藏