arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-05-01 至 2026-05-01 共收录 4 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 4 篇

2604.27308 2026-05-01 cs.LG cs.AI 62%

BoostLoRA: Growing Effective Rank by Boosting Adapters

BoostLoRA:通过提升适配器增强有效秩

Raviteja Anantha, Nick Levato, Layne C. Price

机构 * Amazon(亚马逊)

专题命中 代码评测 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 BoostLoRA通过迭代训练和合并最小适配器,提升模型有效秩,实现性能提升,优于单次低参数适配器和全微调方法。

Comments Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18344 2026-05-01 cs.SE 57%

Forecasting the Maintained Score from the OpenSSF Scorecard: A Study of GitHub Repositories Linked to PyPI Packages

基于OpenSSF评分卡的维护分数预测:对与PyPI包关联的GitHub仓库的研究

Alexandros Tsakpinis, Efe Berk Ergüleç, Emil Schwenger, Alexander Pretschner

专题命中 代码评测 :repository(abstract);分类 cs.SE

AI总结 本文研究如何通过机器学习和深度学习模型预测OpenSSF评分卡中的维护分数,发现聚合表示如分桶分数和趋势类型能实现较高准确率。

Comments 20 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27001 2026-05-01 cs.CR cs.SE 57%

An Empirical Security Evaluation of LLM-Generated Cryptographic Rust Code

对LLM生成的密码学Rust代码的实证安全评估

Mohamed Elsayed, Kenneth Fulton, Jeong Yang

专题命中 代码评测 :code generation(abstract);分类 cs.SE

AI总结 本文评估了三种LLM生成的加密Rust代码的安全性,发现通用工具不足,提示策略对结果影响显著,且存在nonce重用等系统性问题。

Comments 10 pages, 2 figures , EASE 2026-The 6th International Workshop on Software Security Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09408 2026-05-01 cs.AI 57%

HiL-Bench (Human-in-Loop Benchmark): Do Agents Know When to Ask for Help?

HiL-Bench (Human-in-Loop Benchmark): 代理何时该请求帮助?

Mohamed Elfeki, Tu Trinh, Kelvin Luu, Guangze Luo, Nathan Hunt, Ernesto Montoya, Nandan Marwaha, Yannis He, Charles Wang, Fernando Crabedo, Alessa Castilo, Bing Liu

专题命中 代码评测 :coding agent(abstract);分类 cs.AI

AI总结 HiL-Bench通过评估代理在任务中何时请求帮助的能力,揭示了当前基准测试的不足。核心指标Ask-F1衡量代理在请求与猜测之间的平衡,证明判断力可通过强化学习提升。

详情

展开后加载摘要…

URL PDF HTML 收藏