arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-22 至 2026-07-22 共收录 6 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 6 篇

2607.19104 2026-07-22 cs.SE cs.AI 新提交 81%

SciCodePile: A 128GB Corpus and Executable Benchmark for Challenging Scientific Code Generation

SciCodePile:用于具有挑战性的科学代码生成的128GB语料库和可执行基准测试

Weifeng Sun, Ye Fan, Yuchen Chen, Gou Tan, Jieke Shi, Yuan Yidi, Swee Liang Wong, Jonathan Pan, David Lo

机构 * Singapore Management University(新加坡管理大学) Nanjing University(南京大学) SUN YAT-SEN University(孙中山大学) Home Team Science & Technology Agency(家庭团队科技局)

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.AI

AI总结 研究大型语言模型处理科学代码的能力,提出SciCodePile语料库及可执行基准测试,评估15个模型在三项任务上的表现,发现科学代码生成极具挑战,同时展示了该语料库在训练上的效用,代码和数据可获取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18886 2026-07-22 cs.SE 新提交 70%

TraceDev: A Traceability-Driven Multi-agent Framework for Requirement-to-Code Development

TraceDev:一种用于需求到代码开发的可追溯性驱动的多智能体框架

Mingyu Chen, Yakun Zhang, Zihao Xie, Yixing Luo, Jinrui Xu, Cuiyun Gao, Kaiqi Zhao, Yunming Ye

专题命中 代码生成 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 针对现有方法在自然语言需求到代码转换中存在的不足,提出TraceDev多智能体框架,通过五个特定角色智能体及可追溯性图,实现自动化软件开发,在两个数据集上的评估结果证明了其在需求到代码生成上的有效性。

Comments Accepted by ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24927 2026-07-22 cs.CL cs.AI cs.LG 版本更新 67%

Large Language Models Explore by Latent Distilling

通过潜在蒸馏探索大语言模型

Yuanhao Zeng, Ao Lu, Lufei Li, Zheng Zhang, Yexin Li, Kan Ren

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI, Beijing, China(人工智能通用基础理论国家重点实验室,BIGAI,北京,中国) School of Information Science and Technology, ShanghaiTech University, Shanghai, China(信息科学与技术学院,上海交通大学,上海,中国)

专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Exploratory Sampling方法,通过蒸馏模型引导生成过程,提升语义多样性与推理效率,在数学、科学和代码生成中表现优异。

Comments 25 pages, 5 figures. Accepted in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18348 2026-07-22 cs.LG cs.AI 新提交 62%

An Analysis of Residual-Stream Geometry Across Transformer Depth

跨Transformer深度的残差流几何分析

Sunit Bhattacharya, Ravi Shankar Kolli

机构 * ProRata AI(ProRata人工智能公司)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 研究跨Transformer深度的残差流几何规律,提出以转换为中心的分析方法,通过相对位移等测量揭示规律,如相对位移与层有关、旋转幅度恒定等,构建了测量框架,表明深度曲线依赖模型且条件稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21378 2026-07-22 cs.RO cs.AI 版本更新 57%

RoboInspector: Unveiling the Unreliability of Policy Code for LLM-enabled Robotic Manipulation

RoboInspector:揭示用于基于大语言模型的机器人操作的策略代码的不可靠性

Chenduo Ying, Linkang Du, Peng Cheng, Yuanchao Shu

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究基于大语言模型的机器人操作中策略代码不可靠问题,设计RoboInspector从任务复杂性和指令粒度揭示其不可靠性,通过实验识别四种不可靠行为及原因,还引入优化方法,可提高策略代码生成可靠性达35%。

Comments Accepted to ACM Transactions on Intelligent Systems and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03328 2026-07-22 cs.CV cs.IR 版本更新 50%

Beyond Post-Quantization: Native Hash Learning with a Dedicated HASH Token

超越后量化:使用专用哈希令牌的原生哈希学习

Xinze Liu, Ding Wang, Dayan Wu, Hengjie Zhu, Peng Fu, Zheng Lin, Weiping Wang

机构 * Institute of Information Engineering, CAS(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Department of Applied Mathematics and Statistics, Johns Hopkins University(约翰霍普金斯大学应用数学与统计系)

专题命中 代码生成 :code generation(abstract)

AI总结 研究高效图像检索的紧凑表示问题,提出HashViT框架,通过专用哈希令牌及相关设计在Transformer内生成二进制表示,经统一目标优化,实验表明其性能优且保留汉明码效率。

详情

展开后加载摘要…

URL PDF HTML 收藏