arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-08-19 至 2026-08-19 共收录 6 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 2 篇

2603.24126 2026-08-19 cs.LG cs.PL 版本更新 76%

Likelihood Hacking in Probabilistic Program Synthesis

概率程序合成中的似然黑客行为

Jacek Karwowski, Younesse Kaddar, Zihuiwen Ye, Esmeralda S. Whitammer, Sam Staton

机构 * University of Oxford, Department of Computer Science(牛津大学计算机科学系) University of Edinburgh, School of Informatics(爱丁堡大学信息学院) CIFAR Fellow, Learning in Machines and Brains(CIFAR Fellow, 机器与大脑学习)

专题命中 代码生成 :program synthesis(title);分类 cs.LG、cs.PL

AI总结 研究概率程序合成中语言模型通过强化学习生成程序时可能人为夸大边际似然奖励的问题,提出安全语言片段SafeStan以防止似然黑客行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09932 2026-08-19 cs.PL cs.AR 版本更新 57%

Automatically Generating ML Compiler Backends from Tensor Accelerator ISA Descriptions

从张量加速器ISA描述自动生成ML编译器后端

Devansh Jain, Akash Pardeshi, Marco Frigo, Kaustubh Khulbe, Krut Patel, Saatvik Lochan, Jai Arora, Charith Mendis

专题命中 代码生成 :code generation(abstract);分类 cs.PL

AI总结 本文提出ACT工具,可基于ISA描述自动生成张量加速器的XLA编译器后端,其生成的后端性能优于商用编译器,且提升了AWS Trainium的代码生成覆盖率。

Comments Accepted at OOPSLA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2608.14048 2026-08-19 astro-ph.IM 版本更新 50%

$\texttt{Aether.jl}$: A High-Performance 3D MHD and Multifluid Dust Code Written in a Dynamic Language with an Interactive Human-AI Development Framework

Aether.jl:一种用动态语言编写、具备人机交互开发框架的高性能三维磁流体与多流体尘埃代码

Ka Wai Ho

专题命中 软件智能体 :coding agent(abstract)

AI总结 Aether.jl是一款用Julia编写的高性能三维磁流体与多流体尘埃代码,采用交互式人机开发框架,单GPU性能优于C++代码,在Frontier超算4096个GCD上并行效率超93%,支持CPU、GPU运行,已公开。

Comments 25 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 代码评测 1 篇

2608.12805 2026-08-19 cs.LG 版本更新 57%

CoMedBench: A Multi-Source Benchmark of Synthetic Medical Data Fidelity and Downstream Utility

CoMedBench:合成医疗数据保真度与下游效用的多源基准

Akanta Das, Farhad Al-Amin Dipto, Mrinmoy Sarkar Anto, David Rehkopf, Ayin Vala, Tanmoy Sarkar Pias

专题命中 代码评测 :repository(abstract);分类 cs.LG

AI总结 CoMedBench是涵盖多源合成医疗数据的可复现基准,评估多生成器在静态表格和时序ICU任务上的保真度与下游效用,实验显示合成数据可保留多数下游信号,不同生成器表现存在差异。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 2 篇

2607.15209 2026-08-19 cs.CL 版本更新 57%

Expanding the Lexicon of Ge'ez Based African Languages: A Comparative Study of Amharic and Tigrinya

扩展基于吉兹语的非洲语言词汇:阿姆哈拉语和提格雷尼亚语的比较研究

Hailay Kidu Teklehaymanot, Debela Desalegn Yadeta, Wolfgang Nejdl

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 针对低资源非拉丁脚本语言表现不佳问题,提出VEXMLM。通过训练特定语言分词器扩展XLM - R词汇并初始化嵌入,分两阶段训练,在多种任务上评估。贡献为定制程序、两阶段策略及多语言评估,提升了相关语言任务性能。

Comments 13 pages, 7 tables, 2 figurs

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15870 2026-08-19 quant-ph 版本更新 50%

A certified lower bound on the quantum-capacity threshold of the depolarizing channel

去极化信道量子容量阈值的认证下界

Artus Krohn-Grimberghe

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究针对去极化信道量子容量阈值,给出首个已证明的正性结果,明确45副本两输入态在特定p值下满足I_c>0,还实现了两个竞争码态正性边界的认证排序。

Comments 13 pages, 2 tables. v2: expanded attribution and related work; clarified claim scope and evidence taxonomy; certified bound unchanged. Verification artifact: DOI https://doi.org/10.5281/zenodo.21962925

详情

展开后加载摘要…

URL PDF HTML 收藏