arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 865 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 163 篇

2606.15110 2026-06-16 cs.CV 新提交 50%

Physics-Driven Zero-Shot MRI Reconstruction with Non-local Image Priors

基于非局部图像先验的物理驱动零样本MRI重建

Lingtong Zhang, Wenlei Li, Mu He, Li Xiao, Yang Ji

机构 * School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学技术学院)

专题命中 仓库级理解 :repository(abstract)

AI总结 提出一种物理驱动的零样本自监督学习框架,通过线圈灵敏度图引导的动态存储库、SPIRiT正则化和非局部自相似像素银行,解决欠采样MRI重建中的监督不足和过拟合问题,在FastMRI数据集上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14711 2026-06-16 cs.DC 新提交 50%

SWARM-LLM: Collaborative Inference for Edge-based Small Language Models

SWARM-LLM:基于边缘的小语言模型的协同推理

Mostafa Dahshan, Quazi Mamun, Tanmoy Debnath

专题命中 仓库级理解 :repository(abstract)

AI总结 提出SWARM-LLM路由协作层,通过轻量级不确定性估计和安全信号,在边缘SLM、对等SLM协作和云端FM之间动态选择查询处理方式,实现精度、延迟和成本的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14425 2026-06-15 cond-mat.str-el cond-mat.supr-con 新提交 50%

SmoQyElPhQMC.jl: An open-source Julia package for efficient and scalable quantum Monte Carlo simulations of electron-phonon coupled models

SmoQyElPhQMC.jl: 一个用于高效可扩展电子-声子耦合模型量子蒙特卡洛模拟的开源Julia包

Benjamin Cohen-Stead, James Neuhaus, Kipton Barros, Thomas A. Maier, Steven Johnston

专题命中 仓库级理解 :repository(abstract)

AI总结 介绍SmoQyElPhQMC.jl v1.0,一个基于SmoQyDQMC的开源Julia包,通过改进算法实现系统尺寸和逆温度线性标度的电子-声子模型量子蒙特卡洛模拟,并提供灵活脚本接口以适配不同工作流。

Comments Planned submission to SciPost Codebases, comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12585 2026-06-12 econ.GN cs.HC q-fin.EC 新提交 50%

Revisiting the ABCs of Working with AI: A Replication with Radiologists

重新审视与AI合作的ABC:一项针对放射科医生的复制研究

Daniel Martin

专题命中 仓库级理解 :repository(abstract)

AI总结 本研究在放射科医生分析胸部X光片的场景中,复制了Caplin等人关于能力和信念校准影响AI辅助收益的发现,验证了其外部有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13627 2026-06-12 hep-th gr-qc math-ph math.MP 新提交 50%

A Graphical Coaction for FRW Integrals from Partial/Relative Twisted (Co)homology

FRW 积分的图形余作用:来自部分/相对扭曲(上)同调

Andrew J. McLeod, Andrzej Pokraka, Lecheng Ren

专题命中 仓库级理解 :repository(abstract)

AI总结 利用部分/相对扭曲(上)同调中的相交理论,为共形耦合标量理论中的 FRW 积分构造了图形余作用,揭示了微分方程组合结构并开发了计算工具。

Comments 60+8 pages; many figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11877 2026-06-11 cs.NI 新提交 50%

LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence

LLM赋能的NWDAF:迈向AI原生的6G网络智能

Henok Daniel, Omar Alhussein, Cheng Li, Jie Liang, Ernesto Damiani

专题命中 仓库级理解 :repository(abstract)

AI总结 开发了一个与Free5GC兼容的开源NWDAF,集成大语言模型接口,通过意图识别实现自然语言交互,简化网络分析管理,为AI原生6G网络奠定基础。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10666 2026-06-10 cs.CV cs.DB 新提交 50%

Analyzing Training-Free Corruption Detection for Object Detection Datasets

分析目标检测数据集的无训练腐败检测

Christian Sieberichs, Simon Geerkens, Thomas Waschulzik, Viswanathan Ramesh, Alexander Braun

机构 * University of Applied Sciences Düsseldorf(杜塞尔多夫应用科学大学) Siemens Mobility GmbH(西门子交通有限公司) Goethe University Frankfurt(法兰克福大学)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文研究无训练特征空间方法在目标检测数据集中检测标注错误的应用,发现该方法能可靠暴露语义错误,但位置错误难以检测。

Comments Accepted at DataCV Workshop, Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08860 2026-06-09 cs.CV 新提交 50%

Vision-Language Work Zone Intelligence for Safety-Critical Speed Regulation of Mixed-Autonomy Vehicles in Dynamic Environments

面向动态环境中混合自主车辆安全关键速度调节的视觉语言工作区智能

Angel Martinez-Sanchez, Kianna Ng, Wesley Maia, Laura Fleig, Maitrayee Keskar, Erika Maquiling, Yash Tandon, Parthib Roy, Mohan Trivedi, Ross Greer

机构 * UC Merced(加州大学默塞德分校) Johns Hopkins(约翰霍普金斯大学) UC San Diego(加州大学圣地亚哥分校)

专题命中 仓库级理解 :repository(abstract)

AI总结 提出一种实时车载感知管线,通过目标检测与语义验证融合及滞后状态转换,从视觉标志中识别临时工作区限速,在低成本硬件上实现96.5%召回率和68.7%精确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06711 2026-06-08 physics.ins-det 新提交 50%

Lightfall: An API-first, LLM-addressable control platform for synchrotron beamlines

Lightfall: 一种面向同步辐射光束线的API优先、LLM可寻址控制平台

Ronald J. Pandolfi, Damian Guenzing, Marcus M. Noack, Sophie A. Morley, Damon English

专题命中 仓库级理解 :repository(abstract)

AI总结 针对同步辐射光束线控制界面定制化需求,提出Lightfall平台,采用API优先架构,通过统一可寻址接口暴露所有面板、设备和扫描计划,并嵌入语言模型代理驱动实验,支持自然语言修改界面,降低定制成本。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 程序分析与验证 10 篇

2607.21491 2026-07-24 cs.CL cs.LG 新提交 76%

What, Where, and How: Disentangling the Roles of Task, Language, and Model in Code Model Representations

是什么、在哪里以及如何:解开任务、语言和模型在代码模型表示中的作用

Piotr Wilam

机构 * University College London(伦敦大学学院)

专题命中 程序分析与验证 :code model(title);分类 cs.CL、cs.LG

AI总结 研究独立训练的语言模型在代码表示上的情况,通过2x2设计扩展概念电路提取方法,测量语法概念,发现任务决定概念获专用电路,模型决定电路位置及增长方式,还得出如Rust与Python电路差异等结论,为后续测试奠定基础。

Comments 16 pages, 11 figures, 6 tables. Code: https://github.com/piotrwilam/Atlas2x2 ; dataset: https://huggingface.co/datasets/piotrwilam/Atlas2x2

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09217 2026-07-13 cs.AI cs.MS 新提交 70%

OpenProver: Agentic and Interactive Theorem Proving with Lean 4

OpenProver:使用Lean 4进行智能且交互式的定理证明

Matěj Kripner, Milan Straka

机构 * Charles University, Faculty of Mathematics and Physics(查尔斯大学数学与物理系)

专题命中 程序分析与验证 :code generation(abstract);repository(abstract);分类 cs.AI

AI总结 介绍用于大语言模型驱动的自动化定理证明的开源系统OpenProver,它集成特定架构,完全开源,能自动验证证明,提供交互式界面,通过在ProofNet上评估展示自动验证在定量消融实验中的潜力。

Comments 7 pages, 2 figures. Accepted at the 19th Conference on Intelligent Computer Mathematics (CICM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10906 2026-08-12 cs.SE cs.AI 新提交 62%

GitSkills: A Dataset of Agent Skills on GitHub

GitSkills:GitHub上的智能体技能数据集

Giuseppe Destefanis, Daniel Graziotin, Matteo Vaccargiu, Marco Ortu

专题命中 程序分析与验证 :repository(abstract);分类 cs.SE、cs.AI

AI总结 本文提出GitSkills数据集,包含从28.22万个公开GitHub代码库收集的379.7117万个智能体技能相关文件,为智能体技能的多维度研究提供了数据支撑。

Comments Giuseppe Destefanis, Daniel Graziotin, Matteo Vaccargiu, and Marco Ortu. 2027. GitSkills: A Dataset of Agent Skills on GitHub. In Proceedings of the 24th International Conference on Mining Software Repositories (MSR '27). Association for Computing Machinery, New York, NY, USA, 3 pages. To appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07217 2026-07-09 cs.SE cs.CR cs.PL 新提交 62%

Finding and Understanding Miscompilation Bugs in the Solidity Compiler

在Solidity编译器中发现并理解错误编译漏洞

Bhargava Shastry

专题命中 程序分析与验证 :code generation(abstract);分类 cs.SE、cs.PL

AI总结 研究旨在提高Solidity编译器质量,创建SolSmith工具。通过生成有效测试程序使编译器测试更严格,发现25个错误编译漏洞。还对这些漏洞进行定性和定量分析,揭示优化编译器的陷阱,为智能合约及用户减少潜在风险。

Comments 16 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02370 2026-07-07 cs.SE cs.AI 新提交 62%

Understanding Agent-Based Patching of Compiler Missed Optimizations

理解基于智能体的编译器遗漏优化补丁

Batu Guan, Zirui Wang, Shaohua Li

专题命中 程序分析与验证 :coding agent(abstract);分类 cs.SE、cs.AI

AI总结 研究智能体如何为编译器遗漏优化打补丁,发现关键挑战在于泛化而非仅修复报告案例,提出历史知识增强技术以提升泛化能力。

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13298 2026-06-12 cs.SE cs.AI 新提交 62%

Mining Architectural Quality Under Agentic AI Adoption: A Causal Study of Java Repositories

在智能体AI采用下的架构质量挖掘:Java仓库的因果研究

Oliver Aleksander Larsen, Mahyar T. Moghaddam

机构 * SDU Software Engineering, University of Southern Denmark(SDU软件工程,丹麦南部大学)

专题命中 程序分析与验证 :repository(abstract);分类 cs.SE、cs.AI

AI总结 通过差分差分设计和Borusyak插值估计器,研究智能体AI工具采用对Java仓库架构气味密度(ASD)的因果影响,发现ASD下降6.7%源于代码量增长,而非架构改进。

Comments 16 pages. Accepted for presentation at the 52nd Euromicro Conference on Software Engineering and Advanced Applications (SEAA) 2026, Krakow, Poland, 2-4 September 2026, and for publication in the Springer LNCS proceedings. This is the author's accepted manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00555 2026-07-02 cs.SE 新提交 57%

Rise From The Ashes: LLM-based Static Analysis for Deep Learning Framework Bugs

从灰烬中崛起:基于LLM的深度学习框架缺陷静态分析

Shaoyu Yang, Haifeng Lin, Chunrong Fang, Xiang Chen, Wei Cheng, Jiawei Liu, Yiyu Zhang, Hongyu Liu, Zhenyu Chen

专题命中 程序分析与验证 :repository(abstract);分类 cs.SE

AI总结 提出首个基于LLM的静态分析技术Phoenix,通过结构化语义桥接中间表示建模跨语言张量流,结合多智能体工作流检测深度学习框架缺陷,已在PyTorch中发现31个新bug。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25244 2026-06-25 cs.PL 新提交 57%

Reading AI Model Compilation in MLIR Through the Lens of Formal Theories

通过形式理论的视角解读MLIR中的AI模型编译

Javed Absar

专题命中 程序分析与验证 :coding agent(abstract);分类 cs.PL

AI总结 本文通过形式理论(如项重写系统、精化演算、抽象解释)对应MLIR的匹配-重写引擎、阶段降低和范围分析,论证形式概念有助于明确抽象完备性、理想设计及实际权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19149 2026-06-19 cs.CR cs.LG 新提交 57%

OpenAnt: LLM-Powered Vulnerability Discovery Through Code Decomposition, Adversarial Verification, and Dynamic Testing

OpenAnt:通过代码分解、对抗性验证和动态测试实现LLM驱动的漏洞发现

Nahum Korda, Gadi Evron

专题命中 程序分析与验证 :repository(abstract);分类 cs.LG

AI总结 提出OpenAnt系统,结合静态分析与LLM推理,通过代码分解、对抗性验证和动态测试三阶段流水线,在降低误报率的同时发现未知漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29291 2026-08-03 cs.SC cs.LO 新提交 50%

SAT Certificates for the Matrix-Multiplication Challenges over F2: All Ten `Expected-UNSAT` Instances Are Satisfiable, and a Type-3-Free Rank-23 Scheme

F₂上矩阵乘法挑战的SAT证书:全部10个“预期不可满足”实例均可满足,以及一个无3型项的秩23方案

Nick Palladinos

专题命中 程序分析与验证 :repository(abstract)

AI总结 该研究针对F₂上的矩阵乘法SAT基准,发现10个预期不可满足的Challenge-2公式实际可满足,还构造了无3型项的秩23方案,生成了21个实例的SAT证书且可快速复现。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他AI编程 6 篇

2608.04215 2026-08-06 cs.SE cs.AI 新提交 62%

A Unified Model for Cross-Domain Clone Detection via Model Merging

基于模型合并的跨域代码克隆检测统一模型

Palash R. Roy, Banani Roy, Kevin A. Schneider, Chanchal K. Roy

专题命中 其他AI编程 :code model(abstract);分类 cs.SE、cs.AI

AI总结 本文提出通过模型合并技术构建跨域代码克隆检测器,经实验验证TIES合并方法泛化性更优,合并后检测器性能优于零样本代码大模型且泛化性更强。

Comments Accepted at ASE 2026

Journal ref Proceedings of the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26), October 12--16, 2026, Munich, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20950 2026-07-24 cs.LG 新提交 57%

Best-of-Evidence: Best-of-N Selection under Partial Verification

最佳证据:部分验证下的最佳N选择

Cenwei Zhang, Teng Fang, Yuxia Wang, Derek Li, Bryan Dai, Lei You

机构 * IQuest Research(IQuest研究公司) INSAIT(INSAIT公司) Technical University of Denmark(丹麦技术大学)

专题命中 其他AI编程 :code model(abstract);分类 cs.LG

AI总结 研究视觉语言任务中部分验证问题,提出最佳证据(BoE)推理时选择框架,保持候选池固定,用图表示主张并分配预算,形式化部分验证选择,有实用控制器,实验表明其能改进选择并揭示相关限制。

Comments 3 figures, 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16229 2026-06-16 cs.PL 新提交 57%

Synthesizing Best Abstract Transformers via Parallel Bit-Vector Optimization

通过并行位向量优化合成最佳抽象转换器

Weiqi Wang, Peisen Yao, Hanrui Zuo, Yuan Li, Hongfei Fu, Kui Ren

专题命中 其他AI编程 :code model(abstract);分类 cs.PL

AI总结 提出Spear并行合成框架,利用目标间位独立性加速最优抽象转换器合成,在二进制分析基准上优于现有OMT求解器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13918 2026-06-15 cs.SE cs.CR 新提交 57%

Bayesian-Calibrated Detection of Hallucinated Package Imports in AI-Assisted Code

AI辅助代码中幻觉包导入的贝叶斯校准检测

Lom M. Hillah, Jean-Marc Richard, Ryan Hasnaoui

专题命中 其他AI编程 :code model(abstract);分类 cs.SE

AI总结 提出贝叶斯校准层,基于三元认知分类法输出Beta后验概率,并利用PyPI元数据检测注册但可疑的包,优于二元基线。

Comments 23 pages, 2 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12364 2026-06-11 cs.LG 新提交 57%

On Subquadratic Architectures: From Applications to Principles

关于次二次架构:从应用到原理

Anamaria-Roberta Hartl, Levente Zólyomi, David Stap, Pieter-Jan Hoedt, Niklas Schmidinger, Lukas Hauzenberger, Sebastian Böck, Günter Klambauer, Sepp Hochreiter

机构 * ELLIS Unit Linz, LIT AI Lab, Institute for Machine Learning, Johannes Kepler University Linz(林茨ELLIS单元、LIT AI实验室、机器学习研究所、约翰内斯·开普勒大学林茨) NVIDIA(英伟达)

专题命中 其他AI编程 :code model(abstract);分类 cs.LG

AI总结 本文比较了xLSTM、Mamba-2和Gated DeltaNet三种次二次架构,发现xLSTM在代码预训练、蒸馏和时间序列预训练中表现最佳,其优势源于灵活稳定的门控记忆校正机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23528 2026-07-28 physics.plasm-ph 新提交 50%

Implementation and first application of EMC3-EIRENE on DTT for assessing the heat load on the ICRH antenna

EMC3-EIRENE在DTT上的实现及首次应用:评估ICRH天线的热负荷

H. S. Wu, Y. Feng, F. Subba, S. Ceccuzzi, P. Innocente, M. M. Robaldo, A. A. Tuccillo, R. Zanino

专题命中 其他AI编程 :code model(abstract)

AI总结 介绍EMC3-EIRENE在DTT上的实现及应用,通过轴对称几何和SOLPS-ITER结果评估其性能,纳入ICRH天线结构进行模拟,得出热负荷分布预测值,还评估了三维气体喷射对天线热负荷的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏