arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 3924 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 3924 篇

1203.2434 2012-08-27 cs.OH 71%

Institutional repository `eKMAIR': establishing and populating a research repository for the National University "Kyiv Mohyla Academy"

Tetiana Yaroshenko

专题命中 仓库级理解 :repository(title)

Comments This paper has been administratively withdrawn because it was submitted under false pretenses by someone other than Tetiana Yaroshenko and she did not write any of the text

Journal ref Naukovi zapiski UKMA, vol.12 N.3 p.13-21

详情

展开后加载摘要…

URL PDF HTML 收藏
1202.3820 2012-02-20 math.AP 71%

Study of degenerate parabolic system modeling the hydrogen displacement in a nuclear waste repository

Florian Caro, Bilal Saad, Mazen Saad

专题命中 仓库级理解 :repository(title)

Comments Keywords: Degenerate system, nonlinear parabolic system, compressible flow, porous media

详情

展开后加载摘要…

URL PDF HTML 收藏
1105.2968 2011-05-17 q-fin.RM 71%

Banking retail consumer finance data generator - credit scoring data repository

Karol Przanowski

专题命中 仓库级理解 :repository(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
0709.0542 2009-12-01 astro-ph 71%

The largest oxigen bearing organic molecule repository

M. A. Requena-Torres, J. Martin-Pintado, S. Martin, M. R. Morris

专题命中 仓库级理解 :repository(title)

Comments 20 pages, 4 figures, accepted in ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏
cs/0306081 2009-11-30 cs.DB 71%

An on-line Integrated Bookkeeping: electronic run log book and Meta-Data Repository for ATLAS

M. Barczyc, D. Burckhart-Chromek, M. Caprini, J. Da Silva Conceicao, M. Dobson, J. Flammer, R. Jones, A. Kazarov, S. Kolos, D. Liko, L. Mapelli, I. Soloviev, R. Hart NIKHEF, A. Amorim, D. Klose, J. Lima, L. Lucio, L. Pedro, H. Wolters, E. Badescu NIPNE, I. Alexandrov, V. Kotov, M. Mineev JINR, Yu. Ryabov PNPI

专题命中 仓库级理解 :repository(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15769 2026-07-20 cs.SE cs.CY 新提交 70%

Making Agent-Mediated Contributions Governable: A Project-Level Governance Manifest for Open-Source AI Collaboration

使代理介导的贡献具有可治理性:开源人工智能协作的项目级治理宣言

Jinjin Gao, Luyang Li, Shufen Guo, Ligang He, Xiaoning Sun

专题命中 仓库级理解 :repository(abstract);coding agent(abstract);分类 cs.SE

AI总结 研究开源人工智能协作中代理介导贡献的治理问题,开发代理治理宣言(AGM)作为双向治理合同,通过实验验证其有效性,构建三层框架,推进合规数字创新治理并保留维护者决策权。

Comments Preprint. Under journal review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02772 2026-07-14 cs.SE 版本更新 70%

From Codebases to LLMs: Non-Inclusive Naming in Linux Foundation Repositories

从代码库到语言模型:Linux 基金会存储库中的非包容性命名

Honghao Tan, Md Nafiu Rahman, Shin Hwei Tan

专题命中 仓库级理解 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 研究利用 NISCAN 框架检测 Linux 基金会存储库中代码及相关工件的非包容性术语,对 461 个存储库进行生态系统规模研究,分析术语变化及影响因素,还通过案例研究评估大语言模型处理情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00953 2026-06-02 cs.LG cs.MA 70%

When Parallelism Pays Off: Cohesion-Aware Task Partitioning for Multi-Agent Coding

当并行性有回报时:面向多智能体编码的凝聚力感知任务划分

Xu Yang, Lunyiu Nie, Ethan Chandra, Stanislav Gannutin, Fangru Lin, Swarat Chaudhuri

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Oxford(牛津大学)

专题命中 仓库级理解 :repository(abstract);coding agent(abstract);分类 cs.LG

AI总结 提出Co-Coder方法,通过静态分析构建依赖图、社区检测划分图及依赖感知调度,在仓库级软件工程中平衡通信与计算开销,实现多智能体并行编码的效率和成本优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14634 2026-05-25 cs.SE 70%

Documentation-Guided Agentic Codebase Migration from C to Rust

文档引导的从 C 到 Rust 的智能代码库迁移

Minh Le-Anh, Anh Nguyen Hoang, Bach Le, Nghi D. Q. Bui

专题命中 仓库级理解 :repository(abstract);coding agent(abstract);分类 cs.SE

AI总结 提出 RustPrint 框架,通过文档引导的智能体协调,实现仓库级别的 C 到 Rust 迁移,在编译性、特征保留和测试通过率上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08013 2026-05-11 cs.AI 70%

Learning CLI Agents with Structured Action Credit under Selective Observation

基于选择性观察的结构化行动信用学习CLI代理

Haoyang Su, Ying Wen

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 仓库级理解 :repository(abstract);coding agent(abstract);分类 cs.AI

AI总结 本文研究了CLI代理在选择性观察和行动信用分配中的瓶颈,提出σ-Reveal和A³方法,构建ShellOps数据集以评估CLI任务学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19606 2026-05-01 cs.AI cs.MA 70%

AblateCell: A Reproduce-then-Ablate Agent for Virtual Cell Repositories

AblateCell: 一个用于虚拟细胞库的可重现后消去代理

Xue Xia, Chengkai Yao, Mingyu Tsoi, Xinjie Mao, Wenxuan Huang, Jiaqi Wei, Hao Wu, Cheng Tan, Lang Yu, Yuejin Yang, Mengdi Liu, Siqi Sun, Zhangyang Gao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of California San Diego(加州大学圣地亚哥分校) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 仓库级理解 :repository(abstract);coding agent(abstract);分类 cs.AI

AI总结 AblateCell通过可重现后消去方法解决AI虚拟细胞性能归因问题,实现高准确度的代码库验证与属性归因。

Comments 25 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10747 2026-04-14 cs.SE 70%

Engineering Students' Usage and Perceptions of GitHub Copilot in Open-Source Projects

工程学生在开源项目中使用GitHub Copilot的使用情况与认知

Neha Rani, Jeevan Ram Munnangi, Austin Matthew Spangler, Donald Honeycutt

专题命中 仓库级理解 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 研究探讨了工程学生在开源项目中使用GitHub Copilot的差异,分析了性别、编程能力及AI熟悉度对使用情况的影响,发现学生更倾向于使用聊天和代码生成功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01944 2026-02-23 cs.SE cs.AI cs.CL cs.IR cs.PL 70%

The Invisible Hand of AI Libraries Shaping Open Source Projects and Communities

人工智能库对开源项目与社区的无形之手

Matteo Esposito, Andrea Janes, Valentina Lenarduzzi, Davide Taibi

机构 * University of Oulu(奥卢大学) Free University of Bozen-Bolzano(博尔扎诺自由大学) University of Southern Denmark(丹麦南部大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文研究人工智能库在Python和Java开源项目中的采用情况及其对开发实践和技术生态的影响。

Comments ACCEPTED REGISTERED REPORT AT SANER (CORE A*) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02049 2025-06-04 cs.DC cs.AI cs.MA cs.NE 70%

EvoGit: Decentralized Code Evolution via Git-Based Multi-Agent Collaboration

Beichen Huang, Ran Cheng, Kay Chen Tan

机构 * Department of Data Science and Artificial Intelligence(数据科学与人工智能系)

专题命中 仓库级理解 :repository(abstract);coding agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14234 2024-12-24 cs.SE cs.AI cs.LG cs.PL 70%

Syzygy: Dual Code-Test C to (safe) Rust Translation using LLMs and Dynamic Analysis

Manish Shetty, Naman Jain, Adwait Godbole, Sanjit A. Seshia, Koushik Sen

专题命中 仓库级理解 :code generation(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Project webpage at https://syzygy-project.github.io/. Preliminary version accepted at LLM4Code 2025, 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.01413 2021-08-04 cs.SE 70%

IASelect: Finding Best-fit Agent Practices in Industrial CPS Using Graph Databases

Chandan Sharma, Roopak Sinha, Paulo Leitao

专题命中 仓库级理解 :software agent(abstract);repository(abstract);分类 cs.SE

Comments Conference paper, 7 pages, 6 figures, 1 table

Journal ref Proceedings of the 17th International Conference on Industrial Informatics (INDIN2019). Helsinki, Finland, IEEE Computer Society Press, pp.1558-1563

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19933 2026-07-15 cs.CL cs.AI cs.LG 69%

NRR-Phi: A Typed External Text-to-State Interface and Update Contract for Inspectable Ambiguity-State Maintenance

NRR-Phi:LLM推理中为保持歧义性的文本到状态映射

Kei Saito

机构 * Independent Researcher, Japan(日本独立研究员)

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出NRR-Phi框架,通过文本到状态映射保留多解释性,在LLM推理中延迟语义坍缩。

Comments 30 pages, 5 figures, 8 tables. Replacement synced to the current GitHub repository snapshot. Series hub: https://github.com/kei-saito-research/nrr-series-hub

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06176 2026-02-09 cs.AI cs.CL cs.LG 69%

Large Language Model Reasoning Failures

大语言模型推理失败

Peiyang Song, Pengrui Han, Noah Goodman

机构 * California Institute of Technology(加州理工学院) Stanford University(斯坦福大学) Carleton College(卡尔顿学院)

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.CL、cs.AI、cs.LG

AI总结 本文首次系统调查大语言模型推理失败问题,提出分类框架并分析其根本原因,旨在提升模型的推理能力与鲁棒性。

Comments Repository: https://github.com/Peiyang-Song/Awesome-LLM-Reasoning-Failures. Published at TMLR 2026 with Survey Certification

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01801 2024-05-08 cs.LG cs.AI cs.CL 69%

Large Language Models for Time Series: A Survey

Xiyuan Zhang, Ranak Roy Chowdhury, Rajesh K. Gupta, Jingbo Shang

专题命中 仓库级理解 :repository(abstract,comments);分类 cs.CL、cs.AI、cs.LG

Comments GitHub repository: https://github.com/xiyuanzh/awesome-llm-time-series

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11095 2026-08-12 cs.AI cs.LG cs.SE 新提交 67%

Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

CLAUDE.md 为何不断膨胀?智能体编码中的灾难性记忆

Kushal Chakrabarti

机构 * South Park Commons(南公园社区)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 该研究针对智能体编码中提示文件无限制膨胀的问题,提出通过提示注释消除多余指令,可使现实中智能体指令遵循能力提升多达23.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03036 2026-08-05 cs.SE cs.AI cs.LG 新提交 67%

LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs

野外环境下的大语言模型服务:框架、方法与系统设计的实证研究

Forough Majidi, Mohammad Mehdi Morovati, Foutse Khomh, Heng Li

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 本研究通过实证分析开源软件系统中5种LLM服务框架的应用情况,明确了框架使用特点、常用服务方法及应用场景,为相关人员提供了实践见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27528 2026-07-31 cs.CR cs.AI cs.CL cs.SE 新提交 67%

ThreatForest: Multi-Agent Attack Tree Generation with Pluggable TTP Framework Mapping

ThreatForest:基于可插拔TTP框架映射的多智能体攻击树生成方法

Cristian Leo, Anton Dykyi, Danny Cortegaca, Daniel Begimher, Prakash Jha

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 ThreatForest是首个将代码仓库转化为带TTP映射攻击树及对应缓解措施的端到端多智能体系统,其嵌入编码器是TTP映射准确率的核心瓶颈,相关基准框架可用于同类系统测试。

Comments 20 pages, 12 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14037 2026-07-17 cs.SE cs.AI cs.CY cs.LG 版本更新 67%

Early Adoption of Agentic Coding Tools by GitHub Projects

GitHub项目对智能编码工具的早期采用

Maliha Noushin Raida, Daqing Hou

机构 * Rochester Institute of Technology(罗切斯特技术学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 研究GitHub项目对智能编码工具的早期采用情况,通过分析大量智能PR,探究采用情况、项目生产力及协作模式,发现多数仓库采用少,小项目参与度高,生产力差异大,人机协作以单人监督为主,为相关管理提供实证依据。

Comments Accepted at the KDD 2026 Workshop on Agentic Software Engineering (SE 3.0)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07907 2026-07-10 cs.LG cs.AI cs.CL cs.CR cs.MM 新提交 67%

Multimodal Unlearning Across Vision, Language, Video, and Audio: Survey of Methods, Datasets, and Benchmarks

跨视觉、语言、视频和音频的多模态遗忘:方法、数据集和基准的综述

Nobin Sarwar, Shubhashis Roy Dipta, Zheyuan Liu, Vaidehi Patil

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 综述跨视觉、语言、音频和视频的多模态遗忘,基于相关进展等提供统一视角,通过分类法系统比较模型架构和模态,阐明权衡,强调开放问题与实际考虑,支持未来研究与部署,并发布存储库。

Comments Accepted to ACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14568 2026-06-29 cs.SE cs.CL cs.LG 版本更新 67%

Given, When, Then, Again: Mining Subscenario Refactoring Candidates in Behaviour-Driven Test Suites with ML Classifiers and LLM-Judge Baselines

在行为驱动软件测试套件中挖掘子场景重构机会:ML分类器和LLM-判断基线

Ali Hassaan Mughal, Noor Fatima, Muhammad Bilal

机构 * Independent Researcher(独立研究者;应用MBA(数据分析),德克萨斯韦斯利安大学) Applied MBA (Data Analytics), Texas Wesleyan University(独立研究者;计算机工程学士,国立科学与技术大学(NUST)) Independent Researcher(独立研究者;管理硕士,慕尼黑技术大学) B.E. Computer Engineering, National University of Sciences and Technology (NUST) Independent Researcher M.Sc. Management, Technical University of Munich

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.LG

AI总结 本文通过ML分类器和LLM基线,识别行为驱动开发测试套件中可提取的子场景,量化其在公共BDD生态系统中的普及率。

Comments 31 pages, 10 figures, 6 tables, 56 references. v2: retitled; references corrected and verified; threshold-sensitivity and imbalance-robust metrics added; figures restyled. Code and data (Apache-2.0): https://github.com/amughalbscs16/cukereuse_subscenarios_release (archived: https://doi.org/10.5281/zenodo.20356527). Upstream corpus: https://doi.org/10.5281/zenodo.19754359

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14470 2026-06-23 cs.AI cs.CL cs.LG 新提交 67%

GitOfThoughts: Version-Controlled Reasoning and Agent Memory You Can Replay, Diff, and Merge

GitOfThoughts: 版本控制的推理与可回放、差异比较和合并的智能体记忆

Pavan C Shekar, Abhishek H S, Aswanth Krishnan

机构 * QpiAI

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出GitOfThoughts框架,将智能体推理树存储为git仓库,实现推理的可回放、审计和合并;实验表明,对于新问题,任何记忆格式均不能可靠提升准确率,仅当检索案例与当前问题高度相似(>0.8)时才有显著提升,且收益来自答案检索而非方法迁移。

Comments 10 pages, 1 figure, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06492 2026-06-05 cs.SE cs.AI cs.CL 67%

Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution

Code2LoRA:用于软件演化下代码语言模型的超网络生成适配器

Liliana Hotsko, Yinxi Li, Yuntian Deng, Pengyu Nie

机构 * University of Waterloo(滑铁卢大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 提出Code2LoRA超网络框架,通过生成仓库特定的LoRA适配器注入仓库知识,无需推理时令牌开销,支持静态和演化两种场景,在RepoPeftBench上达到与逐仓库LoRA相当或更优的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31264 2026-06-01 cs.AI cs.CL cs.LG 67%

COLLEAGUE.SKILL: Automated AI Skill Generation via Expert Knowledge Distillation

COLLEAGUE.SKILL: 通过专家知识蒸馏实现自动化AI技能生成

Tianyi Zhou, Dongrui Liu, Leitao Yuan, Jing Shao, Xia Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出一个从异构痕迹到可检查、可修正、可代理使用的技能包的自动化蒸馏系统,用于生成基于人的AI技能。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04671 2026-06-01 cs.AI cs.LG cs.LO cs.PL 67%

ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving

ProofWala: 多语言证明数据合成与定理证明框架

Amitayush Thakur, George Tsoukalas, Greg Durrett, Swarat Chaudhuri

机构 * University of Texas, Austin, USA(得克萨斯大学奥斯汀分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG、cs.PL

AI总结 提出ProofWala框架,通过itp-interface库实现与交互式定理证明器的程序化交互,支持多语言证明数据合成、并行证明搜索,并验证了跨语言与跨领域迁移的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17626 2026-04-21 cs.AI cs.CL cs.SE 67%

Toward Reusability of AI Models Using Dynamic Updates of AI Documentation

迈向通过动态更新AI文档提高AI模型重用性

Peter Bajcsy, Walid Keyrouz

机构 * Hugging Face AI consortium

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出通过动态更新AI文档模板,缩短AI模型卡片更新滞后时间,提升AI模型重用性。

Comments 28 pages, 16 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏