arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 3920 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 3920 篇

2406.04464 2024-06-10 cs.SE cs.AI cs.LG 82%

On The Importance of Reasoning for Context Retrieval in Repository-Level Code Editing

Alexander Kovrigin, Aleksandra Eliseeva, Yaroslav Zharov, Timofey Bryksin

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16443 2024-03-26 cs.CL cs.AI cs.SE 82%

CodeS: Natural Language to Code Repository via Multi-Layer Sketch

Daoguang Zan, Ailun Yu, Wei Liu, Dong Chen, Bo Shen, Wei Li, Yafen Yao, Yongshun Gong, Xiaolin Chen, Bei Guan, Zhiguang Yang, Yongji Wang, Qianxiang Wang, Lizhen Cui

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL、cs.AI

Comments https://github.com/NL2Code/CodeS

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03091 2023-10-05 cs.CL cs.AI cs.SE 82%

RepoBench: Benchmarking Repository-Level Code Auto-Completion Systems

Tianyang Liu, Canwen Xu, Julian McAuley

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04125 2025-08-07 cs.SE cs.AI 82%

Experimental Analysis of Productive Interaction Strategy with ChatGPT: User Study on Function and Project-level Code Generation Tasks

Sangwon Hyun, Hyunjun Kim, Jinhyuk Jang, Hyojin Choi, M. Ali Babar

机构 * Adelaide University(阿德莱德大学) Korea Advanced Institute of Science(韩国科学技术院)

专题命中 仓库级理解 :code generation(title,abstract);分类 cs.SE、cs.AI;repository(comments)

Comments The benchmark repository has not been publicly released yet due to the IP policy in our institutions. If you would like to use the benchmark or collaborate on extension, please contact "dr.sangwon.hyun@gmail.com"

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06471 2026-08-10 cs.CR cs.AI cs.SE 新提交 81%

CyberForge: Verified Vulnerability Injection at Repository Level for Cybersecurity Agent Training

CyberForge:用于网络安全智能体训练的、基于代码仓库级别的经验证漏洞注入框架

Amine Lbath, Manan Suri, Aurelien Delaitre, Vadim Okun, Massih-Reza Amini, Ram D. Sriram, Dinesh Manocha

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 本研究提出CyberForge框架,通过向真实C/C++项目注入漏洞生成经验证的代码仓库级安全训练数据,微调后可提升智能体在SEC-bench和PatchEval上的漏洞修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13384 2026-06-04 cs.SE cs.AI 81%

VulnAgent-R2: Evidence-Calibrated Multi-Agent Auditing for Repository-Level Vulnerability Detection

VulnAgent-R2: 证据校准的多智能体审计用于仓库级漏洞检测

Renwei Meng, Haoyi Wu, Jingming Wang

机构 * stu.ahu.edu.cn(安徽大学)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 提出VulnAgent-R2,一个预算感知的多智能体审计框架,通过反事实证据重加权、构建感知验证计划合成和成本风险帕累托调度器,在仓库级漏洞检测中提升F1和AUROC,并降低在线令牌消耗。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16187 2026-06-01 cs.SE cs.LG 81%

MatchFixAgent: Language-Agnostic Autonomous Repository-Level Code Translation Validation and Repair

MatchFixAgent: 语言无关的自主仓库级代码翻译验证与修复

Ali Reza Ibrahimzada, Brandon Paulsen, Reyhaneh Jabbarvand, Joey Dodds, Daniel Kroening

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign, Urbana, IL, USA(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Amazon, Arlington, VA, USA(亚马逊公司,阿灵顿,弗吉尼亚州,美国) University of Oxford, Oxford, UK(牛津大学,牛津,英国)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.LG

AI总结 提出基于大语言模型的多智能体框架MatchFixAgent,实现语言无关的仓库级代码翻译等价性验证与修复,在验证覆盖率和修复成功率上显著优于现有方法。

Comments Published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29277 2026-05-29 cs.SE cs.AI 81%

Code-QA-Bench: Separating Code Reasoning from Documentation Memorization in Repository-Level QA

Code-QA-Bench:在仓库级问答中分离代码推理与文档记忆

Jun Zhang, JianYing Qu, Hanwen Du, Zhongkai Sun, Yehua Yang, Qiao Zhao

机构 * Baidu Inc(百度公司)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 提出Code-QA-Bench框架,通过答案优先生成和三条件实验设计,自动构建仓库级代码理解基准,以区分代码推理、文档回忆和预训练记忆的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26177 2026-05-27 cs.SE cs.AI 81%

RepoMirage: Probing Repository Context Reasoning in Code Agents with Perturbations

RepoMirage: 通过扰动探测代码智能体的仓库上下文推理

Hanyu Li, Yichi Zhang, Speed Zhu, Hang Su, Jun Zhu, Yinpeng Dong

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) Tencent(腾讯)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 提出RepoMirage评估套件,通过语义保持的仓库级扰动和扩展任务,揭示代码智能体在仓库上下文推理中的显著缺陷,并基于结构优先的原型工作流RepoAnchor展示改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20957 2026-05-27 cs.SE cs.AI 81%

One Tool Is Enough: Reinforcement Learning for Repository-Level LLM Agents

一个工具就够了:面向仓库级LLM智能体的强化学习

Zhaoxi Zhang, Yitong Duan, Yanzhi Zhang, Yiming Xu, Zhixiang Wang, Kun Liang, Weikang Li, Jiahui Liang, Deguo Xia, Jizhou Huang, Jiyan He, Yunfang Wu

机构 * National Key Laboratory for Multimedia Information Processing, Peking University(信息处理国家级重点实验室,北京大学) School of Computer Science, Peking University(北京大学计算机科学学院) Zhongguancun Institute of Artificial Intelligence (ZGCI)(中关村人工智能研究院(ZGCI)) Baidu Inc(百度公司)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 提出RepoNavigator,一个仅配备单一执行感知工具(跳转到调用符号定义)的LLM智能体,通过强化学习端到端训练,在仓库级问题定位中达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15815 2026-05-18 cs.SE cs.CL cs.MA 81%

BootstrapAgent: Distilling Repository Setup into Reusable Agent Knowledge

BootstrapAgent: 将仓库设置提炼为可重用的代理知识

Sihan Fu, Oucheng Liu, Shiyuan Wang, Jin Shi, Chengkun Wei

机构 * Zhejiang University(浙江大学) The Australian National University(澳大利亚国立大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL

AI总结 BootstrapAgent通过提炼仓库初始化过程中的启发式知识,生成可验证的代理合同,提升代码代理在 unfamiliar repositories 的任务成功率和效率。

Comments 19 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14362 2026-05-15 cs.SE cs.AI 81%

Correctness-Aware Repository Filtering Under Maximum Effective Context Window Constraints

在最大有效上下文窗口约束下的正确性感知仓库过滤

Shweta Mishra

机构 * Independent Researcher(独立研究者)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 本文提出一种正确性感知的上下文卫生框架,通过预执行的大小基 heuristic 过滤器在 tokenization 前拦截仓库扫描,实现低开销的上下文优化,提升代码分析准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12622 2026-05-01 cs.AI cs.CR cs.ET cs.LG cs.SY eess.SY 81%

The AI Risk Repository: A Comprehensive Meta-Review, Database, and Taxonomy of Risks From Artificial Intelligence

人工智能风险仓库:人工智能风险的全面元综述、数据库和分类

Peter Slattery, Alexander K. Saeri, Emily A. C. Grundy, Jess Graham, Michael Noetel, Risto Uuk, James Dao, Soroush Pour, Stephen Casper, Neil Thompson

机构 * MIT AI Risk Initiative(麻省理工学院人工智能风险倡议)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.AI、cs.LG

AI总结 本文构建了首个公开可访问的人工智能风险数据库,通过系统综述和专家咨询,分类了777个风险,涵盖因果因素和领域分类,为协调管理AI风险提供基础。

Journal ref Patterns 101517 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06793 2026-04-09 cs.SE cs.AI 81%

Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development

通过问答和基于特征的开发评估仓库级软件文档

Xinchen Wang, Ruida Hu, Cuiyun Gao, Pengfei Gao, Chao Peng

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Independent Researcher, China(独立研究者)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 本文提出SWD-Bench基准,通过功能驱动的问答任务评估仓库级文档质量,揭示现有方法局限,并展示高质量文档对SWE-Agent问题解决率的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26567 2026-04-07 cs.SE cs.AI 81%

Beyond Code Snippets: Benchmarking LLMs on Repository-Level Question Answering

超越代码片段:在仓库层面评估大语言模型的问答任务

Yoseph Berhanu Alebachew, Hunter Leary, Swanand Vaishampayan, Chris Brown

机构 * Department of Computer Science, Virginia Tech(弗吉尼亚理工大学计算机科学系)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 本文提出StackRepoQA数据集,用于评估大语言模型在多项目仓库层面的问答能力,通过对比不同配置下的性能,揭示了模型在处理仓库级程序理解时的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16107 2026-03-18 cs.SE cs.AI 81%

RepoReviewer: A Local-First Multi-Agent Architecture for Repository-Level Code Review

RepoReviewer: 一种面向仓库级别的多智能体架构

Peng Zhang

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 RepoReviewer通过分解仓库获取、上下文合成、文件分析等步骤,提供一种实用的仓库级自动化审查架构,强调系统设计与可重用的评估工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03304 2026-03-05 cs.LG cs.AI 81%

Knowledge Graph and Hypergraph Transformers with Repository-Attention and Journey-Based Role Transport

知识图谱与超图变换器与仓库注意力和基于旅程的角色传输

Mahesh Godavarti

专题命中 仓库级理解 :repository(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种结合句子和结构化数据的模型,通过仓库注意力和基于旅程的角色传输实现语言和知识表示的分离,并支持多任务学习。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10471 2026-02-24 cs.SE cs.CL 81%

TestExplora: Benchmarking LLMs for Proactive Bug Discovery via Repository-Level Test Generation

TestExplora: 通过仓库级测试生成对LLMs进行主动bug发现的基准测试

Steven Liu, Jane Luo, Xin Zhang, Aofan Liu, Hao Liu, Jie Wu, Ziyang Huang, Yangyu Huang, Yu Kang, Scarlett Li

机构 * Microsoft(微软公司) School of ECE, Peking University(北京大学电子工程学院) Tsinghua University(清华大学) Chinese Academy of Sciences(中国科学院)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL

AI总结 TestExplora通过仓库级测试生成评估LLMs在主动bug发现中的能力,揭示了当前模型在复杂交互和代理探索方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10887 2026-02-11 cs.SE cs.PL 81%

The Stackage Repository: An Exploratory Study of its Evolution

Stackage仓库:对其演变的探索性研究

Paul Leger, Felipe Ruiz, Nicolás Sepúlveda, Ismael Figueroa, Nicolás Cardozo

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.PL

AI总结 本文通过分析Stackage仓库22次发布中的51,716个软件包,探讨其演变过程,重点研究monad软件包的使用和依赖关系。

Comments 22 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01003 2026-02-10 cs.SE cs.CL 81%

Improving Code Localization with Repository Memory

通过仓库记忆提升代码定位

Boshi Wang, Weijian Xu, Yunsheng Li, Mei Gao, Yujia Xie, Huan Sun, Dongdong Chen

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL

AI总结 通过利用仓库提交历史增强语言代理的记忆,提升代码定位性能,更接近人类开发者经验。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02084 2026-02-04 cs.CL cs.SE 81%

Closing the Loop: Universal Repository Representation with RPG-Encoder

闭环:通用仓库表示法与RPG-编码器

Jane Luo, Chengyu Yin, Xin Zhang, Qingtao Li, Steven Liu, Yiming Huang, Jie Wu, Hao Liu, Yangyu Huang, Yu Kang, Fangkai Yang, Ying Xin, Scarlett Li

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL

AI总结 RPG-Encoder通过统一表示和闭环推理,实现复杂代码库的高精度理解和生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19494 2026-02-02 cs.SE cs.AI 81%

AACR-Bench: Evaluating Automatic Code Review with Holistic Repository-Level Context

AACR-Bench: 评估自动代码审查的综合仓库级上下文

Lei Zhang, Yongda Yu, Minghui Yu, Xinxin Guo, Zhengqi Zhuang, Guoping Rong, Dong Shao, Haifeng Shen, Hongyu Kuang, Zhengfeng Li, Boge Wang, Guoan Zhang, Bangyu Xiang, Xiaobin Xu

机构 * Southern Cross University, Gold Coast, Australia(南方十字大学) TRE, Alibaba Inc., Hangzhou, China(阿里云)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 AACR-Bench通过综合仓库级上下文和专家验证流程,提升自动代码审查评估的准确性与全面性,揭示上下文粒度和检索方法对性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10773 2026-01-19 cs.SE cs.AI 81%

LogicLens: Leveraging Semantic Code Graph to explore Multi Repository large systems

LogicLens: 通过语义代码图探索多仓库大型系统

Niko Usai, Dario Montagnini, Kristian Ilianov Iliev, Raffaele Camanzo

机构 * Sourcesense

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 LogicLens通过构建语义多仓库图,帮助开发者探索复杂软件系统,支持自然语言交互和动态检索子图,实现领域逻辑和运行时行为的分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03731 2026-01-12 cs.SE cs.AI 81%

From Laboratory to Real-World Applications: Benchmarking Agentic Code Reasoning at the Repository Level

从实验室到现实应用:在仓库级别评估代理代码推理

Jia Li, Yuxin Su, Michael R. Lyu

机构 * The Chinese University of Hong Kong(香港中文大学) Sun Yat-sen University(中山大学)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

AI总结 RepoReason提出了一种白盒诊断基准测试,通过执行驱动的突变框架和动态程序切片,量化推理能力,揭示集成宽度是代理代码推理的主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05281 2026-01-08 cs.SE cs.CL 81%

CoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks

CoreCodeBench:通过细粒度仓库级任务解耦代码智能

Lingyue Fu, Hao Guan, Bolun Zhang, Haowei Yuan, Yaoming Zhu, Jun Xu, Zongyu Wang, Lin Qiu, Xunliang Cai, Xuezhi Cao, Weiwen Liu, Weinan Zhang, Yong Yu

机构 * Shanghai Jiao Tong University(上海交通大学) Meituan(美团)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL

AI总结 CoreCodeBench通过细粒度仓库级任务解耦编码能力,揭示LLM在编程任务中的非单一性,提供更精确的评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21878 2025-12-24 cs.SE cs.PL 81%

Advancing Automated In-Isolation Validation in Repository-Level Code Translation

在仓库级代码翻译中推进自动化独立验证

Kaiyao Ke, Ali Reza Ibrahimzada, Rangeet Pan, Saurabh Sinha, Reyhaneh Jabbarvand

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.PL

AI总结 TRAM通过结合上下文感知的类型解析与基于模拟的独立验证,实现了高质量的编程语言间翻译,尤其在Java到Python的翻译中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24749 2025-10-30 cs.SE cs.AI 81%

Beyond Function-Level Search: Repository-Aware Dual-Encoder Code Retrieval with Adversarial Verification

Aofan Liu, Shiyuan Song, Haoxuan Li, Cehao Yang, Yiyan Qi

机构 * International Digital Economy Academy (IDEA)(国际数字经济学院) School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08876 2025-10-13 cs.SE cs.AI 81%

Vector Graph-Based Repository Understanding for Issue-Driven File Retrieval

Kostiantyn Bevziuk, Andrii Fatula, Svetozar Lashin Yaroslav Opanasenko, Anna Tukhtarova, Ashok Jallepalli Pradeepkumar Sharma, Hritvik Shrivastava

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08850 2025-10-13 cs.SE cs.AI 81%

Repository-Aware File Path Retrieval via Fine-Tuned LLMs

Vasudha Yanuganti, Ishaan Puri, Swapnil Chhatre, Mantinder Singh, Ashok Jallepalli, Hritvik Shrivastava, Pradeep Kumar Sharma

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25257 2025-10-01 cs.SE cs.IR cs.LG 81%

RANGER -- Repository-Level Agent for Graph-Enhanced Retrieval

Pratik Shah, Rajat Ghosh, Aryan Singhal, Debojyoti Dutta

机构 * Georgia Institute of Technology(佐治亚理工学院) Nutanix(Nutanix公司)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.LG

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏