arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12133 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4096 篇

2510.26585 2026-03-03 cs.MA cs.AI 57%

Stop Wasting Your Tokens: Towards Efficient Runtime Multi-Agent Systems

停止浪费你的令牌:迈向高效的运行时多智能体系统

Fulin Lin, Shaowen Chen, Ruishan Fang, Hongwei Wang, Tao Lin

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) State Key Laboratory of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 SupervisorAgent通过运行时自适应监督框架减少多智能体系统中的令牌消耗,提升效率与鲁棒性。

Comments Accepted to ICLR 2026. The code is available at https://github.com/LINs-lab/SupervisorAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20187 2026-03-03 cs.CL 57%

Diversity-Enhanced Reasoning for Subjective Questions

增强多样性推理以应对主观问题

Yumeng Wang, Zhiyuan Fan, Jiayu Liu, Jen-tse Huang, Yi R. Fung

机构 * Hong Kong University of Science and Technology(香港科技大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出MultiRole-R1框架,通过引入视角多样性和token级多样性提升主观推理性能,实验显示其在主观任务和高级数学推理中均取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00724 2026-03-03 cs.CL 57%

RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models

RLAR:一种用于大型语言模型多任务强化学习的代理奖励系统

Andrew Zhuoer Feng, Cunxiang Wang, Bosi Wen, Yidong Wang, Yu Luo, Hongning Wang, Minlie Huang

机构 * Tsinghua Univeristy(清华大学) Peking University(北京大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 RLAR通过动态生成奖励函数提升大型语言模型在多任务强化学习中的性能和泛化能力。

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00532 2026-03-03 cs.AI 57%

DenoiseFlow: Uncertainty-Aware Denoising for Reliable LLM Agentic Workflows

DenoiseFlow:面向可靠LLM代理工作流的不确定性感知去噪

Yandong Yan, Junwei Peng, Shijie Li, Chenxi Li, Yifei Shang, Can Deng, Ruiting Dai, Yongqiang Zhao, Jiaqi Zhu, Yu Huang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院) SKLCCSE, School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) Tsinghua University(清华大学) University of Electronic Science and Technology of China(电子科技大学) Key Laboratory of High Confidence Software Technologies(PKU), MOE(北京大学高可信软件技术重点实验室) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 DenoiseFlow通过闭环框架实现多步推理的不确定性感知去噪,提升LLM代理工作流的可靠性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17371 2026-03-03 cs.SE 57%

GraphCue for SDN Configuration Code Synthesis

基于图的SDN配置代码合成

Haomin Qi, Fengfei Yu, Chengbo Huang

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 GraphCue通过拓扑感知检索和约束条件生成,实现了SDN配置代码合成的高通过率和高效验证。

Comments 2 pages, 2 figures

Journal ref IEEE Consumer Communications & Networking Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18487 2026-03-03 cs.CL 57%

Actions Speak Louder than Prompts: A Large-Scale Study of LLMs for Graph Inference

行动胜于提示:大型语言模型在图推断中的大规模研究

Ben Finkelshtein, Silviu Cucerzan, Sujay Kumar Jauhar, Ryen White

机构 * University of Oxford(牛津大学) Microsoft Research(微软研究院)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 研究通过大规模评估揭示LLM在图推断中的表现,发现代码生成在长文本图中表现最佳,异质图上交互策略仍有效,且方法能灵活适应不同输入类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23320 2026-03-02 cs.LG cs.MA 57%

ParamMem: Augmenting Language Agents with Parametric Reflective Memory

ParamMem: 通过参数化反思记忆增强语言代理

Tianjun Yao, Yongqiang Chen, Yujia Zheng, Pan Li, Zhiqiang Shen, Kun Zhang

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 ParamMem通过参数化记忆模块提升语言代理的反思多样性,实现更高效的推理和跨任务迁移能力。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05629 2026-03-02 cs.LG 57%

On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification

在SFT的泛化上:从强化学习视角的奖励校正

Yongliang Wu, Yizhou Zhou, Zhou Ziheng, Yingzhe Peng, Xinyu Ye, Xinting Hu, Wenbo Zhu, Lu Qi, Ming-Hsuan Yang, Xu Yang

机构 * Southeast University(东南大学) University of California, Los Angeles(加州大学洛杉矶分校) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) University of California, Berkeley(加州大学伯克利分校) Wuhan University(武汉大学) University of California, Merced(加州大学默塞德分校)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出动态微调方法,通过奖励校正提升SFT的泛化能力,在多个任务中表现优于传统SFT。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00299 2026-02-27 cs.LG 57%

Agentic Framework for Epidemiological Modeling

流行病建模的代理框架

Rituparna Datta, Zihan Guan, Baltazar Espinoza, Yiqi Su, Priya Pitre, Srini Venkatramanan, Naren Ramakrishnan, Anil Vullikanti

机构 * University of Virginia(弗吉尼亚大学) Virginia Tech(弗吉尼亚理工学院) Biocomplexity Institute(生物复杂性研究所)

专题命中 代码生成 :program synthesis(abstract);分类 cs.LG

AI总结 EPIAGENT通过代理框架自动合成和优化流行病模拟器,提升模型的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20727 2026-02-25 cs.CL 57%

ID-LoRA: Efficient Low-Rank Adaptation Inspired by Matrix Interpolative Decomposition

ID-LoRA: 基于矩阵插值分解的高效低秩适应

Xindian Ma, Rundong Kong, Peng Zhang, Ruoxiang Huang, Yongyu Jiang

机构 * Tianjin University(天津大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 ID-LoRA通过基于矩阵插值分解的低秩适应方法,在减少可训练参数的同时保持模型容量,优于现有PEFT技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20296 2026-02-25 cs.LG 57%

Learning to Solve Complex Problems via Dataset Decomposition

通过数据集分解学习解决复杂问题

Wanru Zhao, Lucas Caccia, Zhengyan Shi, Minseon Kim, Weijia Xu, Alessandro Sordoni

机构 * University of Cambridge(剑桥大学) Microsoft Research(微软研究院) Mila - Quebec AI Institute(魁北克人工智能研究所)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 通过数据集分解和课程生成方法,提升模型解决复杂问题的能力

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19297 2026-02-25 cs.AI 57%

Automated Generation of Microfluidic Netlists using Large Language Models

利用大语言模型自动化生成微流体网表

Jasper Davidson, Skylar Stockham, Allen Boston, Ashton Snelgrove, Valerio Tenace, Pierre-Emmanuel Gaillardon

机构 * Department of Electrical and Computer Engineering, University of Utah(电气与计算机工程系,犹他大学) Primis AI, Inc.(Primis AI 公司)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文利用大语言模型自动化生成微流体器件的结构网表,实现了从自然语言描述到Verilog代码的转换,并在典型微流体设计中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08810 2026-02-25 cs.SE 57%

MigrateLib: a tool for end-to-end Python library migration

MigrateLib: 一种用于端到端Python库迁移的工具

Mohayeminul Islam, Ajay Kumar Jha, May Mahmoud, Sarah Nadi

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 MigrateLib利用大型语言模型、静态分析和动态分析,实现端到端的Python库迁移,能准确迁移32%的迁移任务。

Comments arXiv admin note: text overlap with arXiv:2504.13272

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20144 2026-02-24 eess.SY cs.AI cs.NI cs.SY 57%

Agentic AI for Scalable and Robust Optical Systems Control

面向可扩展和鲁棒光学系统控制的代理AI

Zehao Wang, Mingzhe Han, Wei Cheng, Yue-Kai Huang, Philip Ji, Denton Wu, Mahdi Safari, Flemming Holtorf, Kenaish AlQubaisi, Norbert M. Linke, Danyang Zhuo, Yiran Chen, Ting Wang, Dirk Englund, Tingjun Chen

机构 * Department of Electrical and Computer Engineering, Duke University(电气与计算机工程系,杜克大学) Duke Quantum Center and Department of Physics, Duke University(杜克量子中心和物理系,杜克大学) Department of Computer Science, Duke University(计算机科学系,杜克大学) NEC Laboratories America(NEC美国实验室) Axiomatic AI(公理AI) Joint Quantum Institute, Department of Physics, and the National Quantum Laboratory (QLab), University of Maryland(联合量子研究所、物理系以及国家量子实验室(QLab),马里兰大学) Research Laboratory of Electronics, Massachusetts Institute of Technology(电子研究实验室,麻省理工学院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 AgentOptics通过代理AI框架实现异构光学系统的可扩展和鲁棒自主控制,展示了高保真任务成功率和多任务协调能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03817 2026-02-24 cs.LG stat.ML 57%

TROLL: Trust Regions improve Reinforcement Learning for Large Language Models

TROLL:通过信任区域改进大型语言模型的强化学习

Philipp Becker, Niklas Freymuth, Serge Thilges, Fabian Otto, Gerhard Neumann

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 TROLL通过引入基于信任区域的离散可微投影,改进了大型语言模型的强化学习训练,提升了训练速度、稳定性和最终成功率。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19407 2026-02-24 cs.SE 57%

Multi-CoLoR: Context-Aware Localization and Reasoning across Multi-Language Codebases

多语言代码库中的上下文感知定位与推理:Multi-CoLoR

Indira Vats, Sanjukta De, Subhayan Roy, Saurabh Bodhe, Lejin Varghese, Max Kiehn, Yonas Bedasso, Marsha Chechik

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 Multi-CoLoR通过结合组织知识检索与图推理,提升多语言代码库中的定位准确性与效率。

Comments This paper has been accepted for publication at the 33rd IEEE International Conference on Software Analysis, Evolution and Reengineering (SANER 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18541 2026-02-24 cs.SE 57%

LAPIS: Lightweight API Specification for Intelligent Systems

LAPIS:轻量级智能系统API规范

Daniel Garcia

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 LAPIS是一种为LLM优化的轻量级API规范格式,通过减少token使用并保留语义信息,提升智能系统对API的处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18453 2026-02-24 cs.CY cs.AI 57%

LLM-Assisted Replication for Quantitative Social Science

大语言模型辅助的定量社会科学复制

So Kubota, Hiromu Yakura, Samuel Coavoux, Sho Yamada, Yuki Nakamura

机构 * Graduate School of Economics, Tohoku University(东北大学经济学研究生院) Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所) CREST, ENSAE, Institut Polytechnique de Paris(巴黎高等理工学院CREST与ENSAE) Graduate School of Public Policy, The University of Tokyo(东京大学公共政策研究生院) Faculty of Engineering, The University of Tokyo(东京大学工学部)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本研究提出基于大语言模型的自动化系统,用于复制社会科学论文的统计分析并检测潜在问题,旨在提升研究的可验证性和完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10855 2026-02-23 cs.LG 57%

ExPairT-LLM: Exact Learning for LLM Code Selection by Pairwise Queries

ExPairT-LLM:通过成对查询实现LLM代码选择的精确学习

Tom Yuviler, Dana Drachsler-Cohen

机构 * Tom Yuviler(独立研究者) Dana Drachsler-Cohen(独立研究者)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 ExPairT-LLM通过成对查询提升LLM代码选择的精确性,实现更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18166 2026-02-23 cs.PL 57%

Grammar Repair with Examples and Tree Automata: Extended Version

基于示例和树自动机的语法修复:扩展版

Yunjeong Lee, Gokul Rajiv, Ilya Sergey

专题命中 代码生成 :program synthesis(abstract);分类 cs.PL

AI总结 本研究提出基于示例和树自动机的语法修复方法,通过构建自动机解决语法歧义,提升解析器生成的准确性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17386 2026-02-20 cs.AI cs.IR 57%

Visual Model Checking: Graph-Based Inference of Visual Routines for Image Retrieval

视觉模型检查:基于图的图像检索中的视觉例行程序推断

Adrià Molina, Oriol Ramos Terrades, Josep Lladós

机构 * Centre de Visió per Computador(视觉计算中心) Universitat Autònoma de Barcelona(巴塞罗那自治大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出一种结合图基验证与神经代码生成的框架,用于提升图像检索中复杂查询的可信度和可验证性。

Comments Submitted for ICPR Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16106 2026-02-19 cs.SE 57%

Algorithm-Based Pipeline for Reliable and Intent-Preserving Code Translation with LLMs

基于算法的可靠且意图保留的代码翻译管道

Shahriar Rumi Dipto, Saikat Mondal, Chanchal K. Roy

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文提出一种基于算法的代码翻译管道,通过引入语言中立的中间规范提升翻译准确性和可靠性,实验结果显示其在多个指标上均优于直接翻译方法。

Comments Accepted at 34th IEEE/ACM International Conference on Program Comprehension (ICPC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16047 2026-02-19 cs.HC cs.SE 57%

A Unified, Cross-Platform Framework for Automatic GUI and Plugin Generation in Structural Bioinformatics and Beyond

一种统一的跨平台框架,用于结构生物信息学及其他领域的自动GUI和插件生成

Sikao Guo, Edoardo Sarti, Frédéric Cazals

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文提出了一种统一的跨平台框架,用于自动化生成结构生物信息学及其他领域的GUI和插件,通过MVP模式实现可重用性和跨平台兼容性。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03901 2026-02-19 cs.SE 57%

Unveiling the Role of ChatGPT in Software Development: Insights from Developer-ChatGPT Interactions on GitHub

揭示ChatGPT在软件开发中的作用:来自GitHub上开发者与ChatGPT交互的洞察

Ruiyin Li, Peng Liang, Yifei Wang, Yangxiao Cai, Weisong Sun, Zengyang Li

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本研究通过分析GitHub上的开发者与ChatGPT交互数据,揭示了ChatGPT在软件开发中的应用特点及实际作用。

Comments Preprint accepted for publication in ACM Transactions on Software Engineering and Methodology (TOSEM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13280 2026-02-17 cs.AI 57%

BEAGLE: Behavior-Enforced Agent for Grounded Learner Emulation

BEAGLE:行为约束的地面学习者模拟代理

Hanchen David Wang, Clayton Cohn, Zifan Xu, Siyuan Guo, Gautam Biswas, Meiyi Ma

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 BEAGLE 通过整合自我调节学习理论和三种技术创新,有效模拟学生学习行为,实现对真实学习轨迹的高还原度复现。

Comments paper under submission at IJCAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16701 2026-02-17 cs.AI 57%

An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems

基于大语言模型的代理框架用于解决复杂车辆路径问题

Ni Zhang, Zhiguang Cao, Jianan Zhou, Cong Zhang, Yew-Soon Ong

机构 * School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡管理大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的代理框架AFL,实现复杂车辆路径问题的完全自动化,通过分解任务和协调代理提升解决方案的可靠性和可行性。

Comments Accepted by iclr2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11706 2026-02-13 cs.CV cs.AI cs.RO 57%

LLM-Driven 3D Scene Generation of Agricultural Simulation Environments

基于大语言模型的农业模拟环境3D场景生成

Arafa Yoncalik, Wouter Jansen, Nico Huebel, Mohammad Hasan Rahmani, Jan Steckel

机构 * Faculty of Applied Engineering – Dept. of Electronics and ICT, University of Antwerp(应用工程学院——电子与信息通信技术系,安特卫普大学) Flanders Make Strategic Research Centre(弗拉芒制造战略研究中心)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出基于多LLM流水线的农业模拟环境3D场景生成方法,通过模块化设计提升领域特定场景生成的可靠性与精度。

Comments Accepted at IEEE Conference on Artificial Intelligence 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11411 2026-02-13 cs.SE 57%

Improving the Robustness of Large Language Models for Code Tasks via Fine-tuning with Perturbed Data

通过扰动数据微调提升大语言模型在代码任务中的鲁棒性

Yang Liu, Armstrong Foundjem, Xingfang Wu, Heng Li, Foutse Khomh

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 通过扰动数据微调提升大语言模型在代码任务中的鲁棒性,以增强其对对抗性输入的防御能力,同时注意性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10418 2026-02-12 cs.CR cs.SE 57%

SecCodePRM: A Process Reward Model for Code Security

SecCodePRM: 一种用于代码安全的过程奖励模型

Weichen Yu, Ravi Mangal, Yinyi Luo, Kai Hu, Jingxuan He, Corina S. Pasareanu, Matt Fredrikson

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 SecCodePRM通过一种面向安全的过程奖励模型,提升代码安全性和检测效率,适用于完整代码漏洞检测、部分代码漏洞检测和安全代码生成。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10092 2026-02-11 cs.CL 57%

Quantum-Audit: Evaluating the Reasoning Limits of LLMs on Quantum Computing

量子审计:评估大语言模型在量子计算上的推理极限

Mohamed Afane, Kayla Laufer, Wenqi Wei, Ying Mao, Junaid Farooq, Ying Wang, Juntao Chen

机构 * Fordham University(福特汉姆大学) University of Michigan-Dearborn(密歇根大学-迪尔本分校) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 Quantum-Audit通过2700个问题评估大语言模型在量子计算概念理解上的推理能力,发现顶级模型在专家问题上表现不如LLM生成问题,且在高级主题上准确率显著下降。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏