arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12133 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4096 篇

2602.10009 2026-05-22 cs.AI cs.HC 57%

Discovering High Level Patterns from Simulation Traces

从仿真轨迹中发现高层次模式

Sean Memery, Kartic Subr

机构 * University of Edinburgh(爱丁堡大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 本文提出了一种通过程序合成进行无监督学习的方法,将仿真轨迹转换为稀疏的高层次模式表示,以提升大语言模型对物理系统的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21770 2026-05-22 cs.LG 57%

Manifold-Guided Attention Steering

基于流形的注意力引导

Ian Li, Kapilesh Guruprasad, Raunak Sengupta, Ninad Satish, Loris D'Antoni, Rose Yu

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出了一种基于流形的注意力引导方法,通过在推理过程中监控注意力头与正确性流形的距离,动态纠正偏差,从而提高大语言模型在数学推理、代码生成和分子生成等任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20370 2026-05-21 cs.OS cs.PL 57%

Clove: Object-Level CXL Memory Management in Managed Runtimes

Clove: 有管理运行时中的对象级CXL内存管理

Sam Son, Zhihong Luo, Wen Zhang, Sylvia Ratnasamy, Scott Shenker

专题命中 代码生成 :code generation(abstract);分类 cs.PL

AI总结 本文针对CXL分层内存中对象级管理的研究问题,提出了一种基于有管理语言及其运行时的新设计点,通过结合性能指导的对象热点追踪和对象迁移技术,实现了高效的CXL内存管理,显著提升了内存利用率并降低了运行时开销。

Comments 12 pages (15 pages including references), 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19901 2026-05-20 cs.SE 57%

Can LLMs Produce Better Object-Oriented Designs than Human-Involved Development?

LLMs能否产生比人类参与开发更好的面向对象设计?

Zushuai Zhang, Elliott Wen, Ewan Tempero

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文研究了LLMs在生成面向对象设计(OOD)项目时的表现,通过比较预AI、后AI和纯AI三种作者条件下的项目质量,发现纯AI项目在代码异味密度和整体复杂度上较低,但存在过度简化的问题,结论指出在使用LLMs进行面向对象设计时,适当的人类指导仍很重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01411 2026-05-20 cs.SE 57%

CodePori: Large-Scale System for Autonomous Software Development Using Multi-Agent Technology

CodePori:利用多智能体技术实现大规模自主软件开发的系统

Zeeshan Rasheed, Muhammad Waseem, Kai-Kristian Kemell, Aakash Ahmad, Malik Abdul Sami, Mika Saari, Jussi Rasku, Pekka Abrahamsson

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文研究了基于大语言模型的多智能体系统在自主软件开发中的潜力与局限,通过开发CodePori系统和参与式评估,揭示了LLM多智能体系统的优势、挑战及改进方向。

Comments 18 pages, 8 figures, and 4 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19028 2026-05-20 cs.LG 57%

Learning When to Adapt

学习何时适应

Ali Zindari, Xiaowen Jiang, Rotem Mulayoff, Sebastian U. Stich

机构 * Universität des Saarlandes(萨尔布吕肯大学) CISPA Helmholtz Center for Information Security(信息安全研究中心)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出DISeL,一种动态输入敏感的低秩适应方法,通过引入轻量级输入依赖门控机制,减少遗忘并保持微调准确性,同时提供可解释的诊断视图。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15113 2026-05-20 cs.LG 57%

Learning from Language Feedback via Variational Policy Distillation

通过变分策略蒸馏学习语言反馈

Yang Li, Erik Nijkamp, Semih Yavuz, Shafiq Joty

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出变分策略蒸馏(VPD),通过将学习语言反馈形式化为变分期望最大化问题,解决传统自蒸馏方法中教师策略能力停滞的问题,从而在科学推理和代码生成任务中优于标准RLVR和现有自蒸馏基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18829 2026-05-20 cs.LG cs.CR 57%

Lossless Anti-Distillation Sampling

无损反蒸馏采样

Zibo Diao, Jingchu Gai, Xinyue Ai, Zhang Zhang, Zhenyu He, Di He

机构 * Peking University(北京大学) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出了一种无损反蒸馏采样方法,通过在保持良性用户体验的同时,有效对抗多账号蒸馏攻击,降低蒸馏模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18764 2026-05-20 cs.IR cs.AI 57%

From Intent to AI Pipelines: A Controlled Agentic Framework for Non-AI Expert Scientists

从意图到AI流水线:一种受领域驱动的可控代理框架,用于非AI专家科学家

Hyacinth Ali, Jessie Galasso-Carbonnel, Houari Sahraoui

机构 * University of Montreal(蒙特利尔大学) McGill University(麦吉尔大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出DDAP框架,通过分阶段交互帮助非AI专家科学家系统构建AI流水线及其实现代码,展示了可控代理框架在生成竞争性AI流水线方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17978 2026-05-19 cs.CL 57%

AutoVecCoder: Teaching LLMs to Generate Explicitly Vectorized Code

AutoVecCoder: 教授大语言模型生成显式向量化代码

Shangzhan Li, Xinyu Yin, Xuanyu Jin, Ye He, Yuxin Zhou, Yuxuan Li, Xu Han, Wanxiang Che, Qi Shi, Ting Liu, Maosong Sun

机构 * Harbin Institute of Technology(哈尔滨工业大学) Xiamen University(厦门大学) Tsinghua University(清华大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出AutoVecCoder框架,通过VecPrompt和VecRL组件,使大语言模型能够自动进行显式向量化,从而在SimdBench的SSE和AVX子集上达到最先进的性能,超越传统自动向量化的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17721 2026-05-19 cs.AI 57%

EXG: Self-Evolving Agents with Experience Graphs

EXG: 基于经验图的自演化代理

Yuxin Jin, Siyuan Zhang, Hanchen Wang, Lu Qin, Ying Zhang, Wenjie Zhang

机构 * University of Technology Sydney(悉尼科技大学) The University of New South Wales(新南威尔士大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出EXG,一种基于经验图的自演化代理框架,通过结构化组织积累的成功与失败经验,提升代理在复杂任务中的解决质量和资源效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17672 2026-05-19 cs.CL 57%

Stop When Reasoning Converges: Semantic-Preserving Early Exit for Reasoning Models

停止当推理收敛:用于推理模型的语义保留早退出

Dehai Min, Giovanni Vaccarino, Huiyi Chen, Yongliang Wu, Gal Yona, Lu Cheng

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Google Research(谷歌研究) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Politecnico di Milano(米兰理工学院)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出PUMA框架,通过识别推理层面的语义冗余信号,实现语义保留的早退出,从而在保持准确性和推理链完整性的同时减少token消耗。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17613 2026-05-19 cs.AR cs.LG 57%

VeriCache: Turning Lossy KV Cache into Lossless LLM Inference

VeriCache: 将损失性KV缓存转换为无损LLM推理

Jiayi Yao, Samuel Shen, Kuntai Du, Shaoting Feng, Dongjoo Seo, Rui Zhang, Yuyang Huang, Yuhan Liu, Shan Lu, Junchen Jiang

机构 * University of Chicago(芝加哥大学) Tensormesh Inc.(Tensormesh公司) Samsung Semiconductor(三星半导体) Microsoft Research(微软研究院)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出VeriCache框架,通过利用压缩的KV缓存生成token并验证其与完整KV缓存的一致性,实现了与完整KV缓存解码相同输出的同时保持高解码吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16893 2026-05-19 cs.AI 57%

NGM: A Plug-and-Play Training-Free Memory Module for LLMs

NGM: 一种无需训练的插拔式内存模块用于大语言模型

Yuwen Qu, Wenhui Dong, Chenyang Si, Caifeng Shan

机构 * Nanjing University(南京大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出NGM,一种无需训练的插拔式内存模块,通过因果n-gram编码器和余弦门控内存注入器,实现高效的知识检索,提升大语言模型在代码生成和知识密集型任务中的性能。

Comments Code is available at https://github.com/PioneerQyw/NGM

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15609 2026-05-18 cs.CL 57%

PSD: Pushing the Pareto Frontier of Diffusion LLMs via Parallel Speculative Decoding

PSD: 推动扩散大语言模型的帕累托前沿:通过并行推测解码

Shengyin Sun, Yiming Li, Renxi Liu, Xinqi Li, Hui-Ling Zhen, Weizhe Lin, Chen Chen, Xianzhi Yu, Mingxuan Yuan, Chen Ma

机构 * Huawei Technologies(华为技术)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出PSD框架,通过并行推测解码提升推理效率与生成质量,在推理效率和生成质量之间取得良好平衡,达到每前向传递5.5倍的token处理速度。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15585 2026-05-18 cs.AI cs.CV 57%

See Before You Code: Learning Visual Priors for Spatially Aware Educational Animation Generation

在编码前看到:学习视觉先验以生成空间感知的教育动画

Yuejia Li, Ke He, Junheng Li, Shutong Chen, Jingkang Xia, Zhiyue Su, Junchi Zhang, Mang Ye

机构 * Wuhan University(武汉大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出OmniManim框架,通过视觉规划和反馈机制提升教育动画生成质量,改进渲染效果和教学效果。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15301 2026-05-18 cs.AI 57%

Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution

Solvita:通过代理进化增强大型语言模型以应对编程竞赛

Han Li, Jinyu Tian, Rili Feng, Yuqiao Du, Chong Zheng, Chenyu Wang, Chenchen Liu, Shihao Li, Xinping Lei, Yifan Yao, Weihao Xie, Letian Zhu, Jiaheng Liu

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Independent Researcher(独立研究者)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 Solvita通过闭环系统和可训练知识网络,使代理动态学习,提升编程竞赛任务的准确性和经验积累。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15778 2026-05-18 cs.CL 57%

Stabilizing Knowledge, Promoting Reasoning: Dual-Token Constraints for RLVR

稳定知识,促进推理:双令牌约束用于RLVR

Jiakang Wang, Runze Liu, Fuzheng Zhang, Xiu Li, Guorui Zhou, Ling Pan

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Kuaishou Technology(快手科技) Tsinghua University(清华大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出Archer框架,通过双令牌约束在RLVR中平衡优化,提升LLM的推理和知识保持能力,实验显示在数学推理和代码生成任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14539 2026-05-15 cs.CL 57%

Learning from Failures: Correction-Oriented Policy Optimization with Verifiable Rewards

从失败中学习:具有可验证奖励的纠正导向策略优化

Mengjie Ren, Jie Lou, Boxi Cao, Xueru Wen, Hongyu Lin, Xianpei Han, Le Sun, Xing Yu, Yaojie Lu

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室) University of Chinese Academy of Sciences(中国科学院大学) Xiaohongshu Inc(小红书公司)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 本文提出CIPO方法,通过将失败轨迹转化为纠正监督,提升大语言模型的推理和纠错能力,在11个基准测试中优于基线方法。

Comments Work on progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14503 2026-05-15 cs.SE 57%

Not All RAGs Are Created Equal: A Component-Wise Empirical Study for Software Engineering Tasks

并非所有RAG都同等有效:面向软件工程任务的组件级实证研究

Qiang Ke, Yanjie Zhao, Hongjin Leng, Shengming Zhao, Haoyu Wang

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文通过实证研究分析RAG组件对软件工程任务的影响,发现检索端组件尤其是检索算法对系统性能影响更大,BM25在多种任务中表现稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08374 2026-05-15 cs.AI 57%

MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs

MemQ:将Q学习整合到基于溯源DAG的自进化记忆代理中

Junwei Liao, Haoting Shi, Ruiwen Zhou, Jiaqian Wang, Shengtao Zhang, Wei Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Bo Tang, Weinan Zhang, Muning Wen

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学) Xidian University(西安电子科技大学) University of Science and Technology of China(中国科学技术大学) MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 MemQ通过在溯源DAG中传播信用权重,改进记忆Q值的评估,提升多步任务的泛化能力,尤其在产生深层相关溯源链的任务中表现突出。

Comments 22 pages, 11 figures (containing 43 individual image panels total)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14089 2026-05-15 cs.AI 57%

SkillFlow: Flow-Driven Recursive Skill Evolution for Agentic Orchestration

SkillFlow: 以流程驱动的递归技能进化用于代理编排

Mingda Zhang, Tiesunlong Shen, Haoran Luo, Wenjin Liu, Zikai Xiao, Erik Cambria, Xiaoying Tang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 SkillFlow通过流程驱动的递归技能进化解决代理编排中的策略崩溃、梯度方差高和无指导技能进化问题,实现高效任务编排。

Comments 49 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13898 2026-05-15 cs.SE 57%

Bidirectional Empowerment of Metamorphic Testing and Large Language Models: A Systematic Survey

双向赋能:变形测试与大语言模型的相互促进:系统综述

Zheng Zheng, Zenghui Zhou, Yinwang Xu, Daixu Ren, Tsong Yueh Chen

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文系统综述了93项研究,探讨变形测试与大语言模型之间的双向赋能关系,提出分类框架,分析其在验证、评估和自动化测试中的应用。

Comments Daixu Ren is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13414 2026-05-14 cs.AI 57%

TRIAGE: Evaluating Prospective Metacognitive Control in LLMs under Resource Constraints

TRIAGE:在资源限制下评估大语言模型的前瞻性元认知控制

Zabir Al Nazi, Shubhashis Roy Dipta

机构 * University of California, Riverside, USA(加州大学河滨分校) University of Maryland, Baltimore County, USA(马里兰大学巴尔的摩县分校)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究评估了大语言模型在资源限制下的前瞻性元认知控制能力,通过Triage框架测试不同模型在多个领域的表现,揭示了现有模型在该能力上的显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12975 2026-05-14 cs.AI 57%

Retrieval is Cheap, Show Me the Code: Executable Multi-Hop Reasoning for Retrieval-Augmented Generation

检索成本低廉,展示代码:可执行多跳推理的检索增强生成

Jiashuo Sun, Jimeng Shi, Yixuan Xie, Saizhuo Wang, Jash Rajesh Parekh, Pengcheng Jiang, Zhiyi Shi, Jiajun Fan, Qinglong Zheng, Peiran Li, Shaowen Wang, Ge Liu, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Hong Kong University of Science and Technology(香港科学与技术大学) Texas A&M University(德克萨斯农工大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 本文提出PyRAG框架,将多跳检索增强生成转化为程序合成与执行,通过可执行Python代码实现可调试的推理过程,提升多跳问答性能。

Comments 32 pages, 20 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12746 2026-05-14 cs.CR cs.AI 57%

CoT-Guard: Small Models for Strong Monitoring

CoT-Guard:用于强监控的小型模型

Nirav Diwan, Han Wang, Berkcan Kapusuzoglu, Ramin Moradi, Supriyo Chakraborty, Giri Iyengar, Sambit Sahu, Huan Zhang, Gang Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Capital One

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出CoT-Guard,通过结合监督微调和强化学习,提升小型模型在代码生成任务中检测隐藏目标的能力,其在提示和代码攻击下的表现优于现有大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08992 2026-05-14 cs.LG 57%

Constraints-of-Thought: A Framework for Constrained Reasoning in Language-Model-Guided Search

思维约束:一种在语言模型引导搜索中进行约束推理的框架

Kamel Alrashedy, Vriksha Srihari, Zulfiqar Zaidi, Ridam Srivastava, Pradyumna Tambwekar, Matthew Gombolay

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 本文提出Const-o-T框架,通过约束推理提升语言模型在多步骤任务中的规划效率和决策可靠性,适用于风险游戏、CAD代码生成和算术推理等复杂领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12586 2026-05-14 cs.CV cs.AI cs.DB 57%

3D Primitives are a Spatial Language for VLMs

3D基元是一种视觉语言模型的空间语言

Junze Liu, Kun Qian, Florian Dubost, Kai Zhong, Arvind Srinivasan, Nan Chen, Anping Wang, Sam Zhang, Alejandro Mottini, Qingjun Cui, Tian Wang

机构 * Unity Technologies

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出通过3D基元作为中间表示来提升视觉语言模型的空间理解能力,通过SpatialBabel基准、Code-CoT推理策略和S³-FT自监督微调三种贡献,展示了基元在空间任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22168 2026-05-13 cs.DC cs.PL 57%

TileLoom: Automatic Dataflow Planning for Tile-Based Languages on Spatial Dataflow Accelerators

TileLoom:面向空间数据流加速器的tile基语言自动数据流规划

Wei Li, Zhenyu Bai, Heru Wang, Pranav Dangi, Zhiqiang Zhang, Cheng Tan, Huiying Lan, Weng-Fai Wong, Tulika Mitra

专题命中 代码生成 :code generation(abstract);分类 cs.PL

AI总结 TileLoom通过MLIR框架实现tile基程序到空间数据流架构的编译,通过分布式核心和芯片内网络提升数据复用与通信效率,实验显示其性能与厂商库相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10754 2026-05-12 cs.AI 57%

The Agent Use of Agent Beings: Agent Cybernetics Is the Missing Science of Foundation Agents

代理行为的代理使用:代理循证学是基础代理的缺失科学

Xinrun Wang, Chang Yang, He Zhao, Zhuoyi Lin, Shuyue Hu

机构 * Singapore Management University(新加坡管理大学) The Hong Kong Polytechnic University(香港理工大学) Nanyang Technological University(南洋理工大学) Institute for Infocomm Research, Agency for Science, Technology and Research (A*STAR)(信息通信研究院,科技研究局(A*STAR)) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出代理循证学作为基础代理的理论基础,通过将经典循证学定律映射到代理设计原则,提出可靠性、持续运行和自我改进三大工程需求,以指导复杂任务中的代理设计与部署。

Comments Preliminary Work

详情

展开后加载摘要…

URL PDF HTML 收藏