arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-03-19 至 2026-03-19 共收录 20 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 6 篇

2603.17613 2026-03-19 cs.CL cs.PL 81%

VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation

VeriAgent:一种集成工具的多智能体系统,具有进化记忆,用于PPA感知的RTL代码生成

Yaoxiang Wang, Qi Shi, ShangZhan Li, Qingguo Hu, Xinyu Yin, Bo Guo, Xu Han, Maosong Sun, Jinsong Su

机构 * Xiamen University(厦门大学) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.CL、cs.PL

AI总结 本文提出一种集成EDA工具的多智能体框架,用于高质量Verilog代码生成,通过进化记忆机制实现功能正确性和PPA指标的联合优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17174 2026-03-19 cs.CR cs.AI cs.SE 81%

Detecting Data Poisoning in Code Generation LLMs via Black-Box, Vulnerability-Oriented Scanning

通过黑盒、面向漏洞的扫描检测代码生成LLM中的数据中毒

Shenao Yan, Shimaa Ahmed, Shan Jin, Sunpreet S. Arora, Yiwei Cai, Yizhen Wang, Yuan Hong

机构 * University of Connecticut(康涅狄格大学) Visa Research(Visa研究)

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.AI

AI总结 本文提出CodeScan框架,通过分析多生成代码的结构相似性,结合抽象语法树规范化,检测代码生成模型中的安全漏洞,实现高准确率的数据中毒检测。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10204 2026-03-19 cs.SE cs.LG 81%

Code Roulette: How Prompt Variability Affects LLM Code Generation

代码掷骰子:提示变化如何影响LLM代码生成

Andrei Paleyes, Radzim Sendyka, Diana Robinson, Christian Cabrera, Neil D. Lawrence

机构 * University of Cambridge(剑桥大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.LG

AI总结 研究探讨提示变化对LLM代码生成质量的影响,提出评估流程以量化模型对输入变化的敏感性,通过实验验证方法有效性。

Comments Extended version of the paper accepted to LLM4Code @ ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17800 2026-03-19 cs.AR 78%

Enabling RISC-V Vector Code Generation in MLIR through Custom xDSL Lowerings

通过自定义xDSL降低实现RISC-V向量代码生成

Jie Lei, Héctor Martínez, Adrián Castelló

专题命中 代码生成 :code generation(title,abstract)

AI总结 本文通过结合MLIR与xDSL,解决RISC-V向量扩展代码生成中缺乏的降低阶段,展示如何通过定制中间表示和转换传递,将高级操作转换为硬件感知的C代码,生成高性能RISC-V内核。

Comments 12 pages, 11 Figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00230 2026-03-19 quant-ph cs.AI cs.LG 62%

Reinforcement learning with learned gadgets to tackle hard quantum problems on real hardware

利用学习的工具处理现实硬件上的难题量子问题的强化学习

Akash Kundu, Leopoldo Sarra

机构 * Department of Physics, University of Helsinki(赫尔辛基大学物理系) Axiomatic AI

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI、cs.LG

AI总结 本文提出gadget reinforcement learning方法,通过学习合成程序自动构建复合门,提升量子电路设计的准确性、兼容性和可扩展性,应用于Ising模型和量子化学问题。

Comments 28 page: Gadget reinforcement learning

Journal ref Communications Physics 9, 44 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10063 2026-03-19 cs.AI 57%

Chain of Mindset: Reasoning with Adaptive Cognitive Modes

思维链:具有适应性认知模式的推理

Tianyi Jiang, Arctanx An, Hengyi Feng, Naixin Zhai, Haodong Li, Xiaomin Yu, Jiahui Liu, Hanwen Du, Shuo Zhang, Zhi Yang, Jie Huang, Youhua Li, Yongxin Ni, Huacan Wang, Ronghao Chen

机构 * PKU(北京大学) BJTU(北京理工大学) StepFun SUFE(上海财经大学) NUS(新加坡国立大学) CityUHK(香港城市大学) QuantaAlpha(量子阿尔法)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出Chain of Mindset框架,通过动态选择不同认知模式提升推理效率,实验显示在多个基准测试中表现优异,准确率超越基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 5 篇

2603.17104 2026-03-19 cs.SE cs.AI 81%

When the Specification Emerges: Benchmarking Faithfulness Loss in Long-Horizon Coding Agents

当规范出现时:长期远 horizon 编码代理中忠实度损失的基准测试

Lu Yan, Xuan Chen, Xiangyu Zhang

机构 * Purdue University(普渡大学)

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE、cs.AI

AI总结 本文提出一个基准测试,研究在逐步披露目标设计时,编码代理中忠实度损失(SLUMP)的变化,通过20篇最新ML论文和371个可验证组件评估不同平台的实现忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17829 2026-03-19 cs.SE cs.AI cs.CL 75%

CodeScout: An Effective Recipe for Reinforcement Learning of Code Search Agents

CodeScout: 一种有效的强化学习代码搜索代理训练方法

Lintang Sutawika, Aditya Bharat Soni, Bharath Sriraam R R, Apurva Gandhi, Taha Yassine, Sanidhya Vijayvargiya, Yuchen Li, Xuhui Zhou, Yilin Zhang, Leander Melroy Maben, Graham Neubig

专题命中 软件智能体 :repository(abstract);coding agent(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出CodeScout,通过强化学习方法训练仅使用标准Unix终端的代码搜索代理,实验证明其在多个基准测试中优于大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17833 2026-03-19 cs.SE 70%

ArchBench: Benchmarking Generative-AI for Software Architecture Tasks

Bassam Adnan, Aviral Gupta, Sreemaee Akshathala, Karthik Vaidhyanathan

专题命中 软件智能体 :repository(abstract);coding agent(abstract);分类 cs.SE

Comments 5 pages, 3 figures, Software Architecture Showcase Track, ICSA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17826 2026-03-19 cs.SE cs.AI 62%

FailureMem: A Failure-Aware Multimodal Framework for Autonomous Software Repair

FailureMem: 一种面向故障的多模态框架用于自主软件修复

Ruize Ma, Yilei Jiang, Shilin Zhang, Zheng Ma, Yi Feng, Vincent Ng, Zhi Wang, Xiangyu Yue, Chuanyi Li, Lewei Lu

机构 * Nanjing University(南京大学) SenseTime(秒速) The Chinese University of Hong Kong(香港中文大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 软件智能体 :program repair(abstract);分类 cs.SE、cs.AI

AI总结 本文提出FailureMem框架,通过融合工作流代理、主动感知工具和故障记忆库,提升多模态自动程序修复的效率与准确性,实验表明其在GUI修复任务中解决率提升3.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17639 2026-03-19 cs.AI 57%

VeriGrey: Greybox Agent Validation

VeriGrey:灰盒代理验证

Yuntong Zhang, Sungmin Kang, Ruijie Meng, Marcel Böhme, Abhik Roychoudhury

机构 * National University of Singapore(新加坡国立大学)

专题命中 软件智能体 :coding agent(abstract);分类 cs.AI

AI总结 本文提出VeriGrey方法,通过工具调用序列反馈函数驱动测试过程,发现LLM代理中隐含的提示注入漏洞,并在实际案例中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 程序修复 1 篇

2510.01002 2026-03-19 cs.SE cs.CR 57%

Semantics-Aligned, Curriculum-Driven, and Reasoning-Enhanced Vulnerability Repair Framework

语义对齐、课程驱动和推理增强的漏洞修复框架

Chengran Yang, Ting Zhang, Jinfeng Jiang, Xin Zhou, Haoye Tian, Mingzhe Du, Jieke Shi, Junkai Chen, Yikun Li, Eng Lieh Ouh, Lwin Khin Shar, David Lo

专题命中 程序修复 :repository(abstract);分类 cs.SE

AI总结 本文提出SeCuRepair框架,通过语义对齐、课程驱动和推理增强解决现有漏洞修复方法的局限性,提升代码修复的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 代码评测 1 篇

2603.17204 2026-03-19 cs.CL cs.AR cs.PL 73%

CODMAS: A Dialectic Multi-Agent Collaborative Framework for Structured RTL Optimization

CODMAS:一种基于辩证多智能体协作的结构化RTL优化框架

Che-Ming Chang, Prashanth Vijayaraghavan, Ashutosh Jadhav, Charles Mackin, Vandana Mukherjee, Hsinyu Tsai, Ehsan Degan

机构 * National Taiwan University(国立台湾大学) IBM Research(IBM研究院)

专题命中 代码评测 :code generation(abstract);coding agent(abstract);分类 cs.CL、cs.PL

AI总结 CODMAS通过结合结构化辩证推理与领域感知代码生成和确定性评估,实现RTL优化自动化,显著提升了时钟门控的功耗降低和流水线的延迟减少效果。

Journal ref EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仓库级理解 6 篇

2603.17974 2026-03-19 cs.SE cs.AI 76%

Toward Scalable Automated Repository-Level Datasets for Software Vulnerability Detection

迈向可扩展的自动化仓库级数据集用于软件漏洞检测

Amine Lbath

专题命中 仓库级理解 :repository(title);分类 cs.SE、cs.AI

AI总结 本文提出自动化生成仓库级数据集的方法,通过注入真实漏洞并合成可复现的漏洞证明,提升漏洞检测模型的训练与评估效果,同时研究注入与检测代理的对抗共进化循环以增强鲁棒性。

Comments Supervisor: Prof. Massih-Reza Amini

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17296 2026-03-19 cs.CY cs.AI 57%

GUIDE: GenAI Units In Digital Design Education

GUIDE:数字设计教育中的生成式人工智能单元

Weihua Xiao, Jason Blocklove, Matthew DeLorenzo, Johann Knechtel, Ozgur Sinanoglu, Kanad Basu, Jeyavijayan Rajendran, Siddharth Garg, Ramesh Karri

机构 * NYU Tandon(纽约大学Tandon学院) NYU Abu Dhabi(纽约大学阿布扎比分校) RPI(罗切斯特理工学院) Texas A&M(德克萨斯大学阿姆斯特朗分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 GUIDE为数字设计教育提供可运行的Google Colab实验室和课程资料,通过标准化教学单元提升学习一致性与教学效率,包含三个代表单元和四门课程实例,涵盖RTL生成、测试bench生成及IP盗版检测等核心内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17339 2026-03-19 cs.DL 56%

citecheck: An MCP Server for Automated Bibliographic Verification and Repair in Scholarly Manuscripts

citecheck: 一种MCP服务器,用于学术手稿中的自动文献验证与修复

Junhyeok Lee

专题命中 仓库级理解 :repository(abstract,comments)

AI总结 citecheck通过自动化验证和修复学术手稿中的文献错误,包括识别错误、元数据不完整、作者归属错误及预印本与发表版本不一致等问题,提供结构化修复建议和安全诊断。

Comments 6 pages, 1 figure. Software paper on bibliography verification and repair for scholarly manuscripts; includes MCP server implementation and evaluation on repository-backed tests

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17679 2026-03-19 cs.CV 50%

Illumination-Aware Contactless Fingerprint Spoof Detection via Paired Flash-Non-Flash Imaging

具备照明意识的无接触指纹伪装检测:通过配对闪光-非闪光成像

Roja Sahoo, Anoop Namboodiri

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出通过配对闪光-非闪光成像机制提升无接触指纹识别的伪装检测鲁棒性,利用照明诱导差异特征区分真实指纹与打印、数字和塑形攻击。

Comments Accepted at IWBF 2026 (14th International Workshop on Biometrics and Forensics)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17455 2026-03-19 cs.CV 50%

FACE-net: Factual Calibration and Emotion Augmentation for Retrieval-enhanced Emotional Video Captioning

FACE-net:事实校准与情感增强用于检索增强的情感视频描述

Weidong Chen, Cheng Ye, Zhendong Mao, Peipei Song, Xinyan Liu, Lei Zhang, Xiaojun Chang, Yongdong Zhang

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出FACE-net框架,通过统一架构协同挖掘事实与情感语义,提供适应性指导以生成准确描述,解决事实-情感偏置问题。

Comments Submitted to TPAMI. 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13728 2026-03-19 cs.CV cs.CR 50%

Bodhi VLM: Privacy-Alignment Modeling for Hierarchical Visual Representations in Vision Backbones and VLM Encoders via Bottom-Up and Top-Down Feature Search

Bodhi VLM:通过自上而下和自下而上的特征搜索实现视觉主干和VLM编码器中层次视觉表示的隐私对齐建模

Bo Ma, Wei Qi Yan, Jinsong Wu

机构 * Auckland University of Technology(奥克兰技术大学) Resideo Technologies, Inc.(Resideo技术公司) Guilin University of Electronic Technology(桂林电子科技大学) Universidad de Chile(智利大学)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出Bodhi VLM框架,通过NCP和MDAV聚类将敏感概念与分层神经表示的层间分组关联,并利用自上而下和自下而上的策略定位敏感特征区域,结合EMPA模块生成可解释的隐私预算对齐信号,验证了在目标检测和VLM视觉编码器中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 程序分析与验证 1 篇

2511.12294 2026-03-19 cs.SE 57%

ProofWright: Towards Agentic Formal Verification of CUDA

ProofWright: 向 CUDA 的代理形式验证迈进

Bodhisatwa Chatterjee, Drew Zagieboylo, Sana Damani, Siva Hari, Christos Kozyrakis

专题命中 程序分析与验证 :code generation(abstract);分类 cs.SE

AI总结 ProofWright 通过整合自动形式验证与 LLM 代码生成,为 CUDA 核心提供内存安全、线程安全和语义正确性保证,验证了 74% 的生成内核,发现传统测试遗漏的细微错误。

详情

展开后加载摘要…

URL PDF HTML 收藏