arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-03-26 至 2026-03-26 共收录 18 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 7 篇

2603.21430 2026-03-26 cs.AI cs.SE 84%

DomAgent: Leveraging Knowledge Graphs and Case-Based Reasoning for Domain-Specific Code Generation

DomAgent:利用知识图谱和基于案例的推理进行领域特定代码生成

Shuai Wang, Dhasarathy Parthasarathy, Robert Feldt, Yinan Yu

机构 * Chalmers University of Technology(楚德斯大学)

专题命中 代码生成 :code generation(title,abstract);coding agent(abstract);分类 cs.SE、cs.AI

AI总结 DomAgent通过结合知识图谱和基于案例的推理,提升领域特定代码生成能力,通过结构化推理和定向检索实现领域适应,实验表明其能显著提升复杂真实应用场景的代码生成性能。

Comments Accepted to AAMAS 2026 EA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24202 2026-03-26 cs.LG cs.AI 76%

A Deep Dive into Scaling RL for Code Generation with Synthetic Data and Curricula

深入探讨通过合成数据和课程学习扩展强化学习用于代码生成

Cansu Sancaktar, David Zhang, Gabriel Synnaeve, Taco Cohen

机构 * University of Tübingen(图宾根大学) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)

专题命中 代码生成 :code generation(title);分类 cs.AI、cs.LG

AI总结 本文提出多轮合成数据生成流程,通过教师模型迭代优化问题难度,提升代码生成性能,并系统研究任务难度、课程调度和环境多样性对强化学习训练的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24284 2026-03-26 cs.SE cs.AI cs.MA 62%

The Specification Gap: Coordination Failure Under Partial Knowledge in Code Agents

规范鸿沟:在代码代理中部分知识下的协调失败

Camilo Chacón Sartori

机构 * Catalan Institute of Nanoscience and Nanotechnology (ICN2), CSIC and BIST(加泰罗尼亚纳米科学与纳米技术研究所(ICN2),西班牙国家科研 council(CSIC)和巴塞罗那技术研究所(BIST))

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI

AI总结 研究代码代理在部分知识下的协调失败问题,发现规范鸿沟导致两代理整合准确率下降,信息不对称和协调成本是主要因素,支持以规范为导向的多代理代码生成观点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16485 2026-03-26 cs.CL cs.AI cs.MA 62%

Team of Thoughts: Efficient Test-time Scaling of Agentic Systems through Orchestrated Tool Calling

思想团队:通过协调工具调用实现代理系统高效测试时扩展

Jeffrey T. H. Wong, Zixi Zhang, Junyi Liu, Yiren Zhao

机构 * Imperial College London(帝国学院伦敦) Microsoft Research(微软研究院)

专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Team-of-Thoughts框架,通过协调工具调用实现异构代理系统在测试时的高效扩展,通过动态激活最兼容的代理提升数学推理和代码生成任务的性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23575 2026-03-26 cs.LG cs.AI 62%

APreQEL: Adaptive Mixed Precision Quantization For Edge LLMs

APreQEL: 适应性混合精度量化用于边缘大语言模型

Meriem Bouzouad, Yuan-Hao Chang, Jalil Boukhobza

机构 * Lab-STICC, CNRS UMR 6285 , ENSTA, Institut Polytechnique de Paris(法国巴黎理工学院STICC实验室、CNRS UMR 6285、ENSTA) National Taiwan University(台湾国立台湾大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种适应性混合精度量化方法,通过分析层间贡献和硬件平台行为,优化边缘部署中的内存、延迟和精度平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23909 2026-03-26 cs.AI 57%

DUPLEX: Agentic Dual-System Planning via LLM-Driven Information Extraction

DUPLEX:基于LLM驱动信息提取的代理双系统规划

Keru Hua, Ding Wang, Yaoying Gu, Xiaoguang Ma

机构 * Midea Corporate Research Center(美的集团研发中心) Midea Group(美的集团) Northeastern University(东北大学) Engineering Department(工程部)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 DUPLEX通过限制LLM进行结构化语义 grounding,结合符号规划器实现可靠规划,优于现有端到端和混合LLM基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18145 2026-03-26 astro-ph.IM astro-ph.CO cs.HC 50%

Setting SAIL: Leveraging Scientist-AI-Loops for Rigorous Visualization Tools

构建SAIL:利用科学家-人工智能循环以实现严谨的可视化工具

Nico Schuster, Andrés N. Salcedo, Simon Bouchard, Dennis Frei, Alice Pisani, Julian E. Bautista, Julien Zoubian, Stephanie Escoffier, Wei Liu, Georgios Valogiannis, Pauline Zarrouk

专题命中 代码生成 :code generation(abstract)

AI总结 本文提出SAIL框架,通过分离领域逻辑与代码语法,帮助科学家在保持科学严谨性的同时利用AI快速生成代码,展示两个开源天文工具,证明其在科普、教学和早期研究中的有效性。

Comments 10 pages (+ references), 4 figures. Interactive visualizations available at: https://nicosmo.github.io/lensing_visualization/ and https://nicosmo.github.io/cosmic_web_explorer/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 4 篇

2603.24119 2026-03-26 cs.SE 79%

Enhancing and Reporting Robustness Boundary of Neural Code Models for Intelligent Code Understanding

增强神经代码模型的鲁棒性边界报告

Tingxu Han, Wei Song, Weisong Sun, Hao Wu, Chunrong Fang, Yuan Xiao, Xiaofang Zhang, Zhenyu Chen, Yang Liu

专题命中 软件智能体 :code model(title,abstract);分类 cs.SE

AI总结 本文提出ENBECOME,一种无需训练的轻量级对抗防御方法,通过推理时引入语义保持的扰动,提升神经代码模型的鲁棒性并报告认证鲁棒性边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23763 2026-03-26 cs.NI 78%

AgenticNet: Utilizing AI Coding Agents To Create Hybrid Network Experiments

AgenticNet:利用AI编码代理创建混合网络实验

Majd Latah, Kubra Kalkan

专题命中 软件智能体 :coding agent(title,abstract)

AI总结 AgenticNet通过AI编码代理提供混合网络实验工具,支持纯模拟、纯仿真和混合模式,提升实验灵活性和开发效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23515 2026-03-26 cs.CL cs.AI 62%

Training a Large Language Model for Medical Coding Using Privacy-Preserving Synthetic Clinical Data

利用隐私保护的合成临床数据训练大型语言模型进行医学编码

John Cook, Michael Wyatt, Peng Wei, Iris Chin, Santosh Gupta, Van Zyl Van Vuuren, Richie Siburian, Amanda Spicer, Kristen Viviano, Alda Cami, Raunaq Malhotra, Zhewei Yao, Jeff Rasley, Gaurav Kaushik

机构 * Veradigm Snowflake

专题命中 软件智能体 :coding agent(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了利用隐私保护的合成临床数据训练大型语言模型进行医学编码的可行性,通过微调Llama 3-70B模型,实现了ICD-10-CM和CPT代码的高精度预测,显著提升了编码准确性。

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24517 2026-03-26 cs.LG 57%

AVO: Agentic Variation Operators for Autonomous Evolutionary Search

AVO:用于自主进化搜索的代理变异算子

Terry Chen, Zhifan Ye, Bing Xu, Zihao Ye, Timmy Liu, Ali Hassani, Tianqi Chen, Andrew Kerr, Haicheng Wu, Yang Xu, Yu-Jung Chen, Hanfeng Chen, Aditya Kane, Ronny Krashinsky, Ming-Yu Liu, Vinod Grover, Luis Ceze, Roger Bringmann, John Tran, Wei Liu, Fung Xie, Michael Lightstone, Humphrey Shi

机构 * NVIDIA

专题命中 软件智能体 :coding agent(abstract);分类 cs.LG

AI总结 AVO通过自主代理实现变异操作,取代传统进化搜索中的固定突变和交叉操作,展示了在多头注意力中发现超越cuDNN和FlashAttention-4的优化结果。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 测试生成 1 篇

2601.06615 2026-03-26 cs.SE 57%

Fixturize: Bridging the Fixture Gap in Test Generation

Fixturize:弥合测试生成中的Fixture缺口

Chengyi Wang, Pengyu Xue, Zhen Yang, Xiapu Luo, Yuxuan Zhang, Xiran Lyu, Yifei Pei, Zonghan Jia, Yichen Sun, Linhao Wu, Kunwu Zheng

专题命中 测试生成 :unit test generation(abstract);分类 cs.SE

AI总结 Fixturize通过主动识别依赖fixture的函数并迭代生成fixture,提升自动化测试套件质量,显著提高测试通过率和覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 代码评测 2 篇

2603.24359 2026-03-26 cs.SE cs.HC 57%

Gendered Prompting and LLM Code Review: How Gender Cues in the Prompt Shape Code Quality and Evaluation

性别化提示与大语言模型代码审查:提示中的性别线索如何影响代码质量和评估

Lynn Janzen, Üveys Eroglu, Dorothea Kolossa, Pia Knöferle, Sebastian Möller, Vera Schmitt, Veronika Solopova

专题命中 代码评测 :code generation(abstract);分类 cs.SE

AI总结 研究探讨性别化提示对代码生成和审查的影响,发现性别线索在代码质量上影响有限,但对代码审查存在系统性偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24051 2026-03-26 cs.CL 57%

FinToolSyn: A forward synthesis Framework for Financial Tool-Use Dialogue Data with Dynamic Tool Retrieval

FinToolSyn: 一种用于金融工具使用对话数据的前向合成框架,具有动态工具检索

Caishuang Huang, Yang Qiao, Rongyu Zhang, Junjie Ye, Pu Lu, Wenxi Wu, Meng Zhou, Xiku Du, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) FiT, Tencent(腾讯FiT) Zhejiang University(浙江大学)

专题命中 代码评测 :repository(abstract);分类 cs.CL

AI总结 本文提出FinToolSyn框架,通过动态工具检索生成高质量金融对话数据,构建43,066个工具库并合成148k对话实例,提升金融场景下的工具调用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仓库级理解 4 篇

2603.23873 2026-03-26 cs.AI cs.LG 62%

The DeepXube Software Package for Solving Pathfinding Problems with Learned Heuristic Functions and Search

DeepXube软件包:利用学习启发式函数和搜索解决路径寻找问题

Forest Agostinelli

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 DeepXube通过机器学习学习启发式函数,结合深度强化学习、启发式搜索和形式逻辑,高效解决路径寻找问题,支持GPU和DNN架构的并行计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23794 2026-03-26 cs.CV cs.LG 57%

Sparse Autoencoders for Interpretable Medical Image Representation Learning

稀疏自编码器用于可解释的医学图像表示学习

Philipp Wesp, Robbie Holland, Vasiliki Sideri-Lampretsa, Sergios Gatidis

机构 * Stanford Center for Artificial Intelligence in Medicine and Imaging(斯坦福大学人工智能医学与成像中心) Department of Radiology, Stanford University(斯坦福大学放射科) Chair of AI in Healthcare and Medicine, Technical University of Munich(慕尼黑技术大学人工智能医疗与医学主任) TUM University Hospital, Munich, Germany(慕尼黑技术大学医院)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文研究使用稀疏自编码器替代抽象特征,通过CT和MRI图像切片生成可解释的稀疏特征,提升医学图像处理的可解释性。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06712 2026-03-26 cs.DL 50%

Disappearing repositories -- taking an infrastructure perspective on the long-term availability of research data

消失的存储库——从基础设施角度探讨研究数据的长期可用性

Dorothea Strecker, Heinz Pampel, Rouven Schabinger, Nina Leonie Weisweiler

专题命中 仓库级理解 :repository(abstract)

AI总结 研究数据存储库关闭现象及其对数据长期可用性的影响,通过注册表识别191个已关闭存储库,发现6.2%的存储库关闭,分析关闭原因及数据迁移策略,指出缺乏关闭事件信息和数据可发现性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23754 2026-03-26 cs.CV 50%

IJmond Industrial Smoke Segmentation Dataset

IJmond工业烟雾分割数据集

Yen-Chia Hsu, Despoina Touska

机构 * Informatics Institute University of Amsterdam(阿姆斯特丹大学信息研究所)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出一个用于工业烟雾分割的数据集,包含CC BY 4.0授权的图像数据,用于研究烟雾检测与分割方法。

详情

展开后加载摘要…

URL PDF HTML 收藏