arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-04-14 至 2026-04-14 共收录 7 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 7 篇

2604.09791 2026-04-14 cs.AI cs.CL cs.LG cs.MA 67%

Pioneer Agent: Continual Improvement of Small Language Models in Production

先驱代理:生产环境中小语言模型的持续改进

Dhruv Atreja, Julia White, Nikhil Nayak, Kelton Zhang, Henrijs Princis, George Hurn-Maloney, Ash Lewis, Urchade Zaratiana

机构 * Fastino Labs

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Pioneer Agent,通过闭环系统自动化小语言模型的持续改进,通过冷启动和生产模式提升模型性能,发现有效训练策略。

Comments 43 pages, 10 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11518 2026-04-14 cs.SE cs.AI 62%

From Translation to Superset: Benchmark-Driven Evolution of a Production AI Agent from Rust to Python

从翻译到超集:面向生产AI代理的基准驱动演进:从Rust到Python

Jinhua Wang, Biswa Sengupta

专题命中 代码评测 :coding agent(abstract);分类 cs.SE、cs.AI

AI总结 本文提出一种基于LLM的持续代码翻译方法,将Rust生产代码库迁移至Python,通过基准驱动迭代优化,实现功能扩展与性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09564 2026-04-14 cs.DC cs.AI cs.SE 62%

ACE-Bench: A Lightweight Benchmark for Evaluating Azure SDK Usage Correctness

ACE-Bench:一个轻量级的评估 Azure SDK 使用正确性的基准测试

Wenxing Zhu, Simeng Qi, Junkui Chen, Yan Xie, Min Huang, Jingkan He, Xiao Wang, Cheng Chen, Sijing Meng, Tianqi Zhang

机构 * Microsoft(微软)

专题命中 代码评测 :coding agent(abstract);分类 cs.SE、cs.AI

AI总结 ACE-Bench通过将官方文档示例转化为自包含编码任务,提供快速可重复的通过或失败信号,评估基于LLM的编码代理是否正确使用Azure SDK,同时减少评估成本并提高可重复性。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07061 2026-04-14 cs.AI 57%

Do LLMs Feel? Teaching Emotion Recognition with Prompts, Retrieval, and Curriculum Learning

LLMs能否感知情绪?通过提示、检索和课程学习进行情绪识别

Xinran Li, Yu Liu, Jiaqi Qiao, Xiujuan Xu

专题命中 代码评测 :repository(abstract);分类 cs.AI

AI总结 本文提出PRC-Emo框架,结合提示工程、示范检索和课程学习,探索LLM在对话中感知情绪的能力,实验表明在IEMOCAP和MELD数据集上达到新的SOTA性能。

Comments Accepted at AAAI 2026

Journal ref Proc. AAAI Conf. on Artificial Intelligence, Vol. 40, No. 38, pp. 31778-31786 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11230 2026-04-14 cs.CV 50%

NTIRE 2026 The 3rd Restore Any Image Model (RAIM) Challenge: AI Flash Portrait (Track 3)

NTIRE 2026 第三次恢复任何图像模型(RAIM)挑战:AI闪光人像(第三赛道)

Ya-nan Guan, Shaonan Zhang, Hang Guo, Yawen Wang, Xinying Fan, Tianqu Zhuang, Jie Liang, Hui Zeng, Guanyi Qin, Lishen Qu, Tao Dai, Shu-Tao Xia, Lei Zhang, Radu Timofte, Bin Chen, Yuanbo Zhou, Hongwei Wang, Qinquan Gao, Tong Tong, Yanxin Qian, Lizhao You, Jingru Cong, Lei Xiong, Shuyuan Zhu, Zhi-Qiang Zhong, Kan Lv, Yang Yang, Kailing Tang, Minjian Zhang, Zhipei Lei, Zhe Xu, Liwen Zhang, Dingyong Gou, Yanlin Wu, Cong Li, Xiaohui Cui, Jiajia Liu, Guoyi Xu, Yaoxin Jiang, Yaokun Shi, Jiachen Tu, Liqing Wang, Shihang Li, Bo Zhang, Biao Wang, Haiming Xu, Xiang Long, Xurui Liao, Yanqiao Zhai, Haozhe Li, Shijun Shi, Jiangning Zhang, Yong Liu, Kai Hu, Jing Xu, Xianfang Zeng, Yuyang Liu, Minchen Wei

专题命中 代码评测 :repository(abstract)

AI总结 本文提出NTIRE 2026第三次RAIM挑战,聚焦AI闪光人像赛道,旨在解决低光照条件下人像修复的噪声抑制、细节保留与光照颜色还原平衡问题,提供包含800组真实低光照人像数据的评估数据集和基准代码。

Comments Accepted to CVPR 2026 Workshop. Includes supplementary material as ancillary file

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22511 2026-04-14 cs.CR 50%

CTF as a Service: A reproducible and scalable infrastructure for cybersecurity training

CTF as a Service:一种可重复和可扩展的网络安全培训基础设施

Carlos Jimeno Miguel, Mikel Izal

专题命中 代码评测 :repository(abstract)

AI总结 本文提出CTF as a Service平台,利用虚拟化和IaC工具实现自动化部署和可扩展的网络安全培训。

Comments 6 pages, 2 figures, sent to conference Jornadas Nacionales de Investigacion en Ciberseguridad JNIC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15630 2026-04-14 hep-ph astro-ph.HE 50%

Supernova production of axion-like particles coupling to electrons, reloaded

Ia型超新星产生耦合于电子的轴子样粒子:重新加载

Damiano F. G. Fiorillo, Tetyana Pitik, Edoardo Vitagliano

专题命中 代码评测 :repository(abstract)

AI总结 本文重新审视了在相对论等离子体中通过树级过程产生耦合于电子的轴子样粒子(ALPs)的方法,推导了Bremsstrahlung产率的解析表达式,并评估了生产率的不确定性,同时探讨了ALP生产及其衰变对天体物理观测的影响。

Comments Revised version with corrected Compton emission rate, consistent with the Erratum published in PRD

详情

展开后加载摘要…

URL PDF HTML 收藏