arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-03-23 至 2026-03-23 共收录 11 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 3 篇

2502.20795 2026-03-23 cs.CL 70%

Test-Time Alignment for Large Language Models via Textual Model Predictive Control

通过文本模型预测控制对大型语言模型进行测试时对齐

Kuang-Da Wang, Teng-Ruei Chen, Yu Heng Hung, Guo-Xun Ko, Shuoyang Ding, Yueh-Hua Wu, Yu-Chiang Frank Wang, Chao-Han Huck Yang, Wen-Chih Peng, Ping-Chun Hsieh

机构 * National Yang Ming Chiao Tung University NVIDIA National Taiwan University

专题命中 代码生成 :code generation(abstract);program synthesis(abstract);分类 cs.CL

AI总结 本文提出TMPC方法,通过文本模型预测控制解决测试时对齐问题,通过分层强化学习原理改进生成过程,提升不同任务的性能。

Comments Accepted for ICLR 2026. Project page: https://rl-bandits-lab.github.io/TMPC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20105 2026-03-23 cs.LG cs.AI 62%

The $\mathbf{Y}$-Combinator for LLMs: Solving Long-Context Rot with $λ$-Calculus

LLMs的Y-组合子:解决长上下文旋转问题的λ演算

Amartya Roy, Rasul Tutunov, Xiaotong Ji, Matthieu Zimmer, Haitham Bou-Ammar

机构 * The School of Interdisciplinary Research(跨学科研究学院) Indian Institute of Technology (IIT) Delhi(印度理工学院德里分校) Robert Bosch GmbH, India(德国罗伯特·博世有限公司,印度) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Huawei Noah’s Ark UCL Centre for Artificial Intelligence(华为诺亚方舟大学伦敦人工智能中心)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出λ-RLM框架,通过类型化的功能运行时替代自由递归代码生成,提升长上下文推理的可靠性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13876 2026-03-23 cs.AI cs.CL 62%

Improved Generalized Planning with LLMs through Strategy Refinement and Reflection

通过策略细化与反思改进基于LLM的通用规划

Katharina Stein, Nils Hodel, Daniel Fišer, Jörg Hoffmann, Michael Katz, Alexander Koller

专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过生成伪代码并自动调试,结合反思步骤提升LLM生成的通用规划质量,实验显示改进后配置在17个基准领域达到82%的平均覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2603.19452 2026-03-23 cs.MA cs.AI 57%

TrustFlow: Topic-Aware Vector Reputation Propagation for Multi-Agent Ecosystems

TrustFlow:基于主题的向量声誉传播用于多智能体生态系统

Volodymyr Seliuchenko

专题命中 软件智能体 :software agent(abstract);分类 cs.AI

AI总结 TrustFlow通过主题门控转移运算符在交互图中传播声誉,采用多维声誉向量提升精度,有效抵御Sybil攻击和声誉洗白。

Comments 14 pages, 3 figures, demo at https://robutler.ai

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 代码评测 3 篇

2603.19273 2026-03-23 cs.CL cs.AI 62%

LSR: Linguistic Safety Robustness Benchmark for Low-Resource West African Languages

LSR:低资源西非语言的语言安全鲁棒性基准

Godwin Abuh Faruna

机构 * Fagmart Lab(法格马特实验室)

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

AI总结 LSR是首个评估跨语言拒绝退化现象的基准,针对西非语言中的有害意图表达,发现模型拒绝率从英语的90%降至35-55%,其中Igala语言退化最严重。

Comments 6 pages. Reference implementation: https://huggingface.co/spaces/Faruna01/lsr-dashboard. Dataset: https://huggingface.co/datasets/Faruna01/lsr-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.02831 2026-03-23 cs.CV 50%

Deep Face Restoration: A Survey

深度人脸修复:综述

Tao Wang, Kaihao Zhang, Jiankang Deng, Tong Lu, Wei Liu, Stefanos Zafeiriou

机构 * The State Key Lab for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Australian National University(澳大利亚国立大学) Imperial College London(伦敦帝国理工学院) Tencent(腾讯)

专题命中 代码评测 :repository(abstract)

AI总结 本文综述了基于深度学习的人脸修复方法,分析了问题 formulations、挑战及最新技术,提供了系统评估和开源资源。

Comments Accepted by ACM Computing Surveys, 39 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13479 2026-03-23 cs.AR 50%

Toward Reproducible and Standardized Computer Architecture Simulation with gem5

迈向可重复和标准化的计算机体系结构模拟的gem5

Kunal Pai, Harshil Patel, Erin Le, Noah Krim, Mahyar Samani, Bobby R. Bruce, Jason Lowe-Power

专题命中 代码评测 :repository(abstract)

AI总结 本文通过改进gem5和gem5 Resources,标准化磁盘镜像创建,提供验证过的基础镜像和预注释的基准套件,简化了计算机体系结构模拟的设置流程,提高了可重复性和标准化程度。

Comments Accepted to the 2026 IEEE International Symposium on Performance Analysis of Systems and Software (ISPASS-2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 4 篇

2603.20028 2026-03-23 cs.SE cs.AI 62%

Orchestrating Human-AI Software Delivery: A Retrospective Longitudinal Field Study of Three Software Modernization Programs

协调人机AI软件交付:三种软件现代化项目的回顾纵向实地研究

Maximiliano Armesto, Christophe Kolb

机构 * Taller Technologies(塔勒技术)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究通过回顾三个软件现代化项目,分析AI与人类协作在软件交付各阶段的效果,发现嵌入协调工作流的AI能显著提升效率与覆盖率。

Comments 18 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20151 2026-03-23 cs.CE cs.AI cs.SY eess.SY 57%

Design-OS: A Specification-Driven Framework for Engineering System Design with a Control-Systems Design Case

Design-OS:一种以规范驱动的工程系统设计框架及其控制系统设计案例

H. Sinan Bank, Daniel R. Herber, Thomas H. Bradley

机构 * Department of Systems Engineering(系统工程系) Colorado State University(科罗拉多州立大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出Design-OS,一种以规范驱动的工程系统设计框架,通过五个阶段实现设计过程的可追溯性和可审计性,适用于控制系统的不同实现案例。

Comments 2 figures, 11 pages, Submitted to ASME IDETC 2026 - DAC-09

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18987 2026-03-23 cs.AI 57%

Unmasking Algorithmic Bias in Predictive Policing: A GAN-Based Simulation Framework with Multi-City Temporal Analysis

揭示预测警务中的算法偏见:基于GAN的模拟框架与多城市时间分析

Pronob Kumar Barman, Pronoy Kumar Barman

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩分校) Jagannath University(贾加纳特大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出基于GAN的模拟框架,分析多城市警务中种族偏见的传播,通过实验证明算法偏见的显著性及结构性不平等的持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09111 2026-03-23 cs.CV 50%

Towards Open Environments and Instructions: General Vision-Language Navigation via Fast-Slow Interactive Reasoning

迈向开放环境和指令:通过快速-缓慢交互推理实现通用视觉-语言导航

Yang Li, Aming Wu, Zihao Zhang, Yahong Han

机构 * School of Artificial Intelligence, College of Intelligence and Computing, Tianjin University, China(人工智能学院,智能与计算学院,天津大学,中国) School of Computer Science and Information Engineering, Hefei University of Technology, China(计算机科学与信息工程学院,合肥工业大学,中国)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出慢4快-VLN框架,通过快速-缓慢交互推理提升视觉语言导航的泛化能力,解决传统方法在开放环境中的适应难题。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏