arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-04-13 至 2026-04-13 共收录 17 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 10 篇

2604.09089 2026-04-13 cs.SE cs.AI cs.CR 81%

DeepGuard: Secure Code Generation via Multi-Layer Semantic Aggregation

DeepGuard:通过多层语义聚合实现安全代码生成

Li Huang, Zhongxin Liu, Yifan Wu, Tao Yin, Dong Li, Jichao Bi, Nankun Mu, Hongyu Zhang, Meng Yan

机构 * Chongqing University(重庆大学) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全全国重点实验室,浙江大学) Peking University(北京大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.AI

AI总结 DeepGuard通过多层语义聚合提升代码生成的安全性,实验表明其在安全性和功能性上均优于基线模型,有效检测并减少不安全模式。

Comments ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24250 2026-04-13 cs.AI cs.HC cs.LG 81%

Interactive Program Synthesis for Modeling Collaborative Physical Activities from Narrated Demonstrations

基于叙述演示的协作物理活动建模交互式程序合成

Edward Kim, Daniel He, Jorge Chao, Wiktor Rajca, Mohammed Amin, Nishant Malpani, Ruta Desai, Antti Oulasvirta, Bjoern Hartmann, Sanjit Seshia

机构 * University of California, Berkeley(加州大学伯克利分校) Meta Aalto University(阿尔托大学)

专题命中 代码生成 :program synthesis(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过交互式程序合成解决协作物理活动建模问题,利用叙述演示统一教学、检查和纠正系统逻辑,实验表明用户能有效修正程序以匹配意图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09515 2026-04-13 cs.SE 79%

When LLMs Lag Behind: Knowledge Conflicts from Evolving APIs in Code Generation

当LLM落后时:来自演进API的代码生成中的知识冲突

Ahmed Nusayer Ashik, Shaowei Wang, Tse-Hsun Chen, Muhammad Asaduzzaman, Yuan Tian

专题命中 代码生成 :code generation(title,abstract);分类 cs.SE

AI总结 本文研究了API演变对LLM代码生成的影响,发现缺乏全面文档时LLM难以优先处理外部上下文,执行率仅42.55%,而结构化文档和大模型规模可提升至66.36%,但推理策略如Self-Reflection可进一步提升11%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09442 2026-04-13 cs.CL 79%

UIPress: Bringing Optical Token Compression to UI-to-Code Generation

UIPress:将光学令牌压缩引入UI到代码生成

Dasen Dai, Shuoqi Li, Ronghao Chen, Huacan Wang, Biao Wu, Qizhen Lan

机构 * The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) University of Technology Sydney(悉尼科技大学)

专题命中 代码生成 :code generation(title,abstract);分类 cs.CL

AI总结 本文提出UIPress,一种轻量级学习压缩模块,通过结合深度可分离卷积、元素引导的空间重加权和Transformer细化,将UI截图的视觉令牌从约6700压缩到256,结合LoRA实现表示差距桥接,提升效率并优于现有方法。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08690 2026-04-13 cs.LG cs.CL 62%

Skip-Connected Policy Optimization for Implicit Advantage

隐式优势下的跳连策略优化

Fengwei Teng, Jinyi Bai, Xinhao Yao, Demi Ruohan Wang, Jiahao Zhao, Zhijiang Guo

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Renmin University of China(中国人民大学) Carnegie Mellon University(卡内基梅隆大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.LG

AI总结 本文提出跳连优化方法,通过将推理分解为上游和下游阶段,利用密集奖励和蒙特卡洛采样提升性能,在数学基准和领域外任务中取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04736 2026-04-13 cs.AI cs.AR cs.PL 62%

ChipSeek: Optimizing Verilog Generation via EDA-Integrated Reinforcement Learning

ChipSeek: 通过集成EDA的强化学习优化Verilog生成

Zhirong Chen, Kaiyan Chang, Zhuolin Li, Cangyuan Li, Xinyang He, Chujie Chen, Mengdi Wang, Haobo Xu, Yinhe Han, Huawei Li, Ying Wang

机构 * SKLP, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所智能计算机研究中心) University of Chinese Academy of Sciences(中国科学院大学) University of Electronic Science and Technology of China(电子科技大学) Beijing Institute of Technology(北京理工大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI、cs.PL

AI总结 ChipSeek通过集成EDA的强化学习框架,优化RTL代码生成,提升功能正确性和PPA指标。

Comments Accepted by ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08931 2026-04-13 cs.AI cs.MA 57%

Enhancing LLM Problem Solving via Tutor-Student Multi-Agent Interaction

通过导师-学生多智能体交互增强LLM问题解决能力

Nurullah Eymen Özdemir, Erhan Oztop

机构 * Ozyegin University(奥兹耶金大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出PETITE框架,通过角色差异化交互提升LLM问题解决性能,对比自一致性、自修正等方法,显示在APPS基准上准确率相近或更高且消耗更少token。

Comments 7 pages, 3 figures, This work is under review for conference appearance

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08713 2026-04-13 cs.SE 57%

An Eye for Trust: An Exploration of Developers' Trust Perceptions Through Urgency and Reputation

信任之眼:通过紧迫性和声誉探索开发者信任感知

Sara Yabesi, Mahta Amini, Jelena Ristic, Zohreh Sharafi

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究通过眼动实验探讨紧迫性和声誉如何影响开发者对代码可信度的判断,发现代码优先级影响审查行为但不影响采纳决策,且开发者未充分意识到紧迫性和声誉的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05072 2026-04-13 cs.LG 57%

Hierarchical SVG Tokenization: Learning Compact Visual Programs for Scalable Vector Graphics Modeling

分层SVG标记化:为可扩展矢量图形建模学习紧凑的视觉程序

Ximing Xing, Ziteng Xue, Zhenxi Li, Weicong Liang, Linqing Wang, Zhantao Yang, Tiankai Hang, Zijin Yin, Qinglin Lu, Chunyu Wang, Qian Yu

机构 * Tencent(腾讯) Visual Computing Group, Beijing(北京视觉计算组)

专题命中 代码生成 :program synthesis(abstract);分类 cs.LG

AI总结 本文提出HiVG框架,通过分层标记化提升矢量图形生成的序列效率与空间一致性,解决传统标记化方法在几何结构表达上的不足。

Comments Homepage: https://hy-hivg.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19644 2026-04-13 cs.SE cs.HC 57%

A survey of generative AI adoption and perceived productivity among scientists who program

生成式AI采纳与科学家编程中感知生产力的综述

Gabrielle O'Brien, Alexis Parker, Nasir Eisty, Jeffrey Carver

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 本文综述了生成式AI在科学家编程中的采纳情况,发现学生和经验较少的程序员更倾向于使用通用对话接口,且生成代码量与感知生产力密切相关。

Comments Revisions

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 2 篇

2604.09409 2026-04-13 cs.SE 79%

Do AI Coding Agents Log Like Humans? An Empirical Study

AI 编程代理是否像人类一样记录日志?一项实证研究

Youssef Esseddiq Ouatiti, Mohammed Sayagh, Hao Li, Ahmed E. Hassan

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE

AI总结 研究通过分析4550个代理拉取请求,发现代理在58.4%的仓库中更改日志频率低于人类,但日志密度更高。明确的日志指令稀缺且无效,人类在72.5%的情况下修复日志问题,表明自然语言指令存在不足,需引入确定性限制以确保一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05744 2026-04-13 cs.CL cs.SE 76%

CodeScout: Contextual Problem Statement Enhancement for Software Agents

CodeScout: 为软件代理提供上下文化的问题陈述增强

Manan Suri, Xiangci Li, Mehdi Shojaie, Songyang Han, Chao-Chun Hsu, Shweta Garg, Aniket Anand Deshmukh, Varun Kumar

机构 * University of Maryland, College Park(马里兰大学帕克分校) Amazon Web Services (AWS)(亚马逊云服务(AWS)) Databricks

专题命中 软件智能体 :software agent(title);分类 cs.SE、cs.CL

AI总结 CodeScout通过轻量级预探索将模糊请求转化为完整问题陈述,提升软件代理性能,实验表明其在解决率上提升20%。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 代码评测 3 篇

2604.08851 2026-04-13 cs.CL 57%

Cross-Lingual Attention Distillation with Personality-Informed Generative Augmentation for Multilingual Personality Recognition

跨语言注意力蒸馏与基于个性引导的生成增强用于多语言个性识别

Jing Jie Tan, Ban-Hoe Kwan, Danny Wee-Kiat Ng, Yan-Chai Hum, Noriyuki Kawarazaki, Kosuke Takano

机构 * Universiti Tunku Abdul Rahman(拉曼大学) Kanagawa Institute of Technology(神奈川工科大学) Université Sorbonne Paris Nord(索邦巴黎北大学)

专题命中 代码评测 :repository(abstract);分类 cs.CL

AI总结 本文提出ADAM方法,通过跨语言注意力蒸馏和基于个性引导的生成增强,提升多语言个性识别性能,实验表明CLAD在多种语言和个性特征上均优于标准BCE模型。

Comments IEEE Transactions on Cognitive and Developmental Systems (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08947 2026-04-13 cs.AI 57%

AlphaCast: A Human Wisdom-LLM Intelligence Co-Reasoning Framework for Interactive Time Series Forecasting

AlphaCast:一种用于交互式时间序列预测的人类智慧-大语言模型智能协同推理框架

Xiaohan Zhang, Tian Gao, Mingyue Cheng, Bokai Pan, Ze Guo, Yaguo Liu, Xiaoyu Tao, Qi Liu

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(中国科学技术大学认知智能国家重点实验室)

专题命中 代码评测 :repository(abstract);分类 cs.AI

AI总结 AlphaCast提出一种交互驱动的代理推理框架,利用无训练大语言模型实现准确的时间序列预测,通过多阶段工作流整合上下文准备、基于推理的生成和反思评估,将预测转化为多轮自主交互过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09030 2026-04-13 cs.CV 50%

NTIRE 2026 The 3rd Restore Any Image Model (RAIM) Challenge: Multi-Exposure Image Fusion in Dynamic Scenes (Track 2)

NTIRE 2026 第三次恢复任何图像模型(RAIM)挑战:动态场景中的多曝光图像融合(Track 2)

Lishen Qu, Yao Liu, Jie Liang, Hui Zeng, Wen Dai, Guanyi Qin, Ya-nan Guan, Shihao Zhou, Jufeng Yang, Lei Zhang, Radu Timofte, Xiyuan Yuan, Wanjie Sun, Shihang Li, Bo Zhang, Bin Chen, Jiannan Lin, Yuxu Chen, Qinquan Gao, Tong Tong, Song Gao, Jiacong Tang, Tao Hu, Xiaowen Ma, Qingsen Yan, Sunhan Xu, Juan Wang, Xinyu Sun, Lei Qi, He Xu, Jiachen Tu, Guoyi Xu, Yaoxin Jiang, Jiajia Liu, Yaokun Shi

专题命中 代码评测 :repository(abstract)

AI总结 本文提出NTIRE 2026挑战,针对动态场景中多曝光图像融合的HDR成像难题,提供包含100训练序列和100测试序列的基准数据集,评估PSNR、SSIM、LPIPS等指标及感知质量,最终由114支队伍提交987份方案,提升去噪和细节恢复能力。

Comments Accepted by CVPRW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 2 篇

2604.09233 2026-04-13 eess.IV 50%

A GPU-enhanced workflow for non-Fourier SENSE reconstruction

一种增强GPU的非傅里叶SENSE重建工作流

Samuel Bianchi, Klaas P. Pruessmann

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出一种基于GPU的非傅里叶SENSE重建方法,用于在复杂场景中准确重建磁共振图像,通过优化敏感性和B0映射提升重建效率和图像质量。

Comments 31 pages, 10 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20638 2026-04-13 cs.SD cs.CV cs.MM eess.AS 50%

Music Audio-Visual Question Answering Requires Specialized Multimodal Designs

音乐音频视觉问答需要专门的多模态设计

Wenhao You, Xingjian Diao, Wenjun Huang, Chunhui Zhang, Keyi Kong, Weiyi Wu, Chiyu Ma, Zhongyu Ouyang, Tingxuan Wu, Ming Cheng, Soroush Vosoughi, Jiang Gui

机构 * University of Waterloo(滑铁卢大学) Dartmouth College(达特茅斯学院) UC Irvine(加州大学尔湾分校) New York University(纽约大学)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文探讨了音乐音频视觉问答任务中多模态设计的必要性,指出需专门的输入处理、空间时间架构和音乐特定建模策略以应对连续密集的音频视觉内容和复杂时间动态。

Comments Accepted to Annual Meeting of the Association for Computational Linguistics (ACL 2026). The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏