arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-08-10 至 2026-08-10 共收录 8 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 1 篇

2509.05208 2026-08-10 cs.CV cs.LG 版本更新 57%

Symbolic Graphics Programming with Large Language Models

基于大语言模型的符号图形编程

Yamei Chen, Haoquan Zhang, Yangyi Huang, Zeju Qiu, Kaipeng Zhang, Yandong Wen, Weiyang Liu

机构 * The Chinese University of Hong Kong(香港中文大学) Westlake University(西湖大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)

专题命中 代码生成 :program synthesis(abstract);分类 cs.LG

AI总结 本文针对大语言模型生成符号图形程序(SGP)能力不足的问题,提出带可验证奖励的强化学习方法,在Qwen-2.5-7B上实现与前沿系统相当的SVG生成性能,揭示SGP是跨模态 grounding 的有效视角。

Comments Accepted by Transactions on Machine Learning Research. (32 pages, 12 figures.) This version refines the paper structure, adds experimental results. Project page: https://spherelab.ai/SGP-Gen/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2607.29678 2026-08-10 cs.CL cs.DC cs.PF 版本更新 57%

TokTier: Exact Stateful CPU+GPU Tokenization for Agentic LLM Serving

TokTier:面向智能体大语言模型服务的精确有状态分词方案

Zhenyu Zhang, Zhichao Cao

机构 * Arizona State University(亚利桑那州立大学)

专题命中 软件智能体 :coding agent(abstract);分类 cs.CL

AI总结 本研究提出TokTier,一种面向智能体LLM服务的精确有状态分词方案,通过增量修复、GPU加速分词等技术,将首次令牌生成时间降低16%-34%,饱和请求速率提升至1821次/秒,性能远超现有方案。

Comments 26 pages. Code: https://github.com/asu-idi/toktier

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 测试生成 1 篇

2604.09222 2026-08-10 cs.SD cs.AI 版本更新 57%

GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking

GRM:通过梯度比掩码实现音频大语言模型的效用感知越权攻击

Yunqiang Wang, Hengyuan Na, Di Wu, Miao Hu, Guocong Quan

机构 * Sun Yat-Sen University(中山大学)

专题命中 测试生成 :repository(abstract);分类 cs.AI

AI总结 本文提出GRM框架,通过频率选择性扰动在音频大语言模型中实现效用感知的越权攻击,实验表明其在攻击成功率与效用平衡方面优于基线方法。

Comments Accpeted by MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 4 篇

2608.05204 2026-08-10 cs.AI cs.LG 版本更新 62%

SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse

SkillTrace:面向LLM智能体技能复用的多溯源审计

Jialuo Chen, Minghe Wang, Lingqi Jiang, Jianan Ma, Xinhao Deng, Xiaohu Du, Ruixiao Lin, Yunhao Feng, Linkang Du, Jingyi Wang

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SKILLTRACE框架,通过提取三种溯源审计LLM智能体技能复用,在SKILLTRACE-BENCH上取得高指标,野外审计显示其能生成更具操作性的复用审查队列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25637 2026-08-10 cs.DL cs.AI cs.SI 版本更新 57%

F(AI)2R: Who Did What, and Who Checked? Verifiable AI Provenance as an Executable Skill

F(AI)2R:谁做了什么,谁进行了检查?可验证的人工智能溯源作为一项可执行技能

Florian Krebs

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究将F(AI)2R实验的溯源模型扩展为aiprov,涵盖任何含人工智能工件。方法被打包为可执行技能,由人工智能代理操作,能解析操作员身份,把关图一致性并发布论文版本,以自身为例展示溯源记录。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15790 2026-08-10 cs.LG stat.ML 版本更新 57%

Certified Interpolation Oversampling: Per-Instance Safety Guarantees for Imbalanced Learning

带安全认证的插值过采样:不平衡学习中针对单个样本的安全保证

Pankaj Yadav, Vivek Vijay

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文提出带安全认证的插值过采样(CISO)框架,为不平衡学习生成带安全属性的样本,在多数据集实验中表现与SMOTE相当且无评估失败,揭示了保真度与安全的连续权衡关系。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01361 2026-08-10 astro-ph.HE astro-ph.GA 版本更新 50%

Search for neutrino emission from blazar $γ$-ray flares accounting for possible neutrino time delays

搜寻与blazar γ射线暴相关的高能中微子辐射,考虑中微子可能的时间延迟

Egor Podlesnyi, Foteini Oikonomou

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究通过分析中微子与γ射线暴的时间延迟,探索blazar高能中微子辐射的可能性。

Comments 16 pages (11+5), 12 figures (9+3), 7 tables (2+5); published in the Open Journal of Astrophysics

Journal ref OJA, 9, 10.33232/001c.166774 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 程序分析与验证 1 篇

2606.23512 2026-08-10 cs.SE 版本更新 57%

Source-Free Detection and Impact Analysis of Compiler Optimization Problems in Mobile Applications

移动应用中编译器优化问题的无源检测与影响分析

Han Hu, Xiaoheng Xie, Bo Sun, Jian Gu, Gang Fan, Li Li

专题命中 程序分析与验证 :repository(abstract);分类 cs.SE

AI总结 提出无源框架OptDetect,直接从二进制文件检测编译器优化问题,无需源码或构建元数据,准确率达93.0%,发现30.5%的库使用低优化级别,修复后CPU指令减少10-63%。

详情

展开后加载摘要…

URL PDF HTML 收藏