arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-06-18 至 2026-06-18 共收录 7 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 3 篇

2606.19317 2026-06-18 cs.LG cs.AI 新提交 76%

Explaining Attention with Program Synthesis

用程序合成解释注意力机制

Amiri Hayes, Belinda Z Li, Jacob Andreas

机构 * NJIT(新泽西理工学院) MIT(麻省理工学院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 代码生成 :program synthesis(title);分类 cs.AI、cs.LG

AI总结 提出用可执行程序近似深度网络组件行为的方法,针对Transformer注意力头,通过生成Python程序再现注意力模式,实现可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18425 2026-06-18 cs.SE cs.AI cs.DC 新提交 62%

From Specification to Execution: AI Assisted Scientific Workflow Management

从规范到执行:AI辅助的科学工作流管理

Komal Thareja, Hamza Safri, Rajiv Mayani, Anirban Mandal, Ewa Deelman

机构 * RENCI, University of North Carolina at Chapel Hill, NC, USA(RENCI,北卡罗来纳大学教堂山分校) Information Sciences Institute, University of Southern California, Marina del Rey, CA, USA(信息科学研究所,南加州大学马里纳德尔雷耶斯分校)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI

AI总结 提出一种AI辅助方法,通过规范驱动的工作流生成、自动化调试和分布式执行,结合Pegasus与MCP层,实现从自然语言到大规模科学工作流的端到端管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18747 2026-06-18 cs.RO cs.AI 新提交 57%

Generating Natural and Expressive Robot Gestures through Iterative Reinforcement Learning with Human Feedback using LLMs

通过基于人类反馈的迭代强化学习利用大语言模型生成自然且富有表现力的机器人手势

Chris Lee, Flora Salim, Benjamin Tag, Francisco Cruz

机构 * University of New South Wales(新南威尔士大学) Universidad Central de Chile(智利中央大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 针对社交机器人手势生成僵硬问题,提出将ChatGPT集成到Pepper机器人中生成共语手势,并引入基于人类反馈的迭代强化学习(RLHF)优化手势,实验表明RLHF提升了手势的表现力、相关性和流畅性。

Comments 8 Pages, 6 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 3 篇

2606.19319 2026-06-18 cs.MA cs.AI cs.DB 新提交 79%

Data Intelligence Agents: Interpreting, Modeling, and Querying Enterprise Data via Autonomous Coding Agents

数据智能代理:通过自主编码代理解释、建模和查询企业数据

Anoushka Vyas, Aarushi Dhanuka, Sina Khoshfetrat Pakazad, Henrik Ohlsson

机构 * C3 AI

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.AI

AI总结 提出Data Intelligence Agents (DIA)系统,由三个自主编码代理组成,通过执行、验证和修复工件来压缩数据集成工作流,在七个SQL基准测试中达到或超越最佳结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18733 2026-06-18 cs.SE cs.AI 新提交 62%

SWE-Future: Forecast-Conditioned Data Synthesis for Future-Oriented Software Engineering Agents

SWE-Future: 面向未来软件工程智能体的预测条件数据合成

Qiao Zhao, JianYing Qu, Jun Zhang, Yehua Yang, Hanwen Du, Zhongkai Sun

机构 * Baidu Inc(百度公司)

专题命中 软件智能体 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出SWE-Future方法,利用仓库历史证据预测未来任务类型(如功能实现、缺陷修复),并基于预测条件合成200个编码智能体任务,减少对历史PR回放的依赖,在80个仓库中达到58.1%的未来工作相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19191 2026-06-18 cs.CR 新提交 50%

PhantomSkill: Malicious Code Injection in Agent Skill Ecosystems

PhantomSkill: 代理技能生态系统中的恶意代码注入

Yu-Ting Lin, Chia-Mu Yu

专题命中 软件智能体 :coding agent(abstract)

AI总结 提出PhantomSkill攻击框架,通过VulMask技术将恶意行为隐藏在技能的辅助资源中,利用漏洞形状的实现绕过检测,在保持良性功能的同时降低警告和恶意软件检测率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 仓库级理解 1 篇

2606.10017 2026-06-18 astro-ph.HE astro-ph.CO astro-ph.GA hep-ph 新提交 50%

Refined anti-proton and anti-deuteron fluxes from weak-scale Dark Matter

来自弱尺度暗物质的精细反质子和反氘通量

Marco Cirelli, Mattia Di Mauro, Arpan Kar

专题命中 仓库级理解 :repository(abstract)

AI总结 基于更新传播模型和CosmiXs谱,计算质量从几GeV到100 TeV的暗物质湮灭或衰变产生的反质子和反氘宇宙线通量,并与PPPC4DMID结果比较,发现新模型下通量更稳健。

Comments 26 pages, 14 figures, 1 table. v2: metadata corrected. The results are available at https://github.com/CosmiXsPPPC

详情

展开后加载摘要…

URL PDF HTML 收藏