Explaining Attention with Program Synthesis
用程序合成解释注意力机制
机构 * NJIT(新泽西理工学院) ; MIT(麻省理工学院) ; MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)
专题命中 代码生成 :program synthesis(title);分类 cs.AI、cs.LG
AI总结 提出用可执行程序近似深度网络组件行为的方法,针对Transformer注意力头,通过生成Python程序再现注意力模式,实现可解释性。
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
用程序合成解释注意力机制
机构 * NJIT(新泽西理工学院) ; MIT(麻省理工学院) ; MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)
专题命中 代码生成 :program synthesis(title);分类 cs.AI、cs.LG
AI总结 提出用可执行程序近似深度网络组件行为的方法,针对Transformer注意力头,通过生成Python程序再现注意力模式,实现可解释性。
从规范到执行:AI辅助的科学工作流管理
机构 * RENCI, University of North Carolina at Chapel Hill, NC, USA(RENCI,北卡罗来纳大学教堂山分校) ; Information Sciences Institute, University of Southern California, Marina del Rey, CA, USA(信息科学研究所,南加州大学马里纳德尔雷耶斯分校)
专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI
AI总结 提出一种AI辅助方法,通过规范驱动的工作流生成、自动化调试和分布式执行,结合Pegasus与MCP层,实现从自然语言到大规模科学工作流的端到端管理。
信任区域在线策略蒸馏
机构 * Samsung Research(三星研究院) ; University of Oxford(牛津大学) ; Peking University(北京大学)
专题命中 代码生成 :code generation(abstract);分类 cs.CL、cs.LG
AI总结 提出信任区域在线策略蒸馏(TrOPD),通过信用分配策略和信任区域学习解决师生分布差异导致的训练不稳定问题,在数学推理、代码生成和通用基准上超越现有方法。
通过基于人类反馈的迭代强化学习利用大语言模型生成自然且富有表现力的机器人手势
机构 * University of New South Wales(新南威尔士大学) ; Universidad Central de Chile(智利中央大学)
专题命中 代码生成 :code generation(abstract);分类 cs.AI
AI总结 针对社交机器人手势生成僵硬问题,提出将ChatGPT集成到Pepper机器人中生成共语手势,并引入基于人类反馈的迭代强化学习(RLHF)优化手势,实验表明RLHF提升了手势的表现力、相关性和流畅性。
Comments 8 Pages, 6 Figures
数据智能代理:通过自主编码代理解释、建模和查询企业数据
机构 * C3 AI
专题命中 软件智能体 :coding agent(title,abstract);分类 cs.AI
AI总结 提出Data Intelligence Agents (DIA)系统,由三个自主编码代理组成,通过执行、验证和修复工件来压缩数据集成工作流,在七个SQL基准测试中达到或超越最佳结果。
SWE-Future: 面向未来软件工程智能体的预测条件数据合成
机构 * Baidu Inc(百度公司)
专题命中 软件智能体 :repository(abstract);分类 cs.SE、cs.AI
AI总结 提出SWE-Future方法,利用仓库历史证据预测未来任务类型(如功能实现、缺陷修复),并基于预测条件合成200个编码智能体任务,减少对历史PR回放的依赖,在80个仓库中达到58.1%的未来工作相关性。
PhantomSkill: 代理技能生态系统中的恶意代码注入
专题命中 软件智能体 :coding agent(abstract)
AI总结 提出PhantomSkill攻击框架,通过VulMask技术将恶意行为隐藏在技能的辅助资源中,利用漏洞形状的实现绕过检测,在保持良性功能的同时降低警告和恶意软件检测率。
LivePI:更真实的智能体对抗间接提示注入基准测试
机构 * University of Pennsylvania(宾夕法尼亚大学)
专题命中 代码评测 :repository(abstract);分类 cs.AI
AI总结 提出LivePI基准,覆盖7种输入表面、12种攻击/渲染家族和5种恶意目标,在真实虚拟机环境中评估多个AI智能体,发现攻击成功率10.7%-29.6%,并验证了两层防御的有效性。
SoliDualSPHysics:一种用于固体力学的DualSPHysics扩展,支持超弹性、塑性及断裂
专题命中 代码评测 :repository(abstract)
AI总结 本文提出SoliDualSPHysics,一种基于SPH的开源软件,扩展DualSPHysics以模拟超弹性、有限应变塑性及脆性断裂行为,采用总拉格朗日格式,支持动态加载下的裂纹萌生与扩展,验证了其准确性和可扩展性。
Journal ref Computer Physics Communications 327 (2026) 110257
来自弱尺度暗物质的精细反质子和反氘通量
专题命中 仓库级理解 :repository(abstract)
AI总结 基于更新传播模型和CosmiXs谱,计算质量从几GeV到100 TeV的暗物质湮灭或衰变产生的反质子和反氘宇宙线通量,并与PPPC4DMID结果比较,发现新模型下通量更稳健。
Comments 26 pages, 14 figures, 1 table. v2: metadata corrected. The results are available at https://github.com/CosmiXsPPPC
理解状态空间模型在代码中学到了什么
机构 * TU Darmstadt(图宾根大学) ; Hessian Center for Artificial Intelligence(黑森人工智能中心) ; National Research Center for Applied Cybersecurity ATHENE(应用网络安全国家研究中心ATHENE)
专题命中 其他AI编程 :code model(abstract);分类 cs.AI
AI总结 本文首次系统分析状态空间模型(SSM)在代码理解中的学习机制,发现SSM在预训练时比Transformer更有效捕获语法和语义结构,但微调时会遗忘某些关系,并提出SSM-Interpret框架和架构改进,将NLCodeSearch的MRR提升高达6。