arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-02 至 2026-07-02 共收录 6 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 软件智能体 6 篇

2607.00038 2026-07-02 cs.SE 新提交 79%

Stop Hand-Holding Your Coding Agent: Engineering the Loops that Replace Step-by-Step Prompting

停止手把手指导你的编码智能体:设计替代逐步提示的循环机制

Sandeco Macedo

专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE

AI总结 本文提出循环规范作为替代逐步提示的编码智能体新范式,定义其结构、分类与设计原则,并通过真实语料分析验证其成熟度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00016 2026-07-02 cs.IR cs.AI 新提交 70%

Libra: Training the Environment for Agentic Information Retrieval

Libra: 为智能信息检索训练环境

Xuan Zhao, Andy Chiu, Gengyu Wang

专题命中 软件智能体 :repository(abstract);coding agent(abstract);分类 cs.AI

AI总结 提出Libra框架,通过引入可变目录和LLM驱动优化循环,自动改进代码仓库的索引结构,提升代码定位准确率,并实现跨模型和问题的零样本迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12415 2026-07-02 cs.SE 版本更新 70%

SWE-Perf: Can Language Models Optimize Code Performance on Real-World Repositories?

SWE-Perf:语言模型能否优化真实仓库中的代码性能?

Xinyi He, Qian Liu, Mingzhe Du, Lin Yan, Zhijie Fan, Yiming Huang, Yin Zheng, Zejian Yuan, Zejun Ma

专题命中 软件智能体 :code generation(abstract);repository(abstract);分类 cs.SE

AI总结 提出SWE-Perf基准,用于系统评估LLM在真实仓库中的代码性能优化能力,通过140个实例评估发现现有模型与专家水平存在显著差距。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00334 2026-07-02 cs.AI 新提交 57%

Managed Autonomy at Runtime: Gear-Based Safety and Governance for Single- and Multi-Agent Cyber-Physical Systems

运行时管理自主性:基于档位的单/多智能体信息物理系统安全与治理

Srini Ramaswamy, Wang Miaosheng

机构 * DNRS.ai, USA

专题命中 软件智能体 :software agent(abstract);分类 cs.AI

AI总结 提出一种离散时间控制系统,通过五个执行档位和效用门控调度,在单智能体场景中证明单调稳定性、执行安全性和最终稳定,在多智能体CPS中结合治理状态实现分布式安全保证,在UR5机器人装配单元上达到99.6%异常检测率。

Comments to be submitted to a Journal, 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00155 2026-07-02 cs.AI cs.GT 新提交 57%

A Contextual-Bandit Oversight Game with Two-Sided Informational Asymmetry

具有双边信息不对称的情境赌博机监督博弈

Yunjin Tong

机构 * Stanford Graduate School of Business(斯坦福商学院)

专题命中 软件智能体 :software agent(abstract);分类 cs.AI

AI总结 研究AI代理运行时人类监督中的双边信息不对称问题,提出情境赌博机团队博弈模型,刻画了团队最优与短视规则之间的可避免伤害差距,并分析了动态学习与信号传递机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00245 2026-07-02 q-fin.GN 新提交 50%

Agent-to-Agent Finance: Blockchain Payments and Trust Infrastructure for Autonomous AI Agents

代理间金融:面向自主AI代理的区块链支付与信任基础设施

Hui Gong

专题命中 软件智能体 :software agent(abstract)

AI总结 本文提出代理间金融概念,利用区块链可编程结算、智能钱包、去中心化注册表和可验证计算解决自主AI代理在身份、授权、支付、验证、声誉和问责方面的协调摩擦,强调有限自主权设计。

Comments 22 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏