Stop Hand-Holding Your Coding Agent: Engineering the Loops that Replace Step-by-Step Prompting
停止手把手指导你的编码智能体:设计替代逐步提示的循环机制
专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE
AI总结 本文提出循环规范作为替代逐步提示的编码智能体新范式,定义其结构、分类与设计原则,并通过真实语料分析验证其成熟度。
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
停止手把手指导你的编码智能体:设计替代逐步提示的循环机制
专题命中 软件智能体 :coding agent(title,abstract);分类 cs.SE
AI总结 本文提出循环规范作为替代逐步提示的编码智能体新范式,定义其结构、分类与设计原则,并通过真实语料分析验证其成熟度。
Libra: 为智能信息检索训练环境
专题命中 软件智能体 :repository(abstract);coding agent(abstract);分类 cs.AI
AI总结 提出Libra框架,通过引入可变目录和LLM驱动优化循环,自动改进代码仓库的索引结构,提升代码定位准确率,并实现跨模型和问题的零样本迁移。
SWE-Perf:语言模型能否优化真实仓库中的代码性能?
专题命中 软件智能体 :code generation(abstract);repository(abstract);分类 cs.SE
AI总结 提出SWE-Perf基准,用于系统评估LLM在真实仓库中的代码性能优化能力,通过140个实例评估发现现有模型与专家水平存在显著差距。
Comments Accepted by ICML 2026
运行时管理自主性:基于档位的单/多智能体信息物理系统安全与治理
机构 * DNRS.ai, USA
专题命中 软件智能体 :software agent(abstract);分类 cs.AI
AI总结 提出一种离散时间控制系统,通过五个执行档位和效用门控调度,在单智能体场景中证明单调稳定性、执行安全性和最终稳定,在多智能体CPS中结合治理状态实现分布式安全保证,在UR5机器人装配单元上达到99.6%异常检测率。
Comments to be submitted to a Journal, 18 pages
具有双边信息不对称的情境赌博机监督博弈
机构 * Stanford Graduate School of Business(斯坦福商学院)
专题命中 软件智能体 :software agent(abstract);分类 cs.AI
AI总结 研究AI代理运行时人类监督中的双边信息不对称问题,提出情境赌博机团队博弈模型,刻画了团队最优与短视规则之间的可避免伤害差距,并分析了动态学习与信号传递机制。
代理间金融:面向自主AI代理的区块链支付与信任基础设施
专题命中 软件智能体 :software agent(abstract)
AI总结 本文提出代理间金融概念,利用区块链可编程结算、智能钱包、去中心化注册表和可验证计算解决自主AI代理在身份、授权、支付、验证、声誉和问责方面的协调摩擦,强调有限自主权设计。
Comments 22 pages, 3 figures, 4 tables