Recursive Harness Self-Improvement
递归工具自我改进
专题命中 测试时计算 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 研究在模型-工具协同进化中,通过递归工具自我改进(RHI)优化用户构建工具,以提高执行轨迹质量和智能体性能。RHI将工具表示为提示级规范,经成对反馈迭代改进,在多任务中提升了低推理能力智能体性能,降低推理成本。
Comments This work addresses the first half of the model-harness coevolution loop