SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement
SAHOO:递归自我改进中高阶优化目标的安全保障
机构 * MARS 4.0 Fellowship, Cambridge AI Safety Hub(CAISH), University of Cambridge(剑桥大学) ; AWS Generative AI Innovation Center, Amazon Web Services, USA(亚马逊网络服务) ; Google, USA(谷歌) ; Stanford University(斯坦福大学) ; Northeastern University, Seattle, WA, USA(东北大学)
专题命中 幻觉与事实性 :alignment(title,abstract);safety(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 SAHOO通过三种保障措施实现递归自我改进中高阶优化目标的安全保障,显著提升代码生成和推理质量,同时保持约束和事实性。
Comments Published at ICLR 2026 Workshop on AI with Recursive Self-Improvement. 20 pages, 5 figures