Information-Theoretic Limits of Safety Verification for Self-Improving Systems
自我改进系统安全验证的信息论极限
专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI、cs.LG
AI总结 研究安全验证在允许无界有益自修改的同时维持有限累积风险的理论极限,提出双条件并建立其兼容性理论。
Comments 27 pages, 6 figures. Companion empirical paper: doi:10.5281/zenodo.19237566