Computational Safety for Generative AI: A Hypothesis Testing Perspective
生成式AI的计算安全性:假设检验视角
机构 * IBM Research(IBM研究院)
专题命中 越狱攻击 :safety(title,abstract);jailbreak(abstract);AI safety(abstract);分类 cs.AI、cs.LG
AI总结 本文从假设检验角度形式化生成式AI的计算安全性,提出基于信号处理的方法检测恶意输入和AI生成内容。
Comments Extended version of the paper presented at the ICML 2026 Workshop on Hypothesis Testing