Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions
模型参数中的不可检测后门:在高维空间中隐藏稀疏秘密
机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) ; Princeton University(普林斯顿大学)
AI总结 提出Sparse Backdoor供应链攻击,通过注入带高斯抖动的结构化稀疏扰动在预训练图像分类器中植入可证不可检测后门,其检测难度等价于Sparse PCA,可抵御白盒区分。