CGCE: Classifier-Guided Concept Erasure in Generative Models
CGCE:生成模型中的分类器引导概念擦除
机构 * Johns Hopkins University(约翰霍普金斯大学)
AI总结 研究针对生成模型不安全内容生成的问题,提出分类器引导概念擦除(CGCE)框架。该框架用轻量级分类器检测并细化不良概念提示,仅在推理时修改不安全嵌入,能防止有害内容生成,在安全性和性能间取得平衡,实验验证其有效性。
Comments ECCV 2026