$PC^2$: Politically Controversial Content Generation via Jailbreaking Attacks on GPT-based Text-to-Image Models
$PC^2$:通过基于GPT的文本到图像模型的越狱攻击生成政治争议内容
专题命中 越狱攻击 :safety(abstract)
AI总结 提出首个黑盒政治越狱框架$PC^2$,利用身份保留描述映射和地缘政治远距离翻译绕过安全过滤器,在GPT系列模型上实现高达86%的攻击成功率。
Comments To appear in the 33rd ACM Conference on Computer and Communications Security (CCS 2026)