arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-08 至 2026-07-08 共收录 1 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 1 篇

2607.06120 2026-07-08 cs.CV 新提交 83%

AEGIS: A Mechanism-Guided Defense against Visual Synonym Jailbreaks in Text-to-Image Models

AEGIS:一种针对文本到图像模型中视觉同义词越狱的机制引导防御

Yuanmin Huang, Zhenfei Zhang, Mi Zhang, Geng Hong, Qinqin He, Jialing Tao, Hui Xue, Min Yang

机构 * Fudan University(复旦大学) Alibaba Group(阿里巴巴集团) Shanghai Pudong Research Institute of Cryptology(上海浦东密码研究所) Engineering Research Center of Cyber Security Auditing and Monitoring, Ministry of Education(教育部网络安全审计与监测工程研究中心)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 研究针对文本到图像模型中视觉同义词越狱问题,提出AEGIS防御机制,通过动态追踪不安全语义生成过程,利用稀疏语义注入注意力头,在推理时仅对易受攻击头部应用相似性感知排斥,提升了模型安全与效用。

详情

展开后加载摘要…

URL PDF HTML 收藏