MaskAttn-SDXL: Controllable Region-Level Text-To-Image Generation
MaskAttn-SDXL:可控区域级文本到图像生成
机构 * University of Southern California(南加州大学) ; University of Toronto(多伦多大学)
专题命中 扩散模型 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 本文提出MaskAttn-SDXL模块,通过在softmax前注入token条件空间门控,解决扩散模型在多物体生成中的全局协调和可靠性问题,无需改变SDXL流程。
Comments Published in the 2026 International Joint Conference on Neural Networks (IJCNN 2026)
Journal ref Proceedings of the 2026 International Joint Conference on Neural Networks (IJCNN 2026)