SeFi-Image: A Text-to-Image Foundation Model with Semantic-First Diffusion
SeFi-Image: 一种基于语义优先扩散的文本到图像基础模型
机构 * SeFi Team(SeFi 团队)
专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV
AI总结 提出SeFi-Image,一种基于语义优先扩散的文本到图像基础模型,在1B、2B和5B参数规模上训练,仅用125K A800 GPU小时(约Z-Image的10-20%计算量)即达到与Qwen-Image和Z-Image相当或更优的性能,并在多个基准测试中表现优异。