RankT2I: A Submodular Framework for Discovering Interpretable and Diverse Semantics in Text-to-Image Models
RankT2I:一种用于发现文本到图像模型中可解释且多样化语义的子模框架
机构 * Virginia Tech(弗吉尼亚理工大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV
AI总结 本文提出无训练、模型无关的RankT2I框架,通过子模方法自动发现T2I模型的可编辑语义,性能优于现有方法,可高效获取多领域文本到图像编辑所需的多样化语义。
Comments ECCV 2026