A New Method to Capturing Compositional Knowledge in Linguistic Space
一种在语言空间中捕获组合知识的新方法
机构 * School of Computer Science(计算机科学学院) ; South-Central Minzu University(西南民族大学)
专题命中 VLM训练与架构 :visual language model(abstract);分类 cs.CV
AI总结 提出YUKINO方法,通过文本反转和“no”逻辑正则化,在无需硬负样本的情况下提升视觉语言模型的组合理解能力,在SugarCREPE基准上超越现有多模态SOTA模型8%以上。
Journal ref Neurocomputing, 2026: 133150