Logographic Character Visual Pretraining via Semantic-based Contrastive Learning
基于语义对比学习的表意文字视觉预训练
机构 * Queen Mary University of London(伦敦玛丽女王大学) ; Jilin University(吉林大学) ; King’s College London(伦敦国王学院) ; University College London(伦敦大学学院)
专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV、cs.AI
AI总结 针对表意文字数据集不平衡问题,提出结合视觉与上下文语义的多模态学习方法,通过语义对比预训练提升字符识别性能,在多数据集及下游任务上优于现有最优方法。
Comments ACM MM 2026 paper