CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook
CodeBind: 一种用于多模态对齐的解耦表示学习框架
机构 * Visual AI Lab, The University of Hong Kong(视觉人工智能实验室,香港大学)
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CL、cs.AI
AI总结 CodeBind通过统一的组合代码本设计优化多模态表示空间,解决了传统方法在跨模态信息差异和数据稀缺导致的对齐空间不足问题,实现了多模态分类和检索任务中的最佳性能。
Comments ACL 2026 Findings; Project page: https://visual-ai.github.io/codebind