Dynamic Context Adapters: Efficiently Infusing History into Vision-and-Language Models
动态上下文适配器:将历史信息高效注入视觉-语言模型
机构 * University of Liverpool(利物浦大学) ; National Tsinghua University(国立清华大学) ; Imperial College London(伦敦帝国学院) ; National Taiwan University(国立台湾大学)
专题命中 VLM训练与架构 :vision-language model(abstract);分类 cs.CV、cs.AI
AI总结 针对视觉-语言模型整合历史上下文时的计算与信息损失问题,提出动态上下文适配器(DCA),实现高效历史注入,降低注意力FLOPs超25%、内存13%,提升长时序任务性能。