StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval
StructAlign:结构化跨模态对齐用于连续文本到视频检索
机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) ; Xi’an Jiaotong University(西安交通大学) ; Shandong University(山东大学)
专题命中 视频生成 :text-to-video(title,abstract);分类 cs.CV
AI总结 本文提出StructAlign,通过结构化跨模态对齐方法解决连续文本到视频检索中的模态错位和特征漂移问题,提升模型持续学习能力。