Video-guided Machine Translation with Global Video Context
基于全局视频上下文的视频引导机器翻译
机构 * Shenzhen University(深圳大学) ; Shenzhen Technology University(深圳技术大学)
专题命中 长视频与时序推理 :long video(abstract);分类 cs.CV
AI总结 本文提出一种全局视频引导的多模态翻译框架,通过预训练语义编码器和向量数据库实现视频片段与字幕的语义关联,结合注意力机制提升翻译效果,在大规模纪录片数据集上验证了其在长视频场景中的有效性。