Static and Dynamic Graph Alignment Network for Temporal Video Grounding
静态与动态图对齐网络用于时序视频定位
机构 * Faculty of Electronic Engineering and Computer Science, Ningbo University(宁波大学电子工程与计算机科学学院) ; College of Computer Science, Inner Mongolia University(内蒙古大学计算机学院) ; College of Computing and Engineering, Hunan Normal University(湖南师范大学计算机与工程学院) ; Faculty of Computing, Georg-August-Universität Göttingen(哥廷根大学计算机学院) ; Center for Artificial Intelligence, Mathematical and Data Science, Nagoya University(名古屋大学人工智能、数学与数据科学中心)
专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV
AI总结 本文提出SDGAN,通过联合静态和动态视觉特征构建互补的时序图,引入查询-片段对比学习和自适应图建模,结合多粒度时间提案和渐进易难训练策略,提升时序视频定位的性能。