Probing and Leveraging Video Diffusion Transformer Features for Robust Point Tracking
探查并利用视频扩散变换器特征以实现稳健的点跟踪
机构 * KAIST AI(韩国科学技术院人工智能) ; Google DeepMind(谷歌DeepMind)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 本文探讨了视频扩散变换器在点跟踪中的优势,提出DiTracker框架,通过整合视频DiT特征提升跟踪鲁棒性,实验证明其在挑战性场景下表现优异。
Comments Project Page: https://cvlab-kaist.github.io/DiTracker/