THFM: A Unified Video Foundation Model for 4D Human Perception and Beyond
THFM:一种用于4D人体感知及更广泛领域的统一视频基础模型
专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV
AI总结 THFM是一种统一的视频基础模型,能够同时处理密集任务和稀疏任务,其基于预训练的文本到视频扩散模型,并通过可学习的标记增强稀疏预测能力,且在合成数据上表现优异。