STARCaster: Spatio-Temporal AutoRegressive Video Diffusion for Identity- and View-Aware Talking Portraits
STARCaster:用于身份和视图感知的会说话肖像的时空自回归视频扩散
机构 * Imperial College London, UK(伦敦帝国理工学院) ; FAU Erlangen–Nürnberg, Germany(埃朗根-纽伦堡大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 研究提出STARCaster模型,通过重新思考参考和几何范式,采用组合方法及解耦学习,解决语音驱动肖像动画和动态视点控制问题,能有效泛化,超越先前方法。
Comments ICML 2026