PD-GS: Phoneme-Driven 3DGS for Audio-Driven Talking Heads
PD-GS:音素驱动的3DGS用于音频驱动的说话头生成
机构 * Southeast University(东南大学) ; School of Computer Science and Engineering(计算机科学与工程学院)
专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract)
AI总结 针对3DGS说话头渲染的漏嘴伪影问题,提出PD-GS模型,通过LFM融合音频与音素信息,在HDTF数据集上实现最优嘴唇几何,提升神经化身的语言忠实度。
Comments Accepted to ACM MM 2026