Ex-Omni: Enabling 3D Facial Animation Generation for Omni-modal Large Language Models
Ex-Omni:为全模态大语言模型赋能3D面部动画生成
机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; LIGHTSPEED ; Independent Researcher(独立研究员)
专题命中 多模态生成 :omni-modal(title,abstract);multimodal(abstract);audio-visual(abstract);分类 cs.CV、cs.CL、cs.AI
AI总结 提出Ex-Omni模型,通过混合形状感知语音单元生成器和解码器解耦语义推理与时间生成,并引入统一令牌查询门控融合机制,实现全模态大语言模型同步生成语音和3D面部动画。