Archon: A Unified Multimodal Model for Holistic Digital Human Generation
Archon:面向整体数字人生成的统一多模态模型
机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD与CG国家重点实验室) ; Google(谷歌) ; Google DeepMind(谷歌DeepMind)
AI总结 提出Archon,一个完全预训练的以人为中心的统一多模态模型,通过模态特定分词器、语义视频重参数化和“模态思维”策略,实现文本、音频、动作和视觉等七种模态的整体数字人生成。
Comments Accepted to CVPR 2026. Project Page: https://zju3dv.github.io/archon/