UniAVGen: Unified Audio and Video Generation with Asymmetric Cross-Modal Interactions
UniAVGen:基于非对称跨模态交互的统一音频视频生成
机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) ; Tencent Hunyuan(腾讯文英) ; Shanghai Jiao Tong University(上海交通大学) ; Renmin University of China(中国人民大学) ; Tsinghua University(清华大学) ; Shanghai AI Lab(上海人工智能实验室)
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV
AI总结 UniAVGen通过非对称跨模态交互机制和双分支联合合成架构,实现了音频视频的统一生成,提升同步精度和语义一致性,实验表明其在较少训练样本下表现更优。
Comments CVPR 2026