WavCube: Unifying Speech Representation for Understanding and Generation via Semantic-Acoustic Joint Modeling
WavCube:通过语义-声音联合建模统一语音表示以实现理解和生成
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai Innovation Institute(上海创新研究院) ; Tencent(腾讯) ; Independent Researcher(独立研究员) ; Peking University(北京大学) ; Tianjin University(天津大学) ; Zhejiang University(浙江大学)
AI总结 WavCube通过语义-声音联合建模统一语音表示,解决语音理解和生成的表示兼容问题,实现压缩后的高性能语音任务表现。