Elderly-Contextual Data Augmentation via Speech Synthesis for Elderly ASR
通过语音合成进行老年人语境数据增强用于老年人ASR
机构 * Department of Computer Science and Artificial Intelligence, Dongguk University(计算机科学与人工智能系,东国大学) ; Department of Biostatistics, Harvard University(生物统计学系,哈佛大学)
专题命中 预训练与数据 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本文通过结合大语言模型和语音合成技术,解决老年人ASR数据稀缺问题,实验表明方法有效降低WER达58.2%。
Comments 5 pages, 2 figures, under review at IEEE Signal Processing Letters