来源:期刊VIP网 时间:
作者:杨兴耀;肖瑞;卢进堂;
单位:新疆大学软件学院;
摘要:针对带有维吾尔语口音的普通话朗读短文的语音识别效果不理想的问题,本文建立了一个维吾尔语口音的普通话朗读短文语音数据集CH_ESSAY_SET.通过在该自建数据集和公开数据集Aishell_1和WenetSpeech以及科大讯飞、百度、腾讯、云知声等语音识别接口上的进行对比.实验表明,基于自建数据集训练的端到端声学模型对维吾尔语口音的普通话短文的语音识别精度相比,所提公开数据集和语音识别接口的识别准确率均有明显的提高,验证了自建数据集的有效性.并提出基于迁移学习的多语种任务训练进行特征迁移以及基于WeNet框架的预训练系统的优化方法.实验表明,所提优化方法相比于基线系统的语音识别精度提高了8.9%,达到了7.5%的字错误识别率.
关键词:语音识别;;维吾尔语口音;;端到端;;语料库建设
基金资助:新疆维吾尔自治区自然科学基金面上项目(2023D01C17);; 新疆维吾尔自治区教育厅项目(XJEDU2016S035);; 新疆大学博士科研启动基金资助项目(BS150257)