来源:期刊VIP网 时间:
作者:张珑;张恒远;魏育华;杨烁祯;
单位:天津师范大学计算机与信息工程学院;广州华立科技职业学院计算机信息工程学院;
摘要:多声音事件检测是当前语音处理的研究热点之一,本文对近年来基于深度学习的多声音事件检测模型进行综述.首先介绍了4种监督学习模型和13种弱监督学习模型,弱监督学习模型包括基于平均教师的模型、基于注意力的模型、基于源分离的模型、基于自训练的模型以及其他模型,分析了各模型的特征、结构和性能;然后对各种模型使用的数据集及评价指标进行简要介绍;最后讨论了该领域未来的研究方向.
关键词:深度学习;;多声音事件检测;;弱监督学习;;半监督学习
基金资助:国家自然科学基金面上资助项目(61771173);; 天津市自然科学基金重点资助项目(20JCZDJC00400);; 天津市研究生科研创新资助项目(2022SKYZ279)