期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
基于尺度相关-双向长短期记忆网络模型的说话人识别
1
作者 曹书鑫 冯藤藤 +1 位作者 葛凤培 梁春燕 《计算机工程》 CAS CSCD 北大核心 2023年第4期289-296,共8页
说话人识别通过语音对说话人进行身份认证,然而大部分语音在时域与频域具有分布多样性,目前说话人识别中的卷积神经网络深度学习模型普遍使用单一的卷积核进行特征提取,无法提取尺度相关特征及时频域特征。针对这一问题,提出一种尺度相... 说话人识别通过语音对说话人进行身份认证,然而大部分语音在时域与频域具有分布多样性,目前说话人识别中的卷积神经网络深度学习模型普遍使用单一的卷积核进行特征提取,无法提取尺度相关特征及时频域特征。针对这一问题,提出一种尺度相关卷积神经网络-双向长短期记忆(SCCNN-BiLSTM)网络模型用于说话人识别。通过尺度相关卷积神经网络在每一层特征抽象过程中调整感受野大小,捕获由尺度相关块组成的尺度特征信息,同时引入双向长短期记忆网络保留与学习语音数据的多尺度特征信息,并在最大程度上提取时频域特征的上下文信息。实验结果表明,SCCNN-BiLSTM网络模型在LibriSpeech和AISHELL-1数据集上迭代50000次时的等错率为7.21%和6.55%,相比于ResCNN基线网络模型提升了25.3%和41.0%。 展开更多
关键词 说话人识别 深度学习 尺度相关卷积 感受野 长短期记忆网络
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部