期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
低数据资源条件下基于优化的数据选择策略的无监督语音识别声学建模 被引量:2
1
作者 钱彦旻 刘加 《清华大学学报(自然科学版)》 EI CAS CSCD 北大核心 2013年第7期1001-1004,1010,共5页
为了克服低数据资源条件下的资源匮乏问题,该文利用无监督的声学模型训练方法来增加训练数据,改善系统性能。在标准的无监督训练框架下,在传统词图后验概率的词置信度基础上,提出了基于句子后验概率的置信度数据筛选准则,所选数据在保... 为了克服低数据资源条件下的资源匮乏问题,该文利用无监督的声学模型训练方法来增加训练数据,改善系统性能。在标准的无监督训练框架下,在传统词图后验概率的词置信度基础上,提出了基于句子后验概率的置信度数据筛选准则,所选数据在保证整句话可靠性的同时很好保留了上下文信息,有利于跨词的三音子声学模型建模;还提出了基于音素覆盖率准则的数据筛选方法,在考虑假设标注句子置信可靠度的同时,尽可能选取训练样本中最为稀疏的音素单元,从源头再次克服低数据资源的困难,数据选择效率更高,性能进一步提升。实验表明:基于本文改进的无监督训练方法的词错误率比基线有监督训练方法的降低约相对8%,比传统无监督方法的也有绝对2%的减少,极大程度改善了低数据资源条件下的系统性能。 展开更多
关键词 语音识别 低数据资源 无监督训练 数据选择
原文传递
上一页 1 下一页 到第
使用帮助 返回顶部