音源特征用于提高话者确认系统的鲁棒性被引量：2

Integrating sound source features for robust speaker verification

下载PDF

导出

摘要给出了一种采用音源特征信息提高以声道倒谱参数为特征的话者确认系统噪声鲁棒性的方法,提取了两类音源特征参数:短时(单帧)特征参数和较长时(多帧)特征参数,并分别构建了两个利用音源特征参数的与文本无关的话者确认辅助子系统.采用线性加权对主、辅子系统的输出进行融合.在NIST’03数据库上100个男性话者的对比实验表明,音源特征参数具有良好的噪声鲁棒性,声道特征与音源特征具有较强的互补性,尤其是在较强的噪声背景下,利用音源特征可以有效地提高以声道倒谱参数为特征的确认系统的鲁棒性. Two approaches that use the Pitch and Energy of sound source to improve the performance of speaker verification were presented. The first approach extracted speaker-dependent features of the sound source by short-term analysis. The second approach captured the Pitch and Energy dynamics by taking into account the statistics of multi-frames. For each feature, a model was established by means of GMM-UBM, and then the weighted linear sum of scores from each model was computed as the fusion score. Experiments conducted on the NIST＇03 database show that sound source features have a complementary effect on MFCC. Further more, these features are more robust than MFCC and can greatly improve robustness in noisy environments.

作者吴礼福姚志强戴蓓蒨李辉

机构地区中国科学技术大学电子科学与技术系

出处《中国科学技术大学学报》 CAS CSCD 北大核心 2006年第5期476-480,共5页 JUSTC

基金国家自然科学基金(60272039)资助

关键词音源特征话者确认噪声鲁棒性高斯混合模型-背景模型 sound source speaker verification noise robustness GMM-UBM

分类号 TN912.34 [电子电信—通信与信息系统]

引文网络
相关文献

参考文献9

1Reynolds D A,Quatieri T F,Dunn R B.Speaker verification using adapted Gaussian mixture models[J].Digital Signal Processing,2000,10(1):19-41.
2Rabiner L R,Juang B H.Fundamentals of Speech Recognition[M].PTR,America:Prentice Hall,1993:11-65.
3Carey M J,Parris E S,Lloyd-Thomas H,et al.Robust prosodic features for speaker identification[C]//Proc.ICSLP'96,Philadelphia:1996,3:1 800-1 803.
4Sonmez M K,Heck L,Weintraub M,et al.A lognormal tied mixture model of pitch for prosodybased speaker recognition[C] // Proc.Eurospeech'97,Rhodes,Greece:1997,3:1 391-1 394.
5Sonmez K,Shriberg E,Heck L,et al.Modeling dynamic prosodic variation for speaker verification[C]//Proc.ICSLP'98,Sydney:1998,7:3 189-3 192.
6Weber F,Manganaro L,Peskin B,et al.Using prosodic and lexical information for speaker identification[C]//Proc.ICASSP 02,Orlando:2002,1:141-144.
7Reynolds D A,Andrews W,Campbell J,et al.The superSID project:exploiting high-level information for high-accuracy speaker recognition[C] // Proc.ICASSP-03,Hong Kong:IEEE Press,2003,4:784-787.
8Atal B S.Automatic speaker recognition based on pitch contours[J].JASA,1972,52(6):1 687-1 697.
9Adami A G,Mihaescu R,Reynolds DA,et al.Modeling prosodic dynamics for speaker recognition[C]//Proc.ICASSP-03,Hong Kong:IEEE Press,2003:788-791.

同被引文献4

1王鹏,胡郁,戴礼荣,刘庆峰.加入调型信息的汉语孤立词识别研究[J].中文信息学报,2010,24(4):85-90. 被引量：1
2栗志意,何亮,张卫强,刘加.基于鉴别性i-vector局部距离保持映射的说话人识别[J].清华大学学报（自然科学版）,2012,52(5):598-601. 被引量：11
3方昕,李辉,刘青松.利用i-vectors构建区分性话者模型的话者确认[J].小型微型计算机系统,2014,35(3):685-688. 被引量：3
4花城,李辉.使用阈值提升基频特征对话者确认的补偿性能[J].小型微型计算机系统,2014,35(4):869-871. 被引量：1

引证文献2

1花城,李辉.使用阈值提升基频特征对话者确认的补偿性能[J].小型微型计算机系统,2014,35(4):869-871. 被引量：1
2琚炜,李锐,李辉.使用置信区间的基频特征对Ⅰ-Vector系统的性能补偿[J].小型微型计算机系统,2016,37(7):1629-1632.

二级引证文献1

1琚炜,李锐,李辉.使用置信区间的基频特征对Ⅰ-Vector系统的性能补偿[J].小型微型计算机系统,2016,37(7):1629-1632.

1解焱陆,吴礼福,戴蓓蒨,李辉.基于SVM评分融合的分类短语音话者确认系统[J].数据采集与处理,2005,20(2):213-217.
2张保轩,王连军,田岚.基于PC机的汉语话者确认系统[J].山东电子,1995(3):16-17.
3戴葵,陈晖.基站天线馈线系统的测试方法[J].国外电子测量技术,1998,17(4):12-15.
4吴礼福,解焱陆,戴蓓蒨,李辉.基于CGMM-UBM的电话短语音说话人确认[J].电路与系统学报,2007,12(5):131-136. 被引量：2
5李勃,杨腾祥,胡建华,赵琳.智能卡话者确认系统的研究[J].昆明理工大学学报（理工版）,1999,24(2):12-17.
6黄伟,戴蓓蒨.基于GMM统计特性参数和SVM的话者确认[J].数据采集与处理,2004,19(4):365-370. 被引量：5
7陈雁翔,戴蓓倩,周曦,李辉.基于对话语音的与文本无关的说话人确认系统的研究[J].中文信息学报,2004,18(2):36-43. 被引量：4
8李霄寒,戴蓓倩,方绍武,刘鸣.基于子带HMM和MLP的话者确认系统的噪声鲁棒性研究[J].电路与系统学报,2002,7(2):72-76. 被引量：1
9马继涌,高文.基于快速DGMM的随机提示文本的话者确认系统[J].计算机学报,1999,22(11):1127-1132.
10吴德辉,李辉,刘青松,戴蓓蒨.基于因子分析信道失配补偿的SVM话者确认方法[J].模式识别与人工智能,2010,23(1):59-64. 被引量：2

中国科学技术大学学报

2006年第5期

浏览历史

内容加载中请稍等...

音源特征用于提高话者确认系统的鲁棒性被引量：2

参考文献9

同被引文献4

引证文献2

二级引证文献1

相关作者

相关机构

相关主题

浏览历史

音源特征用于提高话者确认系统的鲁棒性 被引量：2

参考文献9

同被引文献4

引证文献2

二级引证文献1

相关作者

相关机构

相关主题

浏览历史

音源特征用于提高话者确认系统的鲁棒性被引量：2