低数据资源条件下基于优化的数据选择策略的无监督语音识别声学建模
为了克服低数据资源条件下的资源匮乏问题,该文利用无监督的声学模型训练方法来增加训练数据,改善系统性能.在标准的无监督训练框架下,在传统词图后验概率的词置信度基础上,提出了基于句子后验概率的置信度数据筛选准则,所选数据在保证整句话可靠性的同时很好保留了上下文信息,有利于跨词的三音子声学模型建模;还提出了基于音素覆盖率准则的数据筛选方法,在考虑假设标注句子置信可靠度的同时,尽可能选取训练样本中最为稀疏的音素单元,从源头再次克服低数据资源的困难,数据选择效率更高,性能进一步提升.实验表明:基于本文改进的无监督训练方法的词错误率比基线有监督训练方法的降低约相对8%,比传统无监督方法的也有绝对2%的减少,极大程度改善了低数据资源条件下的系统性能.
语音识别、低数据资源、无监督训练、数据选择
53
TN912.3
国家自然科学基金资助项目60931160443,61273268,90920302;国家科技支撑计划项目2009BAH41B01
2013-11-18(万方平台首次上网日期,不代表论文的发表时间)
共5页
1001-1004,1010