A Dialectal Chinese Speech Recognition Framework
摘要
为方言的汉语语音识别的一个框架被建议并且学习,在哪个相对小的方言的中国人(或换句话说,汉语由本国的方言影响了)讲话语料库和方言相关的知识被采用转变标准中国人( orPutonghua ,作为 PTH 缩短了)语音识别器进一个方言的中国语音识别器。知识源的 Twokinds 被探索:一个人是专家知识,其它是一个小方言的中国语料库。这些知识源在四个层次提供信息:语音的水平,词典水平,语言级别,和声学的解码器水平。这篇论文作为一种例子目标语言花吴方言的汉语(WDC ) 。目标是基于中国语言的起始期末考试的结构和方言的中国扬声器怎么说的研究从一个存在 PTHspeech 识别器建立一个 WDC 语音识别器 Putonghua。作者建议使用上下文无关的 PTH-IFmappings (在哪儿如果也意味着起始的中国人或中国期末考试),上下文无关的 WDC-IFmappings ,和音节依赖者 WDC --如果地图砰(从专家或数据获得了),并且把他们与监督最大似然线性回归( MLLR )相结合声学的模型改编方法。为了减少多发音词典的尺寸,由 IF 地图砰介绍了,它可能也扩大词典混乱并且因此导致性能退化,基于积累的 uni 克,概率(AUP ) 被建议的 aMulti 发音扩大(MPE ) 方法。另外,一些通常使用的 WDC 词被选择并且增加了词典。Comparedwith 原来的 PTH 语音识别器,产生 WDC 语音识别器完成 10-18%absolute 字符出错率(CER ) 减小当认出 WDC 时,当认出 PTH 时,与仅仅 0.62% CER 增加。建议框架和方法被期望不仅为 Wudialectal 汉语而且为另外的方言的中国语言甚至另外的语言工作。
引用本文(GB/T 7714)
李净, 郑方, William William, 等. A Dialectal Chinese Speech Recognition Framework[J]. Acta Scientiarum Naturalium Universitatis Sunyatseni, 2006.
引文网络
本站仅收录题录与摘要供学习参考,全文版权归属出版方;如有侵权请联系我们删除。