首页 | 本学科首页   官方微博 | 高级检索  
     

基于分割识别的蒙古语语音关键词检测方法的研究
引用本文:飞龙,高光来,闫学亮,王炜华. 基于分割识别的蒙古语语音关键词检测方法的研究[J]. 计算机科学, 2013, 40(9): 208-211
作者姓名:飞龙  高光来  闫学亮  王炜华
作者单位:内蒙古大学计算机学院 呼和浩特010021
基金项目:本文受国家自然科学基金项目(61263037,9);内蒙古自然科学基金重大项目(2011ZD11)资助
摘    要:蒙古文属于黏着语,词根和后缀能够组合成近百万的蒙古文单词.现有的蒙古语大词汇量连续语音识别(LVCSR)系统的发音词典无法包含所有蒙古文单词.同时发音词典较大时,训练语料的稀疏将导致LVCSR系统的性能明显下降.为了解决LVCSR系统中大多数蒙古文单词的识别问题和蒙古语语音关键词检测系统中大量集外词的检测问题,结合蒙古文的构词特点,提出了基于分割识别的蒙古语LVCSR方法,并建立了对应的声学模型和语言模型.最后,将此方法应用到了蒙古语语音关键词检测系统中并在蒙古语语音语料上进行了测试.实验结果表明,基于分割识别的蒙古语LVCSR方法能解决大部分蒙古文单词的识别问题,并将蒙古语语音关键词检测系统的大量集外词转化成了集内词,大幅度提高了检测系统的查准率和召回率.

关 键 词:蒙古语  词干  结尾后缀  关键词检测  集外词  混淆网络
收稿时间:2012-11-17
修稿时间:2013-03-11

Research on Mongolian Spoken Term Detection Method Based on Segmentation Recognition
BAO Fei-long,GAO Guang-lai,YAN Xue-liang and WANG Wei-hua. Research on Mongolian Spoken Term Detection Method Based on Segmentation Recognition[J]. Computer Science, 2013, 40(9): 208-211
Authors:BAO Fei-long  GAO Guang-lai  YAN Xue-liang  WANG Wei-hua
Affiliation:College of Computer Science,Inner Mogonlia University,Hohhot 010021,China;College of Computer Science,Inner Mogonlia University,Hohhot 010021,China;College of Computer Science,Inner Mogonlia University,Hohhot 010021,China;College of Computer Science,Inner Mogonlia University,Hohhot 010021,China
Abstract:
Keywords:Mongolian  Stem  Ending suffix  Spoken term detection  Out-of-vocabulary word  Confusion network
本文献已被 万方数据 等数据库收录!
点击此处可从《计算机科学》浏览原始摘要信息
点击此处可从《计算机科学》下载全文
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号