首页 | 本学科首页   官方微博 | 高级检索  
     

基于词典和统计相结合的维吾尔语拼写检查方法
引用本文:麦合甫热提,艾山·吾买尔,麦热哈巴·艾力,吐尔根·伊布拉音,张 健.基于词典和统计相结合的维吾尔语拼写检查方法[J].中文信息学报,2014,28(2):66-71.
作者姓名:麦合甫热提  艾山·吾买尔  麦热哈巴·艾力  吐尔根·伊布拉音  张 健
作者单位:1. 新疆大学 教务处,新疆 乌鲁木齐 830046;
2. 新疆大学 信息科学与工程学院,新疆 乌鲁木齐 830046;
3. 新疆虹联软件责任公司,新疆 乌鲁木齐 830002
基金项目:国家重点基础研究计划973(2011211B07);国家自然科学基金(61262060,61063043);国家创新基金(10C26226505485);国家自然科学基金(61063026);国家社会科学基金重点项目(10AYY006)
摘    要:该文通过研究国内外相关的拼写错误查错和纠错方法的理论,再结合维吾尔语自身的特点,提出了基于词典和统计相结合的维吾尔语拼写查错方法。首先,提出基于词典的方法进行词库和词干提取的拼写检查;其次,提出基于N元语法的词缀连接有效性判断模型,对未登录词提出基于N元语法的拼写检查模型;最后,结合以上几种方法各自的优点提出基于混合策略的拼写检查方法,该方法在准确性和检查结果可靠性等方面得到了较显著的提高。

关 键 词:维吾尔语  拼写检查  词典  N元语法  

Spelling Check Method of Uyghur Languages Based on Dictionary and Statistics
Maihefureti,Aishan Wumaier,Maierhaba Aili,Tuergen Yibulayin,ZHANG Jian.Spelling Check Method of Uyghur Languages Based on Dictionary and Statistics[J].Journal of Chinese Information Processing,2014,28(2):66-71.
Authors:Maihefureti  Aishan Wumaier  Maierhaba Aili  Tuergen Yibulayin  ZHANG Jian
Affiliation:1. Teaching affairs department, Xinjiang University, Urumqi, Xinjiang 830046, China;
2. College of Information Science & Engineering, Xinjiang University, Urumqi, Xinjiang 830046, China;
3. Xinjiang Honglian Software Co., Ltd, Urumqi, Xinjiang 830002, China
Abstract:In this paper, we present spelling check method of Uyghur Languages based on a combination of dictionary and statistics. Firstly, we describe a stemming method based on the dictionary. Secondly, we proposed N-gram-based model to judge the suffix to a stem, detecting the misspelling unknown words at the same time. Finally, we present a spelling check method based a hybrid strategy of combining different methods. This method achieves improvements in accuracy, reliability, and so on.
Keywords:Uyghur Language  spelling check  dictionary  N-gram  
本文献已被 CNKI 等数据库收录!
点击此处可从《中文信息学报》浏览原始摘要信息
点击此处可从《中文信息学报》下载全文
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号