摘要
该文通过研究国内外相关的拼写错误查错和纠错方法的理论,再结合维吾尔语自身的特点,提出了基于词典和统计相结合的维吾尔语拼写查错方法。首先,提出基于词典的方法进行词库和词干提取的拼写检查;其次,提出基于N元语法的词缀连接有效性判断模型,对未登录词提出基于N元语法的拼写检查模型;最后,结合以上几种方法各自的优点提出基于混合策略的拼写检查方法,该方法在准确性和检查结果可靠性等方面得到了较显著的提高。
In this paper, we present spelling check method of Uyghur Languages based on a combination of dictiona- ry and statistics. Firstly, we describe a stemming method based on the dictionary. Secondly, we proposed N-gram- based model to judge the suffix to a stem, detecting the misspelling unknown words at the same time. Finally, we present a spelling check method based a hybrid strategy of combining different methods. This method achieves im- provements in accuracy, reliability, and so on.
出处
《中文信息学报》
CSCD
北大核心
2014年第2期66-71,共6页
Journal of Chinese Information Processing
基金
国家重点基础研究计划973(2011211B07)
国家自然科学基金(61262060
61063043)
国家自然科学基金(61063026)
国家创新基金(10C26226505485)
国家社会科学基金重点项目(10AYY006)
关键词
维吾尔语
拼写检查
词典
N元语法
Uyghur Language
spelling check
dictionary
N-gram