位置:成果数据库 > 期刊 > 期刊详情页
基于词典和统计相结合的维吾尔语拼写检查方法
  • ISSN号:1003-0077
  • 期刊名称:中文信息学报
  • 时间:0
  • 页码:-
  • 分类:TP391[自动化与计算机技术—计算机应用技术;自动化与计算机技术—计算机科学与技术]
  • 作者机构:[1]新疆大学教务处,新疆乌鲁木齐830046, [2]新疆大学信息科学与工程学院,新疆乌鲁木齐830046, [3]新疆虹联软件责任公司,新疆乌鲁木齐830002
  • 相关基金:国家重点基础研究计划973(2011211B07);国家自然科学基金(61262060,61063043);国家创新基金(10C26226505485);国家自然科学基金(61063026);国家社会科学基金重点项目(10AYY006).
  • 相关项目:维吾尔文不良信息过滤关键技术的研究
中文摘要:

该文通过研究国内外相关的拼写错误查错和纠错方法的理论,再结合维吾尔语自身的特点,提出了基于词典和统计相结合的维吾尔语拼写查错方法.首先,提出基于词典的方法进行词库和词干提取的拼写检查;其次,提出基于N元语法的词缀连接有效性判断模型,对未登录词提出基于N元语法的拼写检查模型;最后,结合以上几种方法各自的优点提出基于混合策略的拼写检查方法,该方法在准确性和检查结果可靠性等方面得到了较显著的提高.

英文摘要:

In this paper, we present spelling check method of Uyghur Languages based on a combination of dictiona- ry and statistics. Firstly, we describe a stemming method based on the dictionary. Secondly, we proposed N-gram- based model to judge the suffix to a stem, detecting the misspelling unknown words at the same time. Finally, we present a spelling check method based a hybrid strategy of combining different methods. This method achieves im- provements in accuracy, reliability, and so on.

同期刊论文项目
同项目期刊论文
期刊信息
  • 《中文信息学报》
  • 北大核心期刊(2011版)
  • 主管单位:中国科学技术协会
  • 主办单位:中国中文信息学会 中国科学院软件研究所
  • 主编:孙茂松
  • 地址:北京海淀中关村南四街4号中科院软件所
  • 邮编:100190
  • 邮箱:jcip@iscas.ac.cn
  • 电话:010-62562916
  • 国际标准刊号:ISSN:1003-0077
  • 国内统一刊号:ISSN:11-2325/N
  • 邮发代号:
  • 获奖情况:
  • 国内外数据库收录:
  • 日本日本科学技术振兴机构数据库,中国中国科技核心期刊,中国北大核心期刊(2004版),中国北大核心期刊(2008版),中国北大核心期刊(2011版),中国北大核心期刊(2014版),中国北大核心期刊(2000版)
  • 被引量:9136