[01920632]一种蒙古文自动校正方法
交易价格:
面议
所属行业:
类型:
发明专利
技术成熟度:
正在研发
专利所属地:中国
专利号:CN201610706212.0
交易方式:
技术转让
联系人:
所在地:内蒙古自治区呼和浩特市
- 服务承诺
- 产权明晰
-
资料保密
对所交付的所有资料进行保密
- 如实描述
技术详细介绍
本发明公开了一种蒙古文自动校正方法,属于语言校正技术领域,首先对输入的蒙古文文本进行预处理、中间码转换,并对中间码进行词干词缀切分判断该词是否是集内词;然后对集内词进行基于词典和规则的方法进行校正,对未登录词不做处理原样输出;对转换后的同形多音词采用语言模型选择最优转换结果输出,对转换后的同形单音词直接输出;最后将集内词和未登录词的校正结果合并,即得到校正完成的文本。采用中间码将文本中所有显现形式相同但编码不同的蒙古文单词进行统一表示,采用基于词典和规则的方法对集内词进行校正,解决了现有技术中人工统计错误输入方式容易出错,且存在很大局限性的问题。
本发明公开了一种蒙古文自动校正方法,属于语言校正技术领域,首先对输入的蒙古文文本进行预处理、中间码转换,并对中间码进行词干词缀切分判断该词是否是集内词;然后对集内词进行基于词典和规则的方法进行校正,对未登录词不做处理原样输出;对转换后的同形多音词采用语言模型选择最优转换结果输出,对转换后的同形单音词直接输出;最后将集内词和未登录词的校正结果合并,即得到校正完成的文本。采用中间码将文本中所有显现形式相同但编码不同的蒙古文单词进行统一表示,采用基于词典和规则的方法对集内词进行校正,解决了现有技术中人工统计错误输入方式容易出错,且存在很大局限性的问题。