您当前的位置:首页 > 论文浏览
您选择的条件: 吕雅娟(3)

1. chinaXiv:201703.00230 [pdf]

藏文分词及其在藏汉机器翻译中的应用

孙萌; 华却才让; 姜文斌; 吕雅娟; 刘群
分类: 计算机科学 >> 自然语言理解与机器翻译

本文提出一种基于判别式模型的藏文分词方法,并研究了藏文分词在藏汉机器翻译中的应用。根据藏文构词特性,通过最小构词粒度切分、感知机解码和分词结果重排序三个模块,显著提升了藏文分词质量。在此基础上,我们还提出了基于词图的藏汉机器翻译方法,缓解了分词错误在翻译中的传播,可以使翻译质量明显提高。

提交时间: 2017-03-10 点击量1230下载量1012 评论 0

2. chinaXiv:201703.00228 [pdf]

面向形态丰富语言的翻译规则选择方法

王志洋; 吕雅娟; 孙萌; 姜文斌; 刘群
分类: 计算机科学 >> 自然语言理解与机器翻译

目前的机器翻译模型都是针对形态变化简单的语言(如英语)设计的,不太适合于形态丰富语言(如维吾尔语)。在本文中,我们通过区别对待形态丰富语言中的词干与词缀,提出了一种新型的面向形态丰富语言的翻译规则选择方法。我们用词干作为基本翻译单元以缓解数据稀疏问题,此外,每条词干粒度的翻译规则上还附着一个词缀分布。在翻译时,通过计算待翻译片段的词缀分布与翻译规则词缀分布的相似度,来选择更合适的翻译规则。从三种形态丰富语言(维吾尔语、哈萨克语、柯尔克孜语)到汉语的翻译实验表明,该方法显著改善了翻译质量。

提交时间: 2017-03-10 点击量963下载量772 评论 0

3. chinaXiv:201703.00187 [pdf]

中科院计算所的少数民族语言机器翻译研究进展

吕雅娟; 刘群; 姜文斌
分类: 计算机科学 >> 自然语言理解与机器翻译

本文分析了少数民族语言机器翻译研究的背景、研究现状和发展动态,介绍了中科院计算所在少数民族语言处理和机器翻译方面的研究进展,包括维吾尔语、蒙古语、藏语的语言处理基础技术,形态丰富语言的分析和翻译建模,资源缺乏语言的知识获取和翻译技术,以及组织全国机器翻译研讨会少数民族语言机器翻译评测的情况等。

提交时间: 2017-03-09 点击量1077下载量902 评论 0

  [1 页/ 3 条记录]