基于句本位句法体系的古汉语机器翻译研究
2015-04-21杨天心宋继华
中文信息学报 2015年2期
韩 芳,杨天心,宋继华
(北京师范大学 信息科学与技术学院,北京 100009)
基于句本位句法体系的古汉语机器翻译研究
韩 芳,杨天心,宋继华
(北京师范大学 信息科学与技术学院,北京 100009)
该文通过构建古汉语词典模型,结合黎锦熙先生提出的句本位句法相关规则构造知识库,使用词义消歧算法,对古汉语进行基于规则的机器翻译研究。实验以基于句本位语法进行句法标注后的《论语》作为测试语料,以句子为单位进行机器翻译,通过获取待选义项、构建义项选择模型、调整句法顺序等手段生成翻译结果集,并使用二元语法模型对结果进行优选,得到机器翻译最终结果,最后对翻译结果进行了分析测评。
关键词:古汉语;黎氏语法;词义消歧;机器翻译
1 引言
机器翻译主要分为基于统计和基于规则两个阵营,而又以基于统计的机器翻译为主。目前机器翻译(Machine Translation, MT)领域主要是针对不同语种间进行研究,对古汉语进行机器翻译的研究较少。尽管当前已经存在着一些古今汉语平行语料资源,为基于统计的古今汉语机器翻译研究提供了大量支持,但仅利用目前已存的句对齐古今平行语料进行基于统计的机器翻译,数据量仍显不足。由于古今汉语是一脉相承的,本文根据古汉语所特有的汉语言特点,探讨基于规则和统计相结合的古今汉语机器翻译。
本文采用黎氏语法体系作为句法分析及机器翻译的规则指导,对《比较文法》及《古代汉语》*王力主编,吉常宏等编/1999-05-01/中华书局的部分词法规则进行了提取和归纳。……
登录APP查看全文
