基于双向编解码器的乌英机器翻译
2021-05-20李耀松李大舟陈子祥孟智慧
计算机工程与设计 2021年5期
高 巍,李耀松+,李大舟,陈子祥,孟智慧
(1.沈阳化工大学 计算机科学与技术学院,辽宁 沈阳 110142;2.中国移动通信集团设计院有限公司 河北分公司,山西 太原 030000)
0 引 言
近年来,机器翻译作为自然语言处理的重要组成部分取得了飞速的发展。翻译方法由最初的基于统计、基于短语和基于实例的方法,逐渐演变为基于神经网络和编解码器模型的神经机器翻译方法,在翻译质量上甚至媲美人工翻译。同时,翻译模式也由最初的一种语言到另一种语言的翻译模式,逐渐发展为能同时进行一种语言到多种语言的翻译,逐渐呈现出多元化的趋势。然而乌尔都语与英语在语法规则、书写形式等方面存在差异,且平行语料资源稀缺,导致传统机器翻译模型无法发挥出较好的效果。因此设计一个高质量的翻译模型,成为提高乌尔都语到英语翻译质量的重要手段[1-3]。
本文提出一个基于双向编解码器的乌尔都语到英语的机器翻译模型。编码器和解码器都采用双向LSTM搭建,并在编码器与解码器之间引入注意力机制。首先,经词嵌入编码后的源语句作为编码器的输入,输出结果会包含源语句信息的语义向量。注意力机制在不同时刻将对应的语义向量传入解码器。经解码器的输出向量再经过Softmax函数进行处理,输出目标单词的概率向量,再根据词汇表选出预测目标词。采用BLEU评分来对最终的翻译文本进行评估。
1 相关工作
国内外针对乌尔都语与英语的机器翻译的研究相对较少。……
登录APP查看全文
