藏语语言模型的研究现状及展望
2020-05-21郭杨拥措
电脑知识与技术 2020年9期
郭杨 拥措



摘要:语言模型是自然语言处理研究的基础,是计算机识别和自然语言理解的桥梁。到目前为止,语言模型走过来了三个阶段:统计模型、神经网络模型、深度神经网络模型。随着深度学习技术的广泛应用,大规模数据集的使用、复杂的模型以及高昂的训练代價称为语言模型建模的特点。随着信息化的高速发展,藏语的语言模型成为目前乃至以后的研究趋势。文章全篇介绍了语言模型的研究现状以及藏语语言模型的研究现状,并探讨了当前藏语语言模型在分析过程所经历的难题,并提出可能的解决方案以及应用前景。
关键词:语言模型;藏语;研究现状
中图分类号:G424 文献标识码:A
文章编号:1009-3044(2020)09-0181-04
引言
语言模型是许多自然语言处理任务的基础部分,对语言模型的研究可以促进自然语言处理方面技术的攻坚克难。通过对藏语模型的研究,可以提高藏文文本的分词技术,藏语语音的识别技术等,对于少数民族地区的民族化文化信息处理技术有着不可磨灭的重要性。
藏语是促进西藏文化和民族文化的主要工具和手段。因此,本文目标是基于对语言模型以及藏语语言模型的国内外最新研究的成果进行比较、分类、总结,从而探索出语言模型在自然语言处理方面的潜在趋势,帮助其他爱好研究自然语言的研究者全方位、各层次、多角度的了解该领域内的算法与技术。
关于藏语模型的相关研究很少,传统的N-gram语言模型仍在使用。……
登录APP查看全文
