基于逆向最大匹配分词算法的汉盲翻译系统
2021-10-15杨文珍徐豪杰汪文妃宣建强吴新丽潘海鹏浙江理工大学虚拟现实实验室浙江杭州310018
计算机应用与软件 2021年10期
杨文珍 徐豪杰 汪文妃 宣建强 赵 维 吴新丽 潘海鹏(浙江理工大学虚拟现实实验室 浙江 杭州 310018)
0 引 言
盲文是盲人传递获取信息的特殊文字。世界通用的布莱尔盲文符号每方有6个点位,依据点位的单点凹凸状态,每方存在64种排列组合情况,盲人通过摸读不同的点字符号读取信息。汉语盲文是我国盲人摸读书写的文字符号,其对应的是汉字读音而非字形[1]。
纸质盲文书籍厚重、制作繁琐、成本高昂,且现有盲文书多以医学、文学和法学类为主,知识陈旧且覆盖范围狭窄,无法满足我国广大盲人多领域、多层次的阅读需求[2-3]。在当前信息无障碍社会的时代背景下,汉盲翻译系统旨在将电子文本转换为盲文以供盲人获取更丰富的信息[4]。
19世纪50年代,黄乃先生主持设计了以普通话读音为基础、以汉语词组为单位的现行盲文方案,该方案简单易学的特点,使之成为中国大陆普及率最高的盲文方案。为简化盲文,现行盲文通常省略声调,单纯由声母方位和韵母方位组成,图1为“梦想”的不带调现行盲文。

图1 “梦想”对应的现行盲文
本文设计开发的汉盲翻译系统,能够减少多音字的混淆错误,获得较符合分词连写规则的分词结果,有较高的综合汉盲翻译准确率,可以帮助盲人摒弃厚重的盲文书籍,获取更丰富的信息,具有较强实用性。
1 相关研究
不同于英语盲文,字母和盲文符号之间有一一映射关系,汉盲翻译是包含多层次转换的复杂过程。汉语注重语义理解,故汉语盲文的翻译过程不是简单的逐字转换,而是先要根据盲文分词连写规则,对文本做分词连写处理,然后再转换成对应的盲文[5-6]。……
登录APP查看全文
