英语字素音素的可视匹配与特征分析
2021-10-27龚文涛陈晓莹李华昱
郑州大学学报(理学版) 2021年4期
李 昕,李 珊,龚文涛,陈晓莹,李华昱
(1.中国石油大学(华东)计算机科学与技术学院 山东 青岛 266580;2.中国石油大学(华东)信息化建设处 山东 青岛 266580)
0 引言
音素(Phonemes)是决定发音差异的最小单位,例如/AA/、/B/,字素(Grapheme)是对应音素的单个字母或字母序列,例如〈a〉、〈th〉,字素和音素分别是单词和发音的基本单位。形音转换是指字素与音素逐步进行分解和匹配,在匹配对的基础上进行统计分析,形成发音规则,这个过程是语音识别和语音合成的基础。以英语为代表的印欧语系是语音型文字,从诞生之初就与发音形成紧密联系。掌握语音型文字的发音规则是学习相应语言的基础。Hanna[1]早在1965年就著书详细描述形音匹配,由于缺乏完整性和直观性,在当时并没有得到认可。Elovitz等[2]总结了329个字母到发音的规则,但准确性无法达到实际应用的需求。此外这些方法在词汇量很大时变得既耗时又繁杂。近年来,随着人工智能技术的发展,例如神经网络的应用,语音处理问题取得了极大的发展,在标准发音下的语音识别准确率达到了94%。尽管这些基于机器学习的方法提高了识别准确率,但是最终形成的语音规则数目繁多且冗长,不可解释性是其固有弊端,不利于学习者掌握。
建立发音规则非常复杂,主要是因为语言的历史演化和地域差别,出现了大量变种,外来词的引入、元音大迁移等事件的出现,加剧了发音异常变化。此外,由于地域的不同,即使在相同的上下文约束下,相同的字素序列也可能产生不同的发音,使得异常发音很难通过内部一致的方式提取通用规则集。……
登录APP查看全文