共振峰编辑法区别鼻化元音中口、鼻音共振峰的实证探究∗
2021-01-02赵擎华杨俊杰
应用声学 2021年6期
赵擎华 杨俊杰
(1山西大学语言科学研究所 太原 030006)
(2山西警察学院 太原 030021)
0 引言
20世纪30年代至今,司法话者识别技术已经历了近90年的发展历程。当前,国内外司法话者识别方法主要有声学语音学识别、全自动话者识别及半自动话者识别3种[1]。其中,依靠“听觉-声学-语音识别”由专家进行综合判别的声学语音学识别方法,因其结论准确性及可解释性为各国法庭普遍采信,成为国内外司法话者识别专家普遍采用的方法。全自动话者识别具有快速高效的特点,但识别准确率随着样本库容、语种、信道等的异同而稳定性较差,故主要应用在门禁系统、犯罪预防、军事等领域;在打击犯罪领域主要是利用其快速特点进行嫌疑对象的筛查与串并案件。而基于人工与自动识别相结合的半自动话者识别技术,正处于研究阶段,尚未有成熟可信的系统可供使用。在声学语音学的司法话者识别方法中,共振峰频率是最为常见的声学测量参数之一[2],对其应用主要体现在共振峰的动态模式与静态模式上,因其是话者发音器官言语中运动习惯动力定型的声学表现,能够充分体现个体间发音习惯的异同。而基于第一、第二共振峰构建的元音声学空间(F1-F2sapce)度量模型是对共振峰模式最直观体现的方式之一[3]。而今,这一度量模型还被广泛应用于检测耳蜗植入物的语音感知[4]、语言疾病评估[5−6]、构音障碍矫治[7]、语音清晰度评估[8]、语音识别[9]、跨语言比较[10]、汉语方言学研究[11]等多项研究中。……
登录APP查看全文
