基于声纹识别技术的常见模型与发展应用
2021-08-19曾桂南吴恋何燕琴郭清粉
现代计算机 2021年21期
关键词:模型
曾桂南,吴恋,何燕琴,郭清粉
(1.贵州师范学院,数学与大数据学院,贵阳550018;2.贵州师范学院,大数据科学与智能工程研究院,贵阳550018)
0 引言
从古至今,声音在人类信息传递中就有着非常关键的作用,是人类进行交流的主要手段之一。随着时代的变化,科学家们也开始尝试利用人声音特性展开一系列研究。因为不同说话人在发出一段声音时所使用的发声器官——舌头、牙齿、喉头、肺、鼻腔在尺寸和形态方面有所不同,以及受性格、年龄、语言习惯、地域差异等因素的影响,使得要想在现实生活中找到具有完全相同的声纹特征的两个人几乎是不可能。尽管声纹识别在目前的市场上不同于人脸识别、指纹识别具有大范围的应用,但手机、平板电脑等很多电子设备上内置的麦克风,带有录音功能,具有成本低廉,不需要高性能的硬件支持等优势。
1 声纹识别技术的发展历程
纵观声纹识别(说话人识别)技术的发展史,它大约可以被划分为四个时期。而早在上世纪三四十年代,人们就有了对“声纹”的一定认识和了解,在1945年,美国Bell实验室的劳伦斯·科斯塔(L.G.Kersta)等人结合肉眼观察语谱图并进行匹配,就此有了“声纹”的概念。
20世纪40年代到70年代,也就是声纹识别技术发展的第二阶段,在这个阶段,声纹识别的理论体系已经初步建立,而特征参数的提取以及选择成为人们关注之焦点,BS Atal提出了线性预测倒谱系数(LPCC),这种参数稳定性较好,也让该技术在准确率上有了大程度的提高。……
登录APP查看全文
