APP下载

基于高斯滤波器组混合特征的录音回放攻击检测研究

2021-03-18旭,蒋

计算机工程 2021年3期
关键词:特征信息

陈 旭,蒋 晔

(南京财经大学信息工程学院,南京 210023)

0 概述

声纹识别即说话人识别,是根据人说话的声音判定人身份的技术,因其获取成本低、安全系数高及使用便捷而应用于安全、司法、通信等多个领域[1]。但在实际应用中,声纹识别系统容易受到声音模拟[2]、语音合成[3]、声音转换[4]、录音回放(含录音拼接回放)等仿冒语音的攻击,此类攻击极大地影响了声纹识别系统本身的安全性,进而也给采用声纹识别技术进行访问控制的系统带来了安全隐患。录音回放攻击是指攻击者使用高保真录音设备录制合法用户进入认证系统时的语音,或通过其他手段获得用户的语音样本,然后在声纹身份认证系统的拾音器端通过高保真功放回放,从而达到对声纹身份认证系统实施攻击的目的。由于高保真录音设备的普及,合法用户语音极易被偷录,录音回放攻击已成为声纹识别技术中抗仿冒攻击的首要解决问题。

由英国爱丁堡大学、法国国家信息与自动化研究所等组织发起的ASVspoof 是迄今为止对仿冒语音鉴别规模最大、最全面的挑战赛[5]。ASVspoof 2015 是用语音合成、声音转换技术产生数字语音,直接输入系统(不用麦克风)进行逻辑层面的攻击(Logical Access),ASVspoof2017 是使用录音回放的方法,经过麦克风进入系统进行物理层面的攻击(Physical Access)。在实际应用中,语音合成及声音转换技术生成的语音也需要经过重放环节转化为Physical Access。国内外研究学者如NAGAR SHETH 等人[6]用高通滤波器对高频信息进行提取,提取出来的HFCC 参数尽管能提高识别率,但是该参数特征会丢失语音部分特征信息。……

登录APP查看全文

猜你喜欢

特征信息
新型冠状病毒及其流行病学特征认识
如何表达“特征”
不忠诚的四个特征
订阅信息
展会信息
线性代数的应用特征
信息
健康信息
健康信息(九则)
健康信息(十则)