基于音频指纹的两步固定音频检索①
2017-06-07乔立能夏秀渝叶于林
计算机系统应用 2017年5期
关键词:实验
乔立能,夏秀渝,叶于林
1(四川大学 电子信息学院,成都 610064)
2(中国人民解放军78438部队,成都 610066)
基于音频指纹的两步固定音频检索①
乔立能1,夏秀渝1,叶于林2
1(四川大学 电子信息学院,成都 610064)
2(中国人民解放军78438部队,成都 610066)
提出了一种基于过零率和音频指纹的两步固定音频检索算法.在基于过零率直方图的初步检索中,采用直方图的迭代计算和动态的观测窗滑动步长来减少计算量并加快搜索速度,快速筛选出相似度较高的候选音频片段;接着基于降维Philips音频指纹对候选音频进行精检索,进一步提高检索精度.实验结果表明,该音频检索算法在保证较好的检索准确性基础上,大幅度提高了检索速度,且具有较好的鲁棒性.
音频检索;过零率;直方图;音频指纹
1 概述
随着现代信息技术、多媒体技术和网络技术的发展,多媒体信息的数据量急剧增多.人们对如何在海量的多媒体库中快速找到感兴趣或有用的信息产生了越来越大的需求[1].在多媒体检索中,音频检索是一个受人们关注且富有挑战性的研究课题[2,3].目前,音频检索主要分为两大类:一类是基于特征相似度的固定音频检索,它是指给定一个查询音频段,在待检音频库中检索与其相同或同源的片段[4,5];另一类是基于内容的音频检索技术,该技术主要研究如何利用音频的幅度、频谱等物理特征,响度、音高、音色等听觉特征,词字、旋律等语义特征实现基于内容的音频信息检索[6,7].
相对来说,基……
登录APP查看全文
