基于语音信号处理的电子病历系统探索研究
2021-02-07华东理工大学刘峻宇刘逸捷岳川梦真王宪伟刘金琳
电子世界 2021年2期
华东理工大学 刘峻宇 刘逸捷 岳川梦真 王宪伟 刘金琳
伴随着深度神经网络的的到来,机器学习与人工智能技术在人们的日常生活中逐渐得到了广泛运用,尤其是诸如人脸识别,身份认证,物体识别等图像识别以及计算机视觉相关的技术。虽然深度神经网络对于语音识别模块的推进状况不如图像识别,但是迄今为止仍然在不断涌现的技术允许语音识别变得逐渐快速,准确。为了推动语音识别技术在人们生活中的普及,本文提出了一种医疗方向上的语音识别以及与正在发展的电子病历系统结合的系统,并在其上就语音识别和说话人识别,基于语音识别工具包Kaldi进行了一系列研究和探索,针对语音识别修改thchs30的语音模型,获得了一个专门针对医疗语音识别的模型,通过对案例sre16/v2的学习获得了基于xvector的文本无关说人识别模型,最后基于对已经识别出来的语音的正则提取处理,构建了一个手机语音问诊app系统。
1 简介
1.1 语音识别
语音识别是一个十分复杂的过程,其包括语音的采集,前端处理,解码器以及最后的文字处理部分。首先,语音采集也许是所有步骤中看起来最没有技术含量的一个步骤,但这并不意味着这个步骤无足轻重,在韩纪庆等人所著的《语音信号处理》艺术中就阐述了一个良好,全面的语音素材,对于语音信号处理可以起到极大的简化作用,好的语音采集同样对于建立良好的语音模型十分有帮助。……
登录APP查看全文
