APP下载

电视远场语音系统设计

2021-09-26冠捷显示科技厦门有限公司王衍军

电子世界 2021年16期

冠捷显示科技(厦门)有限公司 王衍军

2014年亚马逊推出智能音箱Echo产品,将远场语音应用到传统音箱中,从而赋予音箱人工智能的属性。在其他应用领域也在尝试导入远场语音技术,比如教育机器人、汽车语音助手、白色智能家电、智能厨电等。近年来智能电视开始配置远场语音技术,带给用户更便捷的人机交互方式,真正实现解放双手,带来全新的交互体验。

1 硬件设计

电视产品远场语音系统硬件实现框架如图1,采用4个麦克风线性阵列,数字麦克风输出PDM信号给DSP处理,DSP采用的是一款中等成本专用32位DSP音频处理微控制器,可支持8通道音频输入的采样和处理,内置1MKB SRAM,工作频率高达250MHz,同时配备了闪存控制器,它允许用户更新程序而不需要将芯片从实际的最终产品中移除。两颗ADC ES7210将从功放输出回采的模拟音频信号转成IIS数字信号传输给DSP处理,麦克风采集到的PDM信号与回采的IIS数字信号经DSP算法处理,消除回声成分后得到有用的音频数据,再通过USB2.0传输给TV SOC,SOC再将音频数据上传到语音服务器,与数据库连接识别语意返回给SOC电视端按语音指令做出响应。

图1 硬件框架

1.1 麦克风选型

麦克风选型要符合语音算法厂商设计要求,国内常用的语音算法有科大讯飞、思必驰、腾讯、百度等,本文采用思必驰语音算法,要求的性能指标包括:(1)灵敏度>-42dBFS,测试条件1KHz 94dB SPL;(2)灵敏度一致性≤±1.5dBFS;(3)信噪比(S/N)≥63dBA;(4)总谐波失真(THD)≤1%(1kHz);(5)声学过载点(AOP)≥120dBSPL;(6)自由场频率(100-10kHz内)响应波动≤3dB。

本文采用背收音数字硅麦克风3SM222KMB1HA,灵敏度-26dBFS且误差在±1dBFS内、信噪比64dBA、总谐波失真小于0.2%、AOP 120dBSPL。……

登录APP查看全文