跳转至

双麦声源定位加回声消除算法加NN降噪算法

该算法组合可进行声源方位角度估计,当前版本支持0-180度检测范围,分辨率为10°;自适应追踪回声路径的变换、实时抑制扬声器到达麦克风终端的回声信号,以提升目标语音的识别效果;能抑制设备本身产生的高噪声,以提升低信噪比环境下的识别率,针对不同应用领域需使用对应的领域模型;该算法组合会消耗很多内存和算力,预计剩余内存大概20KB,仅支持大概50个离线词条;该算法组合仅双mic可用。本文以offline_asr_llm_aiot_uart_sample为例,offline_asr_llm_aiot_hpout_sample同样适用。

1. 打开CI13XX_SDK_LLM_AIOT_Vx.x.x\system\user_alg_config.mk文件,将 USE_ASR、USE_GCC_DOA、USE_AEC、USE_NN_DENOISE、USE_NN_VAD 配置为 1(自 V3.0.19 起算法组合由 USE_* 独立开关控制,取代原 CI_ALG_TYPE 单值选择;声源定位当前使用 GCC DOA)

算法使能开关和算法功能对应说明请参考:算法功能使用说明

2. 开启声源定位功能(V3.0.19):将 system\user_alg_config.mk 中的 USE_GCC_DOA 置 1 即可,GCC DOA 无需算法模型。(传统 NN DOA 方式为“把 external\model\doa(声源定位) 中 [60004]nn_dual_mic_doa_vxxxx.bin 复制到 projects\offline_asr_llm_aiot_uart_sample\firmware\dnn”,但 V3.0.19 起 NN DOA 暂不支持、该模型已不再随包提供)

3. 开启深度降噪算法请把CI13XX_SDK_LLM_AIOT_Vx.x.x\external\model\nn_denoise中[60003]ANS1-061.bin算法模型,复制到CI13XX_SDK_LLM_AIOT_Vx.x.x\projects\offline_asr_llm_aiot_uart_sample\firmware\dnn文件夹中(V3.0.19 默认已随包提供;目录名由旧版的 nn_denoise(深度降噪) 简化为 nn_denoise)

4. 声源定位相关参数与应用函数说明请查看☞双麦声源定位算法

5. 回声消除算法相关参数说明请查看☞回声消除算法,回声消除涉及硬件参考信号线路的设计,如果贵司自行设计硬件, 请联系启英泰伦技术支持

6. 深度降噪相关参数与应用函数说明请查看☞深度降噪算法

注意

  1. 该算法属于外挂codec方案,需外部挂7243e codec。