离在线大模型对话SDK(CI13XX_SDK_LLM_AIoT)¶
概述¶
目前CI13XX系列芯片的离在线大模型对话SDK(CI13XX_SDK_LLM_AIoT)最新发布版本为:CI13XX_SDK_LLM_AIoT_V3.0.19
主要针对纯离在线大模型对话应用场景,例如智能家居、智能座舱、AI机器人、AI陪伴、AI教育、AI玩具等;支持离线唤醒和命令词识别,自学习,回声消除(AEC),深度降噪,声源定位(DOA),VAD端点检测,SPEEX/OPUS/G722等语音编解码算法;同时支持语音在线上传和播放功能:
- ASR(Automatic Speech Recognition,自动语音识别),☞《语音识别使用说明》
- CWSL(Command Word Self-Learning,离线命令词自学习),☞《离线命令词自学习使用说明》
- AEC(Acoustic Echo Cancellation,回声消除),☞《回声消除使用说明》
- NN_DENOISE(Neural Network Denoising,深度降噪),☞《深度降噪算法使用说明》
- DOA(Direction of Arrival,双mic声源定位),☞《双mic声源定位算法说明》
- NN VAD(Neural Network Voice Activity Detection,深度语音活性检测),☞《配置选项参考》
目前离在线大模型对话SDK提供了3个sample供用户选择,具体特性如下
| 特性 | HPOUT 方式 | UART 方式 | IIS 方式 |
|---|---|---|---|
| 工程目录 | offline_asr_llm_aiot_hpout_sample |
offline_asr_llm_aiot_uart_sample |
offline_asr_llm_aiot_iis_sample |
| 音频上传方式 | HPOUT 模拟音频输出 | UART 串口数字传输 | IIS(I2S) 数字音频接口 |
| 音频播放方式 | 主控芯片进行播放 | 串口接收数据播放 | IIS 数字音频输出 |
| 内存消耗 | 较低 | 约75KB | 约12KB |
| 压缩支持 | 无 | PCM/Speex/Opus/G722 | 无 |
| 云端播放 | 不支持 | MP3/PCM/G722 | PCM |
| 本地播放 | 不支持 | MP3 | 不支持 |
| VAD检测 | NN VAD | NN VAD | NN VAD |
| 适用场景 | 简单方案,外部WiFi模组处理 | 功能最全,推荐方案 | 高音质数字传输 |
| AUDIO_UPLOAD_TYPE | 2 | 1 | 3 |
备注
- V3.0.19 版本:围绕降噪效果、VAD(语音检测)、AEC(回声消除)方案及系统稳定性进行了全面优化,并引入了多项新特性,以提升产品性能和成本效益;NN 降噪(含降噪强度 beta 系数与自适应模式)更新降噪模型为ANS1-061;算法使能不再使用
CI_ALG_TYPE单值选择,改为各工程project_file/makefile中的USE_xxx独立开关 + 公共配置文件system/user_alg_config.mk(详见 ☞《配置选项参考》);
离在线大模型对话SDK适配的AI语音芯片型号¶
- 芯片型号(☞启英商城有售):
CI 1302 、 CI 1303 、 CI 1306 。
- 模块型号(☞启英商城有售):
CI-D02GS01J单麦离线语音识别端子模块
CI-D06GT01J双麦离线语音识别蓝牙端子模块
- 开发板套件型号(☞启英商城有售):
CI1306开发板套件
CI1303开发板套件
CI1302开发板套件