智能家电浪潮下,空调已成为全屋智能的核心入口。然而,当前空调语音交互仍存在三大痛点:
● 找遥控器太麻烦 —— 半夜开空调,摸黑找不到遥控器
● 噪声干扰识别 —— 风噪和环境噪声导致"喊破喉咙"无响应
● 固定指令太死板 —— 只能"开/关/调温度",无法理解"今天好热"传统离线语音方案只能识别固定词条,无法理解自然语言;纯在线方案延迟高、依赖网络、隐私风险大。离在线融合方案:离线处理高频快捷指令、语音前处理,在线大模型处理复杂意图,才是空调语音交互的最佳路径。

▎传统痛点
• 找遥控器:摸黑找按键
• 噪声干扰:强噪声导致识别失败
• 固定指令:只能说预设词条
• 无法打断:播报中不能插话
• 云端隐私担忧:持续录音上传
▎启英泰伦离在线大模型方案
• 唤醒:直接说话控制
• DNN降噪:强噪下精准识别
• 大模型理解:自然语言交互
• 随时打断:播报中直接下指令
• 端侧VAD:仅有效语音上传
离在线协同工作,兼顾基础操控与海量内容生成
本方案基于启英泰伦 CI1306 神经网络语音芯片,采用"端侧处理 + 云端大模型"的离在线融合架构。
● CI1306芯片提供基于DNN的本地语音唤醒及语音识别、语音深度降噪、端点检测、命令词自学习、回声消除、声源定位,另还提供Speex、Opus数据压缩、MP3流媒体播放等功能。
● CI1306芯片与WiFi芯片通过高速串口进行数据交互。WiFi芯片将语音进行缓存及上传到云端,云端回复下发。
● 云端大模型负责自然语言理解、复杂意图处理,内容生成,并将回复内容下发到语音芯片进行播放。大模型支持接入豆包、ChatGPT、文心一言、DeepSeek 等主流大模型,方案兼容性强。
CI1306离在线对话大模型方案功能框图
CI1306芯片五大核心优势,适配家用空调全场景交互
1语音唤醒,告别遥控器,隐私保护
CI1306芯片内置基于DNN的端侧VAD算法,用户直接说唤醒词即可激活空调语音交互。芯片仅在检测到有效语音时才上传云端,静默期不录音、不上传,从根本上杜绝持续录音的隐私风险。
另一方面,采用DNN的VAD算法可精准拦截环境中的各类噪声,包括稳态噪声,非稳态噪声,类人声的干扰声,避免触发云端无意义的回答响应。
2实时响应,交互零等待
空调功能控制指令(如开关、调温、模式等)由CI1306端侧离线识别,响应延迟<500ms,即说即执行。仅复杂自然语言走云端,且端侧已完成噪压缩,上传数据精简,推理更快。
3噪声环境精准识别
CI1306芯片采用基于DNN的深度降噪技术,精准分离人声和空调风噪、环境噪声。即使空调最大风速档位下,仍保持高识别率。
4随时打断,对话如交流
CI1306芯片基于回声消除(AEC)+ VAD,在空调语音播报期间实时检测用户语音,实现随时打断。直接说新指令即可立即响应,对话体验如同人与人交流。
5定位用户方向,防直吹
CI1306 支持双麦克风声源定位,基于DNN算法感知用户说话方向,自动增强用户方向语音、抑制其他方向噪声。远距可精准识别,并可联动空调自动避开用户位置防直吹。
空调离在线大模型应用方案框图如下:
① 拾音端:双麦(MIC_R / MIC_L)经codec编解码接入CI1306,codec同时提供参考信号用于回声消除。
② 芯片处理:CI1306完成唤醒、识别、降噪、AEC 等全部端侧任务。
③ 互联:CI1306通过UART TX/UART RX与WiFi模组双向通信(语音上传/TTS下发);同时通过UART与空调MCU交互(接收控制指令、上报状态)。
④ 输出端:CI1306通过HPOUT接口经codec输出参考信号,再由PA功放推动喇叭播放。
⑤ 云端接入:WiFi 模组对接豆包、ChatGPT、文心一言、DeepSeek 等主流大模型,方案灵活。
目前,该方案已成功落地头部空调品牌,并实现百万级销量,经受了大规模量产和真实用户场景的严苛检验。
启英泰伦深耕智能语音行业十年,提供完整软硬件交付支持:硬件参考设计、语音算法固件、端侧 SDK、云端对接适配指导等,空调厂商可快速完成差异化智能产品落地,欢迎咨询。