硬件
ESP32-S3 搭配双麦克风阵列、I2S 编解码器与功放,做在一块紧凑的四层板上。
- 双麦阵列,带波束成形前端
- I2S 编解码器与 D 类功放
- 四层板,严格遵守天线净空规则
- USB-C 供电,可选电池方案

一个刻意建在廉价 MCU 上的语音产品。唤醒词检测与音频前端处理在本地完成;流式语音识别、语言模型与语音合成跑在 AI 网关后面。
在一颗可用 RAM 只有几百 KB 的芯片上,通过家用 Wi-Fi 让对话延迟感觉是即时的,而且单机成本不能把产品做死。
我们做了双向音频流,拿到第一段合成音频就开始播放,而不是等完整回复。本地唤醒词与回声消除让射频在真正需要之前保持安静。
ESP32-S3 搭配双麦克风阵列、I2S 编解码器与功放,做在一块紧凑的四层板上。
端侧唤醒词与语音活动检测,流式 ASR、LLM 与 TTS 通过网关接入。
ESP-IDF 固件,带 WebSocket 会话协议、配网流程与 OTA,后面是无状态会话服务。
硬件
AI
嵌入式
云端