78/xiaozhi-esp32
#303 this week
An MCP-based chatbot | 一个基于MCP的聊天机器人
29.6K stars
6.8K forks
29.6K GitHub watchers
Updated 9/3/2026
Build with Backblaze B2
SDKs, agent skills, IDE extensions, and reference pipelines from Backblaze Labs. All open source.
Loading star history...
Use Cases & Benefits
- Implements an MCP-protocol based AI chatbot firmware for ESP32 devices enabling voice interaction and multi-device control.
- Integrates large language models with offline voice wake-up and multi-protocol communication for flexible, real-time AI interactions on embedded hardware.
- Use for building custom voice-controlled smart home devices with multi-language support and device management via MCP protocol.
- Use for developing AI-powered embedded systems on ESP32 platforms with OLED/LCD display and speaker recognition features.
- Use for educational projects or prototyping AI chatbots on breadboarded ESP32 hardware with open-source firmware and cloud model integration.
About xiaozhi-esp32
An MCP-based Chatbot
介绍
👉 人类:给 AI 装摄像头 vs AI:当场发现主人三天没洗头【bilibili】
👉 手工打造你的 AI 女友,新手入门教程【bilibili】
小智 AI 聊天机器人作为一个语音交互入口,利用 Qwen / DeepSeek 等大模型的 AI 能力,通过 MCP 协议实现多端控制。
版本说明
当前 v2 版本与 v1 版本分区表不兼容,所以 无法从 v1 版本通过 OTA 升级到 v2 版本。分区表说明参见 partitions/v2/README.md。
使用 v1 版本的所有硬件,可以通过手动烧录固件来升级到 v2 版本。
v1 的稳定版本为 1.9.2,可以通过 git checkout v1 来切换到 v1 版本,该分支会持续维护到 2026 年 2 月。
已实现功能
- Wi-Fi / ML307 Cat.1 4G
- 离线语音唤醒 ESP-SR
- 支持两种通信协议(Websocket 或 MQTT+UDP)
- 采用 OPUS 音频编解码
- 基于流式 ASR + LLM + TTS 架构的语音交互
- 声纹识别,识别当前说话人的身份 3D Speaker
- OLED / LCD 显示屏,支持表情显示
- 电量显示与电源管理
- 支持多语言(中文、英文、日文)
- 支持 ESP32-C3、ESP32-S3、ESP32-P4 芯片平台
- 通过设备端 MCP 实现设备控制(音量、灯光、电机、GPIO 等)
- 通过云端 MCP 扩展大模型能力(智能家居控制、PC桌面操作、知识搜索、邮件收发等)
- 自定义唤醒词、字体、表情与聊天背景,支持网页端在线修改 (自定义Assets生成器)
硬件
面包板手工制作实践
详见飞书文档教程: