开源小智AI聊天机器人,ESP32-S3硬件开发,离线唤醒、大模型对话和声纹识别
AI 总结
小智 AI 聊天机器人(xiaozhi-esp32)是一个开源的 AI 硬件开发项目,主要面向教学,帮学生和开发者把大模型接到实际硬件上。已经能跑通离线语音唤醒、流式语音对话、声纹识别和短期记忆,语音识别支持国语、粤语、英语、日语、韩语,大模型用 Qwen2.5 72B 或豆包 API,TTS 走火山引擎或 CosyVoice。适配立创实战派 ESP32-S3、乐鑫 ESP32-S3-BOX3、M5Stack CoreS3 等开发板,代码在 GitHub 上
小智 AI 聊天机器人(XiaoZhi AI Chatbot)是一个开源项目,主要面向教学。作者想通过它帮更多人入门 AI 硬件开发,弄清楚大语言模型落到实际硬件设备上是怎么回事。对 AI 感兴趣的学生,或者想试新技术的开发者,都可以拿它练手
已实现功能
- Wi-Fi / ML307 Cat.1 4G
- BOOT 键唤醒和打断,支持点击和长按两种触发方式
- 离线语音唤醒 ESP-SR
- 流式语音对话(WebSocket 或 UDP 协议)
- 支持国语、粤语、英语、日语、韩语 5 种语言识别 SenseVoice
- 声纹识别,识别是谁在喊 AI 的名字 3D Speaker
- 大模型 TTS(火山引擎 或 CosyVoice)
- 大模型 LLM(Qwen2.5 72B 或 豆包 API)
- 可配置的提示词和音色(自定义角色)
- 短期记忆,每轮对话后自我总结
- OLED / LCD 显示屏,显示信号强弱或对话内容
已支持的开源硬件
- 立创·实战派 ESP32-S3 开发板
- 乐鑫 ESP32-S3-BOX3
- M5Stack CoreS3
- AtomS3R + Echo Base
- 神奇按钮 2.4
- 虾哥 Mini C3
- 微雪电子 ESP32-S3-Touch-AMOLED-1.8



语音识别、声纹、TTS 和对话用的模型都是可替换的,提示词和音色能自己配,相当于给机器人换一个角色。硬件上准备一块受支持的 ESP32-S3 开发板,把固件编译烧录进去,再配置好模型服务的 API 就能对话。开源仓库地址放在本页资源区
本文隐藏内容
已解锁正在确认隐藏内容
- 本文标题
- 开源小智AI聊天机器人,ESP32-S3硬件开发,离线唤醒、大模型对话和声纹识别
- 本文作者
- AFeng
- 来源平台
- 资速达 (zisuda.com)
- 本文链接
- https://www.zisuda.com/xiaozhi-ai-chatbot-esp32-s3-offline-voice-wakeup-voiceprint
版权声明:本站所有资源均来自互联网公开分享或原创整理,仅供个人学习、技术交流与研究测试使用,版权归原作者所有
免责条款:任何个人或组织不得将本站资源用于商业用途。如无意中侵犯了您的知识产权或合法权益,请通过邮件(hello@zisuda.com)联系我们,我们将在收到通知并核实后第一时间进行删除下架处理







