docs: 更新小爱音箱自定义唤醒词演示视频

This commit is contained in:
Del Wang
2025-05-10 01:05:32 +08:00
parent e39675abb8
commit 73bf1c6f4d
3 changed files with 19 additions and 15 deletions
+7 -2
View File
@@ -30,6 +30,10 @@
[![](./docs/images/xiaozhi.jpg)](https://www.bilibili.com/video/BV1NBXWYSEvX)
👉 [小爱音箱自定义唤醒词演示视频](https://www.bilibili.com/video/BV1YfVUz5EMj)
[![](./docs/images/kws.jpg)](https://www.bilibili.com/video/BV1YfVUz5EMj)
👉 [小爱音箱接入 MiGPT 演示视频](https://www.bilibili.com/video/BV1N1421y7qn)
[![](./docs/images/migpt.jpg)](https://www.bilibili.com/video/BV1N1421y7qn)
@@ -42,9 +46,10 @@
本项目由 Client 端 + Server 端两部分组成,你可以按照以下顺序运行该项目:
1. 刷机更新小爱音箱补丁固件,开启并 SSH 连接到小爱音箱 👉 [教程](docs/flash.md)
2.你的电脑上编译好 Client 端补丁程序,然后复制到小爱音箱上运行 👉 [教程](packages/client-rust/README.md)
3. 在你的电脑上运行 Server 端演示程序,体验小爱音箱的全新能力 ✨
2.小爱音箱上安装运行 Client 端补丁程序 👉 [教程](packages/client-rust/README.md)
3. 运行以下演示程序,体验小爱音箱的全新能力 ✨
- 👉 [小爱音箱接入小智 AI](examples/xiaozhi/README.md)
- 👉 [小爱音箱自定义唤醒词](examples/kws/README.md)
- 👉 [小爱音箱接入 MiGPT-Next](examples/migpt/README.md)
- 👉 [小爱音箱接入 Gemini Live API](examples/gemini/README.md)
Binary file not shown.

After

Width:  |  Height:  |  Size: 129 KiB

+12 -13
View File
@@ -42,7 +42,7 @@ t iān m āo j īng l íng @天猫精灵
x iǎo d ù x iǎo d ù @小度小度
d òu b āo d òu b āo @豆包豆包
n ǐ h ǎo x iǎo zh ì @你好小智
EOF
EOF
```
> [!TIP]
@@ -74,35 +74,34 @@ cat <<EOF > /data/open-xiaoai/kws/reply.txt
主人你好,请问有什么吩咐?
https://example.com/music.wav
file:///usr/share/sound-vendor/AiNiRobot/wakeup_ei_01.wav
EOF
EOF
```
> [!TIP]
> 修改完毕后,记得重启小爱音箱使新配置生效。
## 常见问题
### Q唤醒词识别不是很灵敏?
### Q能否自定义唤醒词的响应动作?比如:关灯
该脚本默认不支持自定义唤醒词触发后执行的动作。
如果你想要自定义唤醒词的触发动作,可以参考 [open-xiaoai](https://github.com/idootop/open-xiaoai) 里的其他演示程序,根据 server 端接收到的小爱音箱上的唤醒词事件,实时触发任意自定义操作(比如:打电话,订外卖等)。
### Q:为什么唤醒词识别不是很灵敏,时好时坏?
由于小爱音箱 client 端算力和存储空间有限,默认只使用了一个较小的语音识别模型,所以识别效果并不是很完美,需要多多尝试。
如果你想要更完美的唤醒词识别效果,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx)。
如果你想要更完美的唤醒词识别效果,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx),可以参考 [xiaozhi-esp32-server](https://github.com/xinnan-tech/xiaozhi-esp32-server) 项目
### Q:能不能设置英文/方言作为唤醒词?比如:Siri
默认使用的小型语音识别模型只支持中文(普通话)作为唤醒词。
如果你需要多语言唤醒词,比如英文、日语、韩语或方言等,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx)。
### Q:能否自定义唤醒词的响应动作?比如:关灯
该脚本默认不支持自定义唤醒词触发后的执行动作。
如果你想要自定义唤醒词的执行动作,可以参考 [open-xiaoai](https://github.com/idootop/open-xiaoai) 里的演示程序,根据 server 端接收到的小爱音箱上的唤醒词事件,实时触发任意自定义操作(比如:打电话,订外卖等)。
如果你需要多语言唤醒词,比如英文、日语、韩语或方言等,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx),可以参考 [xiaozhi-esp32-server](https://github.com/xinnan-tech/xiaozhi-esp32-server) 项目
### Q:是否支持说话人(声纹)识别?
由于小爱音箱 client 端算力和存储空间有限,默认只使用了一个较小的语音识别模型,并不支持说话人识别等高阶功能。
如果你需要声纹识别、连续对话等高阶功能,可以在 server 端运行更大规模、更先进的 AI 模型,来进行语音识别和对话管理。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx)
如果你需要声纹识别、连续对话等高阶功能,可以在 server 端运行更大规模、更先进的 AI 模型,来进行语音识别和对话管理。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx),可以参考 [xiaozhi-esp32-server](https://github.com/xinnan-tech/xiaozhi-esp32-server) 项目。