diff --git a/README.md b/README.md index ab7b7f7..6f7bfb7 100644 --- a/README.md +++ b/README.md @@ -30,6 +30,10 @@ [![](./docs/images/xiaozhi.jpg)](https://www.bilibili.com/video/BV1NBXWYSEvX) +👉 [小爱音箱自定义唤醒词演示视频](https://www.bilibili.com/video/BV1YfVUz5EMj) + +[![](./docs/images/kws.jpg)](https://www.bilibili.com/video/BV1YfVUz5EMj) + 👉 [小爱音箱接入 MiGPT 演示视频](https://www.bilibili.com/video/BV1N1421y7qn) [![](./docs/images/migpt.jpg)](https://www.bilibili.com/video/BV1N1421y7qn) @@ -42,9 +46,10 @@ 本项目由 Client 端 + Server 端两部分组成,你可以按照以下顺序运行该项目: 1. 刷机更新小爱音箱补丁固件,开启并 SSH 连接到小爱音箱 👉 [教程](docs/flash.md) -2. 在你的电脑上编译好 Client 端补丁程序,然后复制到小爱音箱上运行 👉 [教程](packages/client-rust/README.md) -3. 在你的电脑上运行 Server 端演示程序,体验小爱音箱的全新能力 ✨ +2. 在小爱音箱上安装运行 Client 端补丁程序 👉 [教程](packages/client-rust/README.md) +3. 运行以下演示程序,体验小爱音箱的全新能力 ✨ - 👉 [小爱音箱接入小智 AI](examples/xiaozhi/README.md) + - 👉 [小爱音箱自定义唤醒词](examples/kws/README.md) - 👉 [小爱音箱接入 MiGPT-Next](examples/migpt/README.md) - 👉 [小爱音箱接入 Gemini Live API](examples/gemini/README.md) diff --git a/docs/images/kws.jpg b/docs/images/kws.jpg new file mode 100644 index 0000000..e925b62 Binary files /dev/null and b/docs/images/kws.jpg differ diff --git a/examples/kws/README.md b/examples/kws/README.md index 88e0c8a..e7cada0 100644 --- a/examples/kws/README.md +++ b/examples/kws/README.md @@ -42,7 +42,7 @@ t iān m āo j īng l íng @天猫精灵 x iǎo d ù x iǎo d ù @小度小度 d òu b āo d òu b āo @豆包豆包 n ǐ h ǎo x iǎo zh ì @你好小智 -EOF +EOF ``` > [!TIP] @@ -74,35 +74,34 @@ cat < /data/open-xiaoai/kws/reply.txt 主人你好,请问有什么吩咐? https://example.com/music.wav file:///usr/share/sound-vendor/AiNiRobot/wakeup_ei_01.wav -EOF +EOF ``` > [!TIP] > 修改完毕后,记得重启小爱音箱使新配置生效。 - ## 常见问题 -### Q:唤醒词识别不是很灵敏? +### Q:能否自定义唤醒词的响应动作?比如:关灯 + +该脚本默认不支持自定义唤醒词触发后执行的动作。 + +如果你想要自定义唤醒词的触发动作,可以参考 [open-xiaoai](https://github.com/idootop/open-xiaoai) 里的其他演示程序,根据 server 端接收到的小爱音箱上的唤醒词事件,实时触发任意自定义操作(比如:打电话,订外卖等)。 + +### Q:为什么唤醒词识别不是很灵敏,时好时坏? 由于小爱音箱 client 端算力和存储空间有限,默认只使用了一个较小的语音识别模型,所以识别效果并不是很完美,需要多多尝试。 -如果你想要更完美的唤醒词识别效果,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx)。 +如果你想要更完美的唤醒词识别效果,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx),可以参考 [xiaozhi-esp32-server](https://github.com/xinnan-tech/xiaozhi-esp32-server) 项目。 ### Q:能不能设置英文/方言作为唤醒词?比如:Siri 默认使用的小型语音识别模型只支持中文(普通话)作为唤醒词。 -如果你需要多语言唤醒词,比如英文、日语、韩语或方言等,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx)。 - -### Q:能否自定义唤醒词的响应动作?比如:关灯 - -该脚本默认不支持自定义唤醒词触发后的执行动作。 - -如果你想要自定义唤醒词的执行动作,可以参考 [open-xiaoai](https://github.com/idootop/open-xiaoai) 里的演示程序,根据 server 端接收到的小爱音箱上的唤醒词事件,实时触发任意自定义操作(比如:打电话,订外卖等)。 +如果你需要多语言唤醒词,比如英文、日语、韩语或方言等,可以在 server 端运行更大规模、更先进的 AI 模型,来进行唤醒词识别。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx),可以参考 [xiaozhi-esp32-server](https://github.com/xinnan-tech/xiaozhi-esp32-server) 项目。 ### Q:是否支持说话人(声纹)识别? 由于小爱音箱 client 端算力和存储空间有限,默认只使用了一个较小的语音识别模型,并不支持说话人识别等高阶功能。 -如果你需要声纹识别、连续对话等高阶功能,可以在 server 端运行更大规模、更先进的 AI 模型,来进行语音识别和对话管理。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx)。 \ No newline at end of file +如果你需要声纹识别、连续对话等高阶功能,可以在 server 端运行更大规模、更先进的 AI 模型,来进行语音识别和对话管理。推荐使用 [FunASR](https://github.com/modelscope/FunASR) 和 [Sherpa-ONNX](https://github.com/k2-fsa/sherpa-onnx),可以参考 [xiaozhi-esp32-server](https://github.com/xinnan-tech/xiaozhi-esp32-server) 项目。