yaotutu
|
9edd083411
|
feat: 添加 Sherpa-ONNX Paraformer 模型支持
- 在 sherpa_onnx_local.py 中添加 model_type 参数,支持 paraformer 和 sense_voice 两种模型类型
- 在 config.yaml 中添加 SherpaParaformerASR 配置示例
- 添加详细的 Paraformer 使用文档 (docs/sherpa-paraformer-guide.md)
- 保持向后兼容,默认使用 sense_voice 模型
这个改动允许用户在低性能设备(如 RK3566)上使用更轻量的 Paraformer 模型,
相比 SenseVoice (894MB),Paraformer-small (78MB) 可以提供 4-6 倍的识别速度提升。
|
2025-07-30 10:41:27 +08:00 |
|
 hrzandGitHub
|
67c4622ca7
|
Merge pull request #1935 from myifeng/aliyun-internal
如果配置的是ECS内网地址,则使用ws协议,默认是wss协议
|
2025-07-29 08:59:34 +08:00 |
|
hrz
|
ff9fb9eb1b
|
update:优化最后活动时间
|
2025-07-28 22:38:48 +08:00 |
|
Chingfeng Li
|
b07a8796ff
|
阿里云ECS内网访问协议设置
|
2025-07-28 17:06:53 +08:00 |
|
hrz
|
dff8b8ccec
|
Merge branch 'main' into py_test_tts
|
2025-07-24 16:18:39 +08:00 |
|
hrz
|
78e5c52932
|
Merge branch 'main' into py_test_tts
|
2025-07-24 15:15:44 +08:00 |
|
Sakura-RanChen
|
2f5e8c2019
|
fix: 补充None值判断
|
2025-07-24 15:07:35 +08:00 |
|
hrz
|
2508d3f965
|
update:获取nginx转发的ip地址
|
2025-07-24 14:38:56 +08:00 |
|
 hrzandGitHub
|
3699d28dd0
|
Merge pull request #1893 from Hmmrrr/main
feat:添加minimax单向双向流式
|
2025-07-24 14:18:19 +08:00 |
|
Sakura-RanChen
|
84ff897b46
|
fix: LLM携带空文本时错误判断
|
2025-07-24 09:31:44 +08:00 |
|
Sakura-RanChen
|
83ded8458a
|
Merge branch 'py_test_tts' of https://github.com/xinnan-tech/xiaozhi-esp32-server into py_test_tts
|
2025-07-23 14:40:14 +08:00 |
|
Sakura-RanChen
|
e93053d412
|
fix: 文本重复发送
|
2025-07-23 14:35:59 +08:00 |
|
Hmmrrr
|
fadf18b7fc
|
feat:添加minimax单向双向流式
|
2025-07-22 18:13:05 +08:00 |
|
 欣南科技andGitHub
|
710218b5b5
|
Merge pull request #1716 from xinnan-tech/py_test_tts
update:添加阿里云流式asr
|
2025-07-22 13:27:41 +08:00 |
|
hrz
|
60cbe1571c
|
update:修复cosyvoice非流式合成方法
|
2025-07-22 13:25:54 +08:00 |
|
 hrzandGitHub
|
6740d6a723
|
Merge pull request #1885 from xinnan-tech/py_prompt_emoji
Py prompt emoji
|
2025-07-21 23:18:30 +08:00 |
|
Sakura-RanChen
|
bc5586a077
|
update: HuoshanTTS服务器资源释放
|
2025-07-21 17:46:22 +08:00 |
|
hrz
|
f6e79e17b7
|
update:更正cosyvoice大模型节点
|
2025-07-21 12:03:53 +08:00 |
|
Sakura-RanChen
|
eead126f7a
|
update: 表情由llm发送,长文本进行约束
|
2025-07-21 09:30:23 +08:00 |
|
3030332422
|
b8136ac1dc
|
fix:修复阿里云流式ASR音频传递问题
|
2025-07-19 18:17:21 +08:00 |
|
3030332422
|
6d5b53fcd5
|
fix: 修复阿里云流式ASR终止协议缺失问题
|
2025-07-19 12:16:12 +08:00 |
|
hrz
|
5cf8eb5e71
|
update:优化OpenaiASR、GroqASR配置
|
2025-07-19 01:03:36 +08:00 |
|
3030332422
|
f037f4c7de
|
fix: 修复声纹识别场景下的意图识别问题
|
2025-07-18 11:34:14 +08:00 |
|
3030332422
|
618be6d108
|
update:日志文件的补充
|
2025-07-17 16:08:13 +08:00 |
|
hrz
|
7fb028205f
|
Merge branch 'main' into py_test_tts
# Conflicts:
# main/manager-api/src/main/resources/db/changelog/db.changelog-master.yaml
|
2025-07-17 14:32:50 +08:00 |
|
 hrzandGitHub
|
f70652f165
|
Merge branch 'py_test_tts' into openai-asr
|
2025-07-17 11:31:44 +08:00 |
|
3030332422
|
8831ea22b7
|
update:删去一些重复、不用的代码
|
2025-07-16 16:43:49 +08:00 |
|
3030332422
|
1a411da133
|
fix:修复FunASR多设备连接时声纹识别配置相互覆盖的问题
|
2025-07-16 15:42:21 +08:00 |
|
Sakura-RanChen
|
e2a7534aa5
|
update: 优化相关处理
|
2025-07-16 15:03:53 +08:00 |
|
3030332422
|
953a232654
|
fix: 修复使用豆包流式ASR时,不能使用声纹识别功能的问题。
|
2025-07-15 18:13:01 +08:00 |
|
3030332422
|
dc78057823
|
fix:修复多模块部署时远程ASR声纹识别功能未初始化的问题
|
2025-07-15 14:52:56 +08:00 |
|
Sakura-RanChen
|
2c33ee5b32
|
update: 优化文本处理
|
2025-07-14 17:34:42 +08:00 |
|
Sakura-RanChen
|
04ed5ed980
|
update: 同步非流式处理 10秒超时链接不复用
|
2025-07-11 18:04:00 +08:00 |
|
 欣南科技andGitHub
|
a491ce96cb
|
Merge branch 'main' into py_fix_log
|
2025-07-11 17:29:37 +08:00 |
|
3030332422
|
47e4c0f190
|
fix:日志文件的优化
|
2025-07-11 16:44:50 +08:00 |
|
Sakura-RanChen
|
8e5d933745
|
update: 优化音频播放 文本发送
|
2025-07-11 16:36:47 +08:00 |
|
hrz
|
c6225f3ab8
|
update:优化总结
|
2025-07-11 15:42:46 +08:00 |
|
Sakura-RanChen
|
23cd453af8
|
update: aliyun双流改造 待优化长连接机制和文本生成反馈为空
|
2025-07-11 11:36:58 +08:00 |
|
 欣南科技andGitHub
|
8f6dd22a6d
|
Merge pull request #1804 from xinnan-tech/mangger-api-voice-print
声纹识别
|
2025-07-11 10:19:15 +08:00 |
|
hrz
|
108c87f395
|
update:优化提示词
|
2025-07-11 10:15:14 +08:00 |
|
3030332422
|
2fbee33185
|
update:python对接声纹识别优化
|
2025-07-10 15:03:49 +08:00 |
|
hrz
|
6da3138814
|
Merge branch 'main' into py_test_tts
|
2025-07-10 13:47:53 +08:00 |
|
luruxian
|
fbd4a22e3e
|
feat(asr): 添加OpenAI和Groq语音识别支持
新增GPT语音识别模型供应器和配置,实现语音转文本功能
更新相关文档说明,包含API申请步骤和使用注意事项
|
2025-07-10 11:41:20 +08:00 |
|
Sakura-RanChen
|
dede73e9a5
|
fix: id一致 方法流程
|
2025-07-10 11:34:31 +08:00 |
|
Sakura-RanChen
|
ce358dcd65
|
fix: 音频播放方法跟随主分支
|
2025-07-10 10:17:07 +08:00 |
|
hrz
|
01158e67e0
|
add:智控台返回声纹接口信息
|
2025-07-10 09:54:16 +08:00 |
|
 
|
f4cfa04954
|
update: TTS复用链接,VAD双阈值判断 (#1742)
* update: TTS复用链接,VAD双阈值判断
* fix: 播放音乐时,引导词卡顿
* update:优化引导词
* update: 优化chat函数流程 优化huoshan处理 会话保持一致性
* fix: 等待时可能已经完成(设置为None),后续对None错误访问
* update:增加书名号
* fix: 打断状态未重置 监听未完成时服务端可能还在发送数据 此时复用链接会接收上个语音的残余 需要两者一同关闭
---------
Co-authored-by: hrz <1710360675@qq.com>
|
2025-07-09 18:34:04 +08:00 |
|
Sakura-RanChen
|
2625133f40
|
fix: 打断状态未重置 监听未完成时服务端可能还在发送数据 此时复用链接会接收上个语音的残余 需要两者一同关闭
|
2025-07-09 17:04:42 +08:00 |
|
 hrzandGitHub
|
29b4d0daeb
|
Merge branch 'mangger-api-voice-print' into py_test
|
2025-07-09 16:51:10 +08:00 |
|
3030332422
|
d13fb73c67
|
update:优化
|
2025-07-09 14:23:47 +08:00 |
|