Chingfeng Li
|
095fe72db0
|
待完善流控方式
|
2025-08-05 18:35:37 +08:00 |
|
Chingfeng Li
|
ac1e19f621
|
调整流式处理opus
|
2025-08-05 14:10:55 +08:00 |
|
Chingfeng Li
|
8b81b918cc
|
移除未使用的total_duration返回值
|
2025-08-04 13:49:12 +08:00 |
|
yaotutu
|
9edd083411
|
feat: 添加 Sherpa-ONNX Paraformer 模型支持
- 在 sherpa_onnx_local.py 中添加 model_type 参数,支持 paraformer 和 sense_voice 两种模型类型
- 在 config.yaml 中添加 SherpaParaformerASR 配置示例
- 添加详细的 Paraformer 使用文档 (docs/sherpa-paraformer-guide.md)
- 保持向后兼容,默认使用 sense_voice 模型
这个改动允许用户在低性能设备(如 RK3566)上使用更轻量的 Paraformer 模型,
相比 SenseVoice (894MB),Paraformer-small (78MB) 可以提供 4-6 倍的识别速度提升。
|
2025-07-30 10:41:27 +08:00 |
|
Chingfeng Li
|
b07a8796ff
|
阿里云ECS内网访问协议设置
|
2025-07-28 17:06:53 +08:00 |
|
 hrzandGitHub
|
3699d28dd0
|
Merge pull request #1893 from Hmmrrr/main
feat:添加minimax单向双向流式
|
2025-07-24 14:18:19 +08:00 |
|
Sakura-RanChen
|
e93053d412
|
fix: 文本重复发送
|
2025-07-23 14:35:59 +08:00 |
|
Hmmrrr
|
fadf18b7fc
|
feat:添加minimax单向双向流式
|
2025-07-22 18:13:05 +08:00 |
|
hrz
|
60cbe1571c
|
update:修复cosyvoice非流式合成方法
|
2025-07-22 13:25:54 +08:00 |
|
 hrzandGitHub
|
6740d6a723
|
Merge pull request #1885 from xinnan-tech/py_prompt_emoji
Py prompt emoji
|
2025-07-21 23:18:30 +08:00 |
|
Sakura-RanChen
|
bc5586a077
|
update: HuoshanTTS服务器资源释放
|
2025-07-21 17:46:22 +08:00 |
|
hrz
|
f6e79e17b7
|
update:更正cosyvoice大模型节点
|
2025-07-21 12:03:53 +08:00 |
|
Sakura-RanChen
|
eead126f7a
|
update: 表情由llm发送,长文本进行约束
|
2025-07-21 09:30:23 +08:00 |
|
3030332422
|
b8136ac1dc
|
fix:修复阿里云流式ASR音频传递问题
|
2025-07-19 18:17:21 +08:00 |
|
3030332422
|
6d5b53fcd5
|
fix: 修复阿里云流式ASR终止协议缺失问题
|
2025-07-19 12:16:12 +08:00 |
|
hrz
|
5cf8eb5e71
|
update:优化OpenaiASR、GroqASR配置
|
2025-07-19 01:03:36 +08:00 |
|
hrz
|
7fb028205f
|
Merge branch 'main' into py_test_tts
# Conflicts:
# main/manager-api/src/main/resources/db/changelog/db.changelog-master.yaml
|
2025-07-17 14:32:50 +08:00 |
|
 hrzandGitHub
|
f70652f165
|
Merge branch 'py_test_tts' into openai-asr
|
2025-07-17 11:31:44 +08:00 |
|
3030332422
|
8831ea22b7
|
update:删去一些重复、不用的代码
|
2025-07-16 16:43:49 +08:00 |
|
3030332422
|
1a411da133
|
fix:修复FunASR多设备连接时声纹识别配置相互覆盖的问题
|
2025-07-16 15:42:21 +08:00 |
|
Sakura-RanChen
|
e2a7534aa5
|
update: 优化相关处理
|
2025-07-16 15:03:53 +08:00 |
|
3030332422
|
953a232654
|
fix: 修复使用豆包流式ASR时,不能使用声纹识别功能的问题。
|
2025-07-15 18:13:01 +08:00 |
|
Sakura-RanChen
|
2c33ee5b32
|
update: 优化文本处理
|
2025-07-14 17:34:42 +08:00 |
|
Sakura-RanChen
|
04ed5ed980
|
update: 同步非流式处理 10秒超时链接不复用
|
2025-07-11 18:04:00 +08:00 |
|
Sakura-RanChen
|
8e5d933745
|
update: 优化音频播放 文本发送
|
2025-07-11 16:36:47 +08:00 |
|
hrz
|
c6225f3ab8
|
update:优化总结
|
2025-07-11 15:42:46 +08:00 |
|
Sakura-RanChen
|
23cd453af8
|
update: aliyun双流改造 待优化长连接机制和文本生成反馈为空
|
2025-07-11 11:36:58 +08:00 |
|
 欣南科技andGitHub
|
8f6dd22a6d
|
Merge pull request #1804 from xinnan-tech/mangger-api-voice-print
声纹识别
|
2025-07-11 10:19:15 +08:00 |
|
hrz
|
6da3138814
|
Merge branch 'main' into py_test_tts
|
2025-07-10 13:47:53 +08:00 |
|
luruxian
|
fbd4a22e3e
|
feat(asr): 添加OpenAI和Groq语音识别支持
新增GPT语音识别模型供应器和配置,实现语音转文本功能
更新相关文档说明,包含API申请步骤和使用注意事项
|
2025-07-10 11:41:20 +08:00 |
|
Sakura-RanChen
|
dede73e9a5
|
fix: id一致 方法流程
|
2025-07-10 11:34:31 +08:00 |
|
Sakura-RanChen
|
ce358dcd65
|
fix: 音频播放方法跟随主分支
|
2025-07-10 10:17:07 +08:00 |
|
 
|
f4cfa04954
|
update: TTS复用链接,VAD双阈值判断 (#1742)
* update: TTS复用链接,VAD双阈值判断
* fix: 播放音乐时,引导词卡顿
* update:优化引导词
* update: 优化chat函数流程 优化huoshan处理 会话保持一致性
* fix: 等待时可能已经完成(设置为None),后续对None错误访问
* update:增加书名号
* fix: 打断状态未重置 监听未完成时服务端可能还在发送数据 此时复用链接会接收上个语音的残余 需要两者一同关闭
---------
Co-authored-by: hrz <1710360675@qq.com>
|
2025-07-09 18:34:04 +08:00 |
|
Sakura-RanChen
|
2625133f40
|
fix: 打断状态未重置 监听未完成时服务端可能还在发送数据 此时复用链接会接收上个语音的残余 需要两者一同关闭
|
2025-07-09 17:04:42 +08:00 |
|
 hrzandGitHub
|
29b4d0daeb
|
Merge branch 'mangger-api-voice-print' into py_test
|
2025-07-09 16:51:10 +08:00 |
|
3030332422
|
d13fb73c67
|
update:优化
|
2025-07-09 14:23:47 +08:00 |
|
Sakura-RanChen
|
62e39dd0e2
|
fix: 等待时可能已经完成(设置为None),后续对None错误访问
|
2025-07-09 11:18:26 +08:00 |
|
Sakura-RanChen
|
44593ff3f3
|
update: 优化chat函数流程 优化huoshan处理 会话保持一致性
|
2025-07-08 17:48:50 +08:00 |
|
hrz
|
ab890ada37
|
update:强化小智提示词
|
2025-07-08 16:59:38 +08:00 |
|
CGD
|
5c83d63fe2
|
update:声纹识别对接的优化
|
2025-07-08 11:25:54 +08:00 |
|
CGD
|
155ba92ba6
|
update:增加了智控台的sql语句,优化了部分配置
|
2025-07-07 15:29:13 +08:00 |
|
ganbin
|
2535ff6c90
|
fix: 修正VLLM本地调用,question参数为空会用英文回复的问题
|
2025-07-07 09:02:59 +08:00 |
|
CGD
|
3d64152dba
|
update:python单模块部署声纹识别对接
|
2025-07-04 17:11:44 +08:00 |
|
Sakura-RanChen
|
7e5a2b4549
|
fix: 播放音乐时,引导词卡顿
|
2025-07-04 11:27:49 +08:00 |
|
Sakura-RanChen
|
69cac9d40a
|
update: TTS复用链接,VAD双阈值判断
|
2025-07-03 09:16:06 +08:00 |
|
CGD
|
039badd265
|
update:添加了阿里云CosyVoice流式TTS
|
2025-07-01 18:14:36 +08:00 |
|
CGD
|
90a9631450
|
update:添加阿里云流式asr
|
2025-06-30 14:41:53 +08:00 |
|
 hrzandGitHub
|
3015b01740
|
Merge branch 'newsnow' into add_local_tts_change_voice
|
2025-06-30 10:48:06 +08:00 |
|
 hrzandGitHub
|
96abc34a92
|
Merge branch 'newsnow' into main
|
2025-06-30 10:44:39 +08:00 |
|
 hrzandGitHub
|
26553b8875
|
Update openai.py
|
2025-06-30 10:41:15 +08:00 |
|