Sakura-RanChen
|
0ea18d87a3
|
fix: asr识别缺字现象,去除无用的变量
|
2025-08-20 16:22:32 +08:00 |
|
Sakura-RanChen
|
74826c1c59
|
fix
|
2025-08-20 09:30:43 +08:00 |
|
hrz
|
ad50fbe3c9
|
fix: #2067 #2070 OTA和流控的音频bug
|
2025-08-19 00:19:41 +08:00 |
|
hrz
|
61ee21d627
|
update:给LLM性能测试工具增加系统提示词,更符合本项目的实际效果
|
2025-08-17 09:35:06 +08:00 |
|
hrz
|
2d75eb76f1
|
update:引导测试页面启动
|
2025-08-16 14:36:23 +08:00 |
|
 hrzandGitHub
|
e2324d3c37
|
Merge pull request #2044 from xinnan-tech/py_test_audio
Py test audio
|
2025-08-15 17:59:21 +08:00 |
|
Sakura-RanChen
|
d2f29f335e
|
update: 音频流式优化
|
2025-08-15 16:33:46 +08:00 |
|
FAN-yeB
|
7e63e1d607
|
update:更新paddlespeech.py
|
2025-08-13 16:00:33 +08:00 |
|
 Sakura-RanChenandGitHub
|
311e5d5cfd
|
Merge pull request #1988 from myifeng/async-handler
调整OPUS函数式处理,不再以数组方式收集再遍历
|
2025-08-12 10:14:43 +08:00 |
|
Sakura-RanChen
|
3eb39ebef2
|
update: huoshanTTS add config
|
2025-08-11 17:38:17 +08:00 |
|
hrz
|
d742bca205
|
update:添加indextts 流式语音合成
|
2025-08-08 17:32:41 +08:00 |
|
Sakura-RanChen
|
8e51d52155
|
update: 增加单模块IndexTTS
|
2025-08-08 16:55:17 +08:00 |
|
 hrzandGitHub
|
b3f603732e
|
Merge pull request #1915 from YourKnight1/main
调整PaddleSpeechTTS流式传输
|
2025-08-07 23:42:16 +08:00 |
|
Chingfeng Li
|
4d50eeb830
|
修正self错误
|
2025-08-06 14:53:59 +08:00 |
|
Chingfeng Li
|
abf1fa0ef4
|
调整子类
|
2025-08-06 11:34:57 +08:00 |
|
Chingfeng Li
|
903c0e51ee
|
修正剩余文本
|
2025-08-06 10:13:42 +08:00 |
|
Chingfeng Li
|
ce6a711c8e
|
调整流控参数优化
|
2025-08-06 10:09:28 +08:00 |
|
Chingfeng Li
|
095fe72db0
|
待完善流控方式
|
2025-08-05 18:35:37 +08:00 |
|
Chingfeng Li
|
ac1e19f621
|
调整流式处理opus
|
2025-08-05 14:10:55 +08:00 |
|
Chingfeng Li
|
8b81b918cc
|
移除未使用的total_duration返回值
|
2025-08-04 13:49:12 +08:00 |
|
yaotutu
|
9edd083411
|
feat: 添加 Sherpa-ONNX Paraformer 模型支持
- 在 sherpa_onnx_local.py 中添加 model_type 参数,支持 paraformer 和 sense_voice 两种模型类型
- 在 config.yaml 中添加 SherpaParaformerASR 配置示例
- 添加详细的 Paraformer 使用文档 (docs/sherpa-paraformer-guide.md)
- 保持向后兼容,默认使用 sense_voice 模型
这个改动允许用户在低性能设备(如 RK3566)上使用更轻量的 Paraformer 模型,
相比 SenseVoice (894MB),Paraformer-small (78MB) 可以提供 4-6 倍的识别速度提升。
|
2025-07-30 10:41:27 +08:00 |
|
Chingfeng Li
|
b07a8796ff
|
阿里云ECS内网访问协议设置
|
2025-07-28 17:06:53 +08:00 |
|
root
|
04746961f2
|
调整PaddleSpeechTTS流式传输
|
2025-07-25 10:09:04 +08:00 |
|
 hrzandGitHub
|
3699d28dd0
|
Merge pull request #1893 from Hmmrrr/main
feat:添加minimax单向双向流式
|
2025-07-24 14:18:19 +08:00 |
|
Sakura-RanChen
|
e93053d412
|
fix: 文本重复发送
|
2025-07-23 14:35:59 +08:00 |
|
Hmmrrr
|
fadf18b7fc
|
feat:添加minimax单向双向流式
|
2025-07-22 18:13:05 +08:00 |
|
hrz
|
60cbe1571c
|
update:修复cosyvoice非流式合成方法
|
2025-07-22 13:25:54 +08:00 |
|
 hrzandGitHub
|
6740d6a723
|
Merge pull request #1885 from xinnan-tech/py_prompt_emoji
Py prompt emoji
|
2025-07-21 23:18:30 +08:00 |
|
Sakura-RanChen
|
bc5586a077
|
update: HuoshanTTS服务器资源释放
|
2025-07-21 17:46:22 +08:00 |
|
hrz
|
f6e79e17b7
|
update:更正cosyvoice大模型节点
|
2025-07-21 12:03:53 +08:00 |
|
Sakura-RanChen
|
eead126f7a
|
update: 表情由llm发送,长文本进行约束
|
2025-07-21 09:30:23 +08:00 |
|
3030332422
|
b8136ac1dc
|
fix:修复阿里云流式ASR音频传递问题
|
2025-07-19 18:17:21 +08:00 |
|
3030332422
|
6d5b53fcd5
|
fix: 修复阿里云流式ASR终止协议缺失问题
|
2025-07-19 12:16:12 +08:00 |
|
hrz
|
5cf8eb5e71
|
update:优化OpenaiASR、GroqASR配置
|
2025-07-19 01:03:36 +08:00 |
|
hrz
|
7fb028205f
|
Merge branch 'main' into py_test_tts
# Conflicts:
# main/manager-api/src/main/resources/db/changelog/db.changelog-master.yaml
|
2025-07-17 14:32:50 +08:00 |
|
 hrzandGitHub
|
f70652f165
|
Merge branch 'py_test_tts' into openai-asr
|
2025-07-17 11:31:44 +08:00 |
|
3030332422
|
8831ea22b7
|
update:删去一些重复、不用的代码
|
2025-07-16 16:43:49 +08:00 |
|
3030332422
|
1a411da133
|
fix:修复FunASR多设备连接时声纹识别配置相互覆盖的问题
|
2025-07-16 15:42:21 +08:00 |
|
Sakura-RanChen
|
e2a7534aa5
|
update: 优化相关处理
|
2025-07-16 15:03:53 +08:00 |
|
3030332422
|
953a232654
|
fix: 修复使用豆包流式ASR时,不能使用声纹识别功能的问题。
|
2025-07-15 18:13:01 +08:00 |
|
Sakura-RanChen
|
2c33ee5b32
|
update: 优化文本处理
|
2025-07-14 17:34:42 +08:00 |
|
Sakura-RanChen
|
04ed5ed980
|
update: 同步非流式处理 10秒超时链接不复用
|
2025-07-11 18:04:00 +08:00 |
|
Sakura-RanChen
|
8e5d933745
|
update: 优化音频播放 文本发送
|
2025-07-11 16:36:47 +08:00 |
|
hrz
|
c6225f3ab8
|
update:优化总结
|
2025-07-11 15:42:46 +08:00 |
|
Sakura-RanChen
|
23cd453af8
|
update: aliyun双流改造 待优化长连接机制和文本生成反馈为空
|
2025-07-11 11:36:58 +08:00 |
|
 欣南科技andGitHub
|
8f6dd22a6d
|
Merge pull request #1804 from xinnan-tech/mangger-api-voice-print
声纹识别
|
2025-07-11 10:19:15 +08:00 |
|
hrz
|
6da3138814
|
Merge branch 'main' into py_test_tts
|
2025-07-10 13:47:53 +08:00 |
|
luruxian
|
fbd4a22e3e
|
feat(asr): 添加OpenAI和Groq语音识别支持
新增GPT语音识别模型供应器和配置,实现语音转文本功能
更新相关文档说明,包含API申请步骤和使用注意事项
|
2025-07-10 11:41:20 +08:00 |
|
Sakura-RanChen
|
dede73e9a5
|
fix: id一致 方法流程
|
2025-07-10 11:34:31 +08:00 |
|
Sakura-RanChen
|
ce358dcd65
|
fix: 音频播放方法跟随主分支
|
2025-07-10 10:17:07 +08:00 |
|