 wengzhandGitHub
|
f0b176768d
|
Merge branch 'main' into py_test_AudioArtifacts
|
2026-02-02 14:23:01 +08:00 |
|
 Sakura-RanChenandGitHub
|
d02d094219
|
Merge pull request #2924 from shengzhou1216/refactor/asr-delete_audio
refactor(asr): 重构speech_to_text方法以接收artifacts参数
|
2026-02-02 11:42:59 +08:00 |
|
Sakura-RanChen
|
f5b4bae927
|
fix: 模式切换时音频残余,优化相关状态管理
|
2026-02-02 11:29:47 +08:00 |
|
huozaimengli
|
614b662e3d
|
refactor(asr): 重构speech_to_text方法以接收artifacts参数
移除各ASR提供者中重复的get_current_artifacts调用,改为通过参数传递artifacts
修改base类中process_audio方法,根据combined_pcm_data长度决定是否创建artifacts
更新所有speech_to_text方法签名,添加artifacts可选参数并更新文档字符串
|
2026-01-29 16:39:35 +08:00 |
|
Sakura-RanChen
|
bbf3858735
|
fix: 保存音频数据文件时文本不记录
|
2026-01-27 16:22:35 +08:00 |
|
 Sakura-RanChenandGitHub
|
22d0dcdf58
|
Merge pull request #2887 from shengzhou1216/refactor/asr-delete_audio
refactor(asr): 统一音频预处理逻辑并引入AudioArtifacts
|
2026-01-27 15:41:46 +08:00 |
|
Sakura-RanChen
|
4dde66339b
|
补充minimax接口错误信息
|
2026-01-27 11:22:32 +08:00 |
|
 rainv123andGitHub
|
43234f4798
|
Merge pull request #2836 from xinnan-tech/py_audio_rate
update: 自定义配置输出音频采样率
|
2026-01-27 10:58:32 +08:00 |
|
Sakura-RanChen
|
c313997a61
|
去除调试输出
|
2026-01-26 16:33:09 +08:00 |
|
huozaimengli
|
15650e1a6c
|
refactor(asr): 统一音频预处理逻辑并引入AudioArtifacts
重构所有ASR提供商的speech_to_text方法,将重复的音频解码、合并和文件保存逻辑提取到基类的speech_to_text_wrapper中。引入AudioArtifacts数据类封装PCM帧、字节数据、文件路径和临时路径,简化各提供商实现。移除各提供商中的冗余文件清理代码,由基类统一处理。
新增requires_file()和prefers_temp_file()方法允许提供商声明文件需求,优化内存和磁盘使用。保持接口兼容性的同时提高代码复用性和可维护性。
|
2026-01-25 11:27:34 +08:00 |
|
Sakura-RanChen
|
ce00c862fe
|
HuoshanDoubleStreamTTS增加自定义配置
|
2026-01-23 17:16:46 +08:00 |
|
3030332422
|
7094548ecf
|
fix: 修复开机立刻唤醒导致客户端 MCP 工具列表为空的问题
|
2026-01-16 18:04:04 +08:00 |
|
Sakura-RanChen
|
fd1dd39463
|
update: 自定义配置输出音频采样率
|
2026-01-14 17:54:50 +08:00 |
|
Sakura-RanChen
|
24519a2732
|
TTS文本过滤
|
2026-01-07 17:38:38 +08:00 |
|
Sakura-RanChen
|
e6108ccbbd
|
增加ASR情绪和语种返回
|
2026-01-05 11:17:04 +08:00 |
|
 Sakura-RanChenandGitHub
|
85919e800e
|
Merge pull request #2552 from Packeting1/multi_lang_tts
feat: 为阿里百炼流式TTS支持多语言音色
|
2026-01-04 15:02:24 +08:00 |
|
Sakura-RanChen
|
d1f6774e58
|
update: 增加火山流式情感字段支持
|
2025-12-30 16:46:04 +08:00 |
|
Sakura-RanChen
|
c511766e9d
|
update: 增加豆包流式多语种识别
|
2025-12-29 16:38:23 +08:00 |
|
FAN-yeB
|
46abb1009a
|
update:初始化阿里云百炼asr供应器 手动模式待更改
|
2025-12-26 16:13:14 +08:00 |
|
 CGDandGitHub
|
68b0d9654c
|
Merge branch 'main' into py_tts_huoshan
|
2025-12-26 14:46:51 +08:00 |
|
 rainv123andGitHub
|
9541e85600
|
Merge pull request #2743 from xinnan-tech/py_async_server-mcp
update:将服务端MCP的初始化MCP服务从串行改为并发执行,并添加超时机制
|
2025-12-23 16:50:26 +08:00 |
|
 rainv123andGitHub
|
9ecd829bfa
|
Merge pull request #2747 from xinnan-tech/py_asr_doubao_stream
豆包ASR流式自定义语句停止时长
|
2025-12-23 16:49:56 +08:00 |
|
3030332422
|
e066c1d6a1
|
update:超时时间更改为10秒,并且删去无用的模块导入
|
2025-12-22 16:38:28 +08:00 |
|
3030332422
|
85f5404b3b
|
update:添加锁保护避免MCP并发初始化时的竞态条件
|
2025-12-22 15:56:40 +08:00 |
|
Sakura-RanChen
|
33c5893d32
|
豆包ASR流式自定义语句停止时长
|
2025-12-22 15:23:55 +08:00 |
|
hrz
|
b597cb0686
|
update:移除无用代码
|
2025-12-20 00:30:20 +08:00 |
|
hrz
|
d217cc4dd0
|
update:移除无用代码
|
2025-12-19 22:31:20 +08:00 |
|
rainv123
|
53bcee7032
|
Merge branch 'manager-web-logo-i18n' of https://github.com/xinnan-tech/xiaozhi-esp32-server into new
|
2025-12-19 14:06:19 +08:00 |
|
3030332422
|
6c57ce9dd2
|
update:将服务端MCP的初始化MCP服务从串行改为并发执行,并添加超时机制
|
2025-12-19 11:49:42 +08:00 |
|
Packeting1
|
6cdbe45313
|
feat: 为阿里百炼流式TTS添加多语言音色支持、相关 音色配置;
|
2025-12-16 11:35:58 +08:00 |
|
Sakura-RanChen
|
20f601e607
|
fix: 同步方法使用线程池避免阻塞
|
2025-12-12 15:39:30 +08:00 |
|
Sakura-RanChen
|
c8d2d2255d
|
fix: 音频影响线程问题
|
2025-12-12 15:08:40 +08:00 |
|
rainv123
|
d6697948c2
|
fix:使用java端做聊天记录总结
|
2025-12-12 12:53:59 +08:00 |
|
Sakura-RanChen
|
f88abd7638
|
fix: 聆听设备误触发
|
2025-12-12 09:46:15 +08:00 |
|
Sakura-RanChen
|
fbfc408e94
|
update: 长按设备ASR适配
|
2025-12-11 17:12:56 +08:00 |
|
FAN-yeB
|
3a74b30a0e
|
更新 qwen3_asr_flash.py
|
2025-12-10 17:57:26 +08:00 |
|
FAN-yeB
|
60521b0a7e
|
update:长按说话不走VAD直接触发ASR识别
|
2025-12-09 14:42:50 +08:00 |
|
Sakura-RanChen
|
fb5c35e6c9
|
后台初始化组件,gc全局化避免每次回收触发GIL锁,音频定时发送
|
2025-11-28 16:12:19 +08:00 |
|
hrz
|
4645c50f6d
|
update:将垃圾回收放置ws关闭处,避免频繁操作
|
2025-11-25 16:11:48 +08:00 |
|
Chingfeng Li
|
9e39883276
|
移除OpenAI不支持的参数top_k
|
2025-11-24 16:29:46 +08:00 |
|
hrz
|
83a3d0eabe
|
update:优化代码
|
2025-11-23 15:11:35 +08:00 |
|
3030332422
|
5d439a4168
|
update:内存泄漏
|
2025-11-23 11:55:38 +08:00 |
|
Sakura-RanChen
|
3c46e16494
|
自主选择链接复用功能
|
2025-11-22 16:19:13 +08:00 |
|
Chingfeng Li
|
8b4f9ab20e
|
Add ProgressFnT LoggingFnT...
|
2025-11-21 14:27:18 +08:00 |
|
Sakura-RanChen
|
38d50f4275
|
fix: 长按设备过于灵敏
|
2025-11-21 10:11:50 +08:00 |
|
Sakura-RanChen
|
8bae0c8ac5
|
参数补充
|
2025-11-18 14:40:17 +08:00 |
|
Sakura-RanChen
|
637b528aad
|
fix: 去除默认值配置
|
2025-11-13 17:08:21 +08:00 |
|
shiyin
|
578ed62d18
|
火山双流式TTS日志bug修复
|
2025-11-13 14:28:21 +08:00 |
|
hrz
|
8a4f786c0b
|
update:ragflow教程升级到0.22.0
|
2025-11-13 10:44:00 +08:00 |
|
 hrzandGitHub
|
ff3e308ce8
|
Merge pull request #2500 from xinnan-tech/py-test-mem0.ai
fix:修复 Mem0 搜索缺少 filters 导致的报错
|
2025-11-11 22:53:47 +08:00 |
|