Chingfeng Li
|
833f379aa1
|
优化日志级别,生产环境中INFO避免打印过多日志
|
2025-11-11 18:52:14 +08:00 |
|
Sakura-RanChen
|
e1056f72e1
|
fix: 等待音频过长时需修正包状态
|
2025-11-03 15:17:52 +08:00 |
|
Sakura-RanChen
|
ec07088c13
|
fix: 流控状态未重置
update: 增加流式预缓冲
|
2025-11-01 17:59:16 +08:00 |
|
 hrzandGitHub
|
4b2d7da4e5
|
Merge pull request #2357 from kkroid/feature_tts-audio-send-delay
feat: 添加可配置的TTS音频发送延迟功能
|
2025-10-22 11:48:34 +08:00 |
|
Sakura-RanChen
|
c06a7b1db6
|
update: 优化vad判断逻辑
|
2025-10-20 11:45:50 +08:00 |
|
will.zhang
|
3b8bbb5c5f
|
feat: 添加可配置的TTS音频发送延迟功能
- 修改 sendAudio() 函数,新增 tts_audio_send_delay 配置参数(毫秒)
- 0: 使用原有逻辑
- 大于0: 使用固定延迟发送(降低首包延迟,提升响应速度)
|
2025-10-14 18:30:17 +08:00 |
|
Sakura-RanChen
|
4952ccfbf7
|
fix: 相关状态未重置
|
2025-10-13 16:47:05 +08:00 |
|
1cccux
|
450560f92a
|
fix:修复长按聆听设备松开没有声音的问题
|
2025-10-13 10:57:48 +08:00 |
|
hrz
|
44f41ebd11
|
fix:回复词太短
|
2025-10-12 23:24:43 +08:00 |
|
3030332422
|
b5a3cc1c78
|
update:修改唤醒词
|
2025-10-11 15:48:27 +08:00 |
|
Sakura-RanChen
|
c2985c0db3
|
update: 阿里百炼流式TTS 减少调试日志显示
fix: 音频发送误差修正
|
2025-09-16 17:07:00 +08:00 |
|
 hrzandGitHub
|
f3431ea977
|
Merge pull request #2203 from xinnan-tech/py_fix_intentllm
fix:修复LLM意图识别的若干问题
|
2025-09-11 14:46:10 +08:00 |
|
3030332422
|
f0a7ee1c0c
|
fix:修复LLM意图识别
|
2025-09-11 14:38:27 +08:00 |
|
hrz
|
26fd3110b4
|
update:优化代码
|
2025-09-10 22:20:43 +08:00 |
|
hrz
|
5bd78cac1a
|
update:优化代码
|
2025-09-10 21:40:25 +08:00 |
|
3030332422
|
0738c52d14
|
fix:修复LLM意图识别的若干问题
|
2025-09-10 18:00:39 +08:00 |
|
FAN-yeB
|
f81be33539
|
优化mqtt启用
|
2025-09-10 17:46:55 +08:00 |
|
FAN-yeB
|
eee907b1a2
|
兼容udp和websocket协议传输音频
|
2025-09-09 09:37:31 +08:00 |
|
FAN-yeB
|
eed9503391
|
mqtt
|
2025-09-08 11:04:42 +08:00 |
|
 CGDandGitHub
|
bd8ae27f92
|
Merge branch 'main' into future
|
2025-09-05 10:14:52 +08:00 |
|
Sakura-RanChen
|
66f382039c
|
fix: 打断时状态未回正,提示无法正确播报
|
2025-09-03 10:46:24 +08:00 |
|
Chingfeng Li
|
3cfc1cf97a
|
textHandle.py 消息解耦
|
2025-09-03 09:43:34 +08:00 |
|
Sakura-RanChen
|
b88b102d38
|
修改注解
|
2025-09-02 17:08:56 +08:00 |
|
Sakura-RanChen
|
fa3ddc2e2b
|
去除无用变量
|
2025-09-02 17:06:19 +08:00 |
|
Sakura-RanChen
|
f45bc5d9c9
|
优化音频
|
2025-09-02 15:24:51 +08:00 |
|
Sakura-RanChen
|
b9df6d4ad2
|
fix: 优化
|
2025-09-02 14:34:26 +08:00 |
|
Sakura-RanChen
|
c3c2e7c28e
|
fix: 提示尾音播放和单模块第一次唤醒时等待tts初始化
|
2025-09-02 12:00:04 +08:00 |
|
Sakura-RanChen
|
c428a9ddee
|
fix: 唤醒机制
|
2025-09-02 11:18:04 +08:00 |
|
hrz
|
eaade698fb
|
update:流式优化暂不稳定,先回滚到早期代码
|
2025-08-30 22:59:21 +08:00 |
|
Sakura-RanChen
|
41b8fac3aa
|
update: 增加唤醒时声纹处理 ,1秒内发送至大模型 【需优化唤醒锁机制,中途会遭受打断(偶发),考虑忽略检测】
|
2025-08-28 17:58:23 +08:00 |
|
Sakura-RanChen
|
91cd843cfe
|
update: 恢复唤醒播放机制,待优化和改造(目前只有linkerai拥有正常保存唤醒音频to_tts)
|
2025-08-27 10:04:27 +08:00 |
|
Sakura-RanChen
|
1988bced60
|
fix: 优化流控音频播放 wechat聊天模式错误STT消息发送
|
2025-08-22 17:10:36 +08:00 |
|
Sakura-RanChen
|
0ea18d87a3
|
fix: asr识别缺字现象,去除无用的变量
|
2025-08-20 16:22:32 +08:00 |
|
Sakura-RanChen
|
74826c1c59
|
fix
|
2025-08-20 09:30:43 +08:00 |
|
Sakura-RanChen
|
d2f29f335e
|
update: 音频流式优化
|
2025-08-15 16:33:46 +08:00 |
|
Chingfeng Li
|
095fe72db0
|
待完善流控方式
|
2025-08-05 18:35:37 +08:00 |
|
Chingfeng Li
|
ac1e19f621
|
调整流式处理opus
|
2025-08-05 14:10:55 +08:00 |
|
Chingfeng Li
|
8b81b918cc
|
移除未使用的total_duration返回值
|
2025-08-04 13:49:12 +08:00 |
|
Chingfeng Li
|
f40c3ec0f6
|
恢复sentence_start判断
|
2025-07-31 16:59:52 +08:00 |
|
Chingfeng Li
|
71eef4693d
|
仅在首句发送TTS消息
|
2025-07-31 14:15:39 +08:00 |
|
Chingfeng Li
|
ef25e82544
|
移除无用的tts消息sentence_end
|
2025-07-31 13:21:29 +08:00 |
|
hrz
|
ff9fb9eb1b
|
update:优化最后活动时间
|
2025-07-28 22:38:48 +08:00 |
|
Sakura-RanChen
|
83ded8458a
|
Merge branch 'py_test_tts' of https://github.com/xinnan-tech/xiaozhi-esp32-server into py_test_tts
|
2025-07-23 14:40:14 +08:00 |
|
Sakura-RanChen
|
e93053d412
|
fix: 文本重复发送
|
2025-07-23 14:35:59 +08:00 |
|
 欣南科技andGitHub
|
710218b5b5
|
Merge pull request #1716 from xinnan-tech/py_test_tts
update:添加阿里云流式asr
|
2025-07-22 13:27:41 +08:00 |
|
Sakura-RanChen
|
eead126f7a
|
update: 表情由llm发送,长文本进行约束
|
2025-07-21 09:30:23 +08:00 |
|
3030332422
|
f037f4c7de
|
fix: 修复声纹识别场景下的意图识别问题
|
2025-07-18 11:34:14 +08:00 |
|
 欣南科技andGitHub
|
8f6dd22a6d
|
Merge pull request #1804 from xinnan-tech/mangger-api-voice-print
声纹识别
|
2025-07-11 10:19:15 +08:00 |
|
 
|
f4cfa04954
|
update: TTS复用链接,VAD双阈值判断 (#1742)
* update: TTS复用链接,VAD双阈值判断
* fix: 播放音乐时,引导词卡顿
* update:优化引导词
* update: 优化chat函数流程 优化huoshan处理 会话保持一致性
* fix: 等待时可能已经完成(设置为None),后续对None错误访问
* update:增加书名号
* fix: 打断状态未重置 监听未完成时服务端可能还在发送数据 此时复用链接会接收上个语音的残余 需要两者一同关闭
---------
Co-authored-by: hrz <1710360675@qq.com>
|
2025-07-09 18:34:04 +08:00 |
|
3030332422
|
d13fb73c67
|
update:优化
|
2025-07-09 14:23:47 +08:00 |
|