huozaimengli
|
614b662e3d
|
refactor(asr): 重构speech_to_text方法以接收artifacts参数
移除各ASR提供者中重复的get_current_artifacts调用,改为通过参数传递artifacts
修改base类中process_audio方法,根据combined_pcm_data长度决定是否创建artifacts
更新所有speech_to_text方法签名,添加artifacts可选参数并更新文档字符串
|
2026-01-29 16:39:35 +08:00 |
|
huozaimengli
|
15650e1a6c
|
refactor(asr): 统一音频预处理逻辑并引入AudioArtifacts
重构所有ASR提供商的speech_to_text方法,将重复的音频解码、合并和文件保存逻辑提取到基类的speech_to_text_wrapper中。引入AudioArtifacts数据类封装PCM帧、字节数据、文件路径和临时路径,简化各提供商实现。移除各提供商中的冗余文件清理代码,由基类统一处理。
新增requires_file()和prefers_temp_file()方法允许提供商声明文件需求,优化内存和磁盘使用。保持接口兼容性的同时提高代码复用性和可维护性。
|
2026-01-25 11:27:34 +08:00 |
|
hrz
|
d06e297c2d
|
update:ASR加入队列
|
2025-06-04 11:41:04 +08:00 |
|
hrz
|
bb42095ca0
|
update:兼容豆包流式ASR
|
2025-05-29 23:56:34 +08:00 |
|
hrz
|
d86a2cf9de
|
update:抽离公共方法save_audio_to_file到父类
|
2025-05-29 10:38:01 +08:00 |
|
hrz
|
f6f7879d6e
|
fix:修正warn为warning
|
2025-05-14 10:40:40 +08:00 |
|
 hrzandGitHub
|
98bfe863fe
|
修复test_page.html没有hello消息,导致缺失audio_format的bug (#1151)
|
2025-05-08 15:08:11 +08:00 |
|
玄凤科技
|
ba86b34a8c
|
pcm模式,同步其他asr
|
2025-05-07 11:34:29 +08:00 |
|
玄凤科技
|
bde260b330
|
PCM音频模式
|
2025-05-06 14:57:29 +08:00 |
|
王华侨
|
727621fdac
|
规范asr部分的代码
|
2025-05-03 22:20:50 +08:00 |
|
MakerZorky
|
16e77b02c2
|
update:所有ASR均改为PCM直接识别,通过delete_audio参数判断要不要储存wav
|
2025-04-29 01:28:06 +08:00 |
|
JoeyZhou
|
d2d97149fc
|
feat:新增腾讯云ASR语音识别服务
|
2025-03-31 15:19:29 +08:00 |
|