update: 增加豆包流式多语种识别

This commit is contained in:
Sakura-RanChen
2025-12-29 16:38:23 +08:00
parent 46abb1009a
commit c511766e9d
7 changed files with 114 additions and 58 deletions
+7 -2
View File
@@ -346,6 +346,11 @@ ASR:
# 热词、替换词使用流程:https://www.volcengine.com/docs/6561/155738
boosting_table_name: (选填)你的热词文件名称
correct_table_name: (选填)你的替换词文件名称
# 是否开启多语种识别模式
enable_multilingual: False
# 多语种识别当该键为空时,该模型支持中英文、上海话、闽南语,四川、陕西、粤语识别。当将其设置为特定键时,它可以识别指定语言。
# 详细语言列表参考 https://www.volcengine.com/docs/6561/1354869
# language: zh-cn
# 静音判定时长(ms),默认200ms
end_window_size: 200
output_dir: tmp/
@@ -496,11 +501,11 @@ ASR:
# 可选参数
disfluency_removal_enabled: false # 是否过滤语气词(如"嗯"、"啊"等)
semantic_punctuation_enabled: false # 语义断句(true:会议场景,准确;false:VAD断句,交互场景,低延迟)
max_sentence_silence: 800 # VAD断句静音时长阈值(ms),范围200-6000,仅VAD断句时生效
max_sentence_silence: 200 # VAD断句静音时长阈值(ms),范围200-6000,仅VAD断句时生效
multi_threshold_mode_enabled: false # 防止VAD断句切割过长,仅VAD断句时生效
punctuation_prediction_enabled: true # 是否自动添加标点符号
heartbeat: false # 是否开启长连接心跳(持续静音下保持连接)
inverse_text_normalization_enabled: true # 是否开启ITN(中文数字转阿拉伯数字)
# 热词定制文档地址:https://help.aliyun.com/zh/model-studio/custom-hot-words?
# vocabulary_id: vocab-xxx-24ee19fa8cfb4d52902170a0xxxxxxxx # 热词ID(可选)
# language_hints: ["zh", "en"] # 指定语言(可选),支持zh、en、ja、yue、ko、de、fr、ru
output_dir: tmp/