增加豆包语音合成模型2.0专属供应器

This commit is contained in:
Sakura-RanChen
2026-04-21 15:33:37 +08:00
parent dc7615c008
commit 4313216816
3 changed files with 135 additions and 1 deletions
+25
View File
@@ -796,6 +796,31 @@ TTS:
# - source_speaker: zh_male_ahu_conversation_wvae_bigtts
# mix_factor: 0.4
# language: "中文" # 指定输出语种,如:中文、英语、日语、韩语等,请根据所选音色支持的语言进行设置,不填则默认为中文
#豆包语音合成模型2.0,支持双向流式tts(基于seed-tts-2.0资源)
HuoshanDoubleStreamTTSV2:
type: huoshan_double_stream
# 访问 https://console.volcengine.com/speech/service/10035 开通语音合成大模型,购买音色
# 在页面底部获取appid和access_token
# 资源ID固定为:seed-tts-2.0(豆包语音合成模型2.0
# 如果是机智云,把接口地址换成wss://bytedance.gizwitsapi.com/api/v3/tts/bidirection
# 机智云不需要天填 appid
ws_url: wss://openspeech.bytedance.com/api/v3/tts/bidirection
appid: 你的火山引擎语音合成服务appid
access_token: 你的火山引擎语音合成服务access_token
resource_id: seed-tts-2.0
speaker: zh_female_xiaohe_uranus_bigtts
# 开启WebSocket连接复用,默认复用(注意:复用后设备处于聆听状态时空闲链接会占并发数)
enable_ws_reuse: True
# 相关参数文档:https://www.volcengine.com/docs/6561/1329505
# 音频输出配置(audio_params)- 用户可自定义添加火山引擎支持的任何音频参数
audio_params:
speech_rate: 0 # 语速(-50~100)
loudness_rate: 0 # 音量(-50~100)
# 高级文本处理配置(additions)- 用户可自定义添加火山引擎支持的任何高级参数
additions:
post_process:
pitch: 0 # 音高(-12~12)
# language: "中文" # 指定输出语种,如:中文、英语、日语、韩语等,请根据所选音色支持的语言进行设置,不填则默认为中文
CosyVoiceSiliconflow:
type: siliconflow
# 硅基流动TTS