From c449d29de0182255422c35b6a7adbcf49521ef31 Mon Sep 17 00:00:00 2001 From: rainv123 <2148537152@qq.com> Date: Tue, 14 Oct 2025 15:23:48 +0800 Subject: [PATCH] =?UTF-8?q?Update=EF=BC=9A=E6=9B=B4=E6=96=B0=E7=81=AB?= =?UTF-8?q?=E5=B1=B1=E5=8F=8C=E6=B5=81=E5=BC=8F=E8=AF=AD=E9=9F=B3=E5=90=88?= =?UTF-8?q?=E6=88=90+=E9=9F=B3=E8=89=B2=E5=85=8B=E9=9A=86=E9=85=8D?= =?UTF-8?q?=E7=BD=AE=E6=96=87=E6=A1=A3?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- docs/huoshan-streamTTS-voice-cloning.md | 12 ++++++------ 1 file changed, 6 insertions(+), 6 deletions(-) diff --git a/docs/huoshan-streamTTS-voice-cloning.md b/docs/huoshan-streamTTS-voice-cloning.md index 4b242145..44af3fb3 100644 --- a/docs/huoshan-streamTTS-voice-cloning.md +++ b/docs/huoshan-streamTTS-voice-cloning.md @@ -3,16 +3,16 @@ ## 1.开通火山引擎服务 访问 https://console.volcengine.com/speech/app 在应用管理创建应用,勾选语音合成大模型和声音复刻大模型,左边列表点击声音复刻大模型后下滑获得App Id,Access Token,Cluster ID以及声音ID(S_xxxxx) -##2.全模块部署 +### 2.全模块部署 1.填写配置。 -如果你是全模块部署,请在智控台页面模型配置的语音合成页面,找到“火山双流式语音合成”,点击修改,将你火山引擎的App Id,Access Token以及声音ID(S_xxxxx)填进去, -注意:把资源id(Resource-Id)改成```volc.megatts.defaul```或```seed-icl-1.0``` +如果你是全模块部署,请在智控台页面模型配置的语音合成页面,找到“火山双流式语音合成”,点击修改,将你火山引擎的App Id,Access Token以及声音ID(S_xxxxx)填进去。 +#####注意:把资源id(Resource-Id)改成```volc.megatts.defaul```或```seed-icl-1.0``` 2.音色克隆。 准备一段8-60之间的音频文件,点击音色克隆菜单的音色资源,新增音色资源。回到音色克隆页面,点击上传音频。上传好音频之后点击复刻,等1~2秒会返回结果。 复刻成功后,在“火山双流式语音合成”的“音色资源”里可以看到你复刻好的声音,也可以在配置角色使用“火山双流式语音合成”时选择复刻的音色了。 -###3.单模块部署 +### 3.单模块部署 克隆音色请参照教程 https://github.com/104gogo/huoshan-voice-copy 1.音色克隆。 @@ -31,9 +31,9 @@ python tts_http_demo.py ``` 回到火山引擎控制台页面,刷新可以看到声音复刻详情的状态是复刻成功。 -2.填写配置文件(.config.yaml) +2.填写配置文件。(.config.yaml) 注意:修改 resource_id的参数为``` volc.megatts.default``` speaker的参数填入声音ID(S_xxxxx) -启动服务,唤醒小智发出的声音是克隆的音色即成功。 \ No newline at end of file +启动服务,唤醒小智发出的声音是克隆的音色即成功。