From ae55007c5ce19ab7ed398f6a9f2f1173d08b33f8 Mon Sep 17 00:00:00 2001 From: =?UTF-8?q?Stardust=C2=B7=E5=87=8F?= Date: Wed, 4 Oct 2023 21:44:18 +0800 Subject: [PATCH] =?UTF-8?q?=E4=BF=AE=E6=AD=A3=E5=A4=9A=E8=AF=AD=E8=A8=80?= =?UTF-8?q?=E6=8E=A8=E7=90=86?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- webui.py | 5 +++-- 1 file changed, 3 insertions(+), 2 deletions(-) diff --git a/webui.py b/webui.py index 742b7c2..e3196ad 100644 --- a/webui.py +++ b/webui.py @@ -101,15 +101,16 @@ def infer(text, sdp_ratio, noise_scale, noise_scale_w, length_scale, sid, langua .numpy() ) del x_tst, tones, lang_ids, bert, x_tst_lengths, speakers + torch.cuda.empty_cache() return audio -def tts_fn(text, speaker, sdp_ratio, noise_scale, noise_scale_w, length_scale): +def tts_fn(text, speaker, sdp_ratio, noise_scale, noise_scale_w, length_scale, language): slices = text.split("|") audio_list = [] with torch.no_grad(): for slice in slices: - audio = infer(slice, sdp_ratio=sdp_ratio, noise_scale=noise_scale, noise_scale_w=noise_scale_w, length_scale=length_scale, sid=speaker) + audio = infer(slice, sdp_ratio=sdp_ratio, noise_scale=noise_scale, noise_scale_w=noise_scale_w, length_scale=length_scale, sid=speaker, language=language) audio_list.append(audio) silence = np.zeros(hps.data.sampling_rate) # 生成1秒的静音 audio_list.append(silence) # 将静音添加到列表中