Improve: ONNX conversion logic improved, and support for noise_scale(_w) model argument

This commit is contained in:
tsukumi
2024-09-22 16:14:25 +09:00
parent 9b27ba9777
commit 291e635e9e
3 changed files with 104 additions and 76 deletions

View File

@@ -230,10 +230,10 @@ def infer(
lang_ids,
ja_bert,
style_vec=style_vec_tensor,
length_scale=length_scale,
sdp_ratio=sdp_ratio,
noise_scale=noise_scale,
noise_scale_w=noise_scale_w,
length_scale=length_scale,
)
else:
output = cast(SynthesizerTrn, net_g).infer(
@@ -246,10 +246,10 @@ def infer(
ja_bert,
en_bert,
style_vec=style_vec_tensor,
length_scale=length_scale,
sdp_ratio=sdp_ratio,
noise_scale=noise_scale,
noise_scale_w=noise_scale_w,
length_scale=length_scale,
)
audio = output[0][0, 0].data.cpu().float().numpy()