This commit is contained in:
litagin02
2024-03-12 21:47:59 +09:00
parent 6e4dcf0232
commit 69225a3e13
9 changed files with 25 additions and 7 deletions

1
.gitignore vendored
View File

@@ -4,6 +4,7 @@ venv/
dist/
.coverage
.ipynb_checkpoints/
.ruff_cache/
/Data/
/model_assets/

View File

@@ -72,6 +72,23 @@ cov = [
"cov-report",
]
[tool.hatch.envs.style]
detached = true
dependencies = [
"black",
"isort",
]
[tool.hatch.envs.style.scripts]
check = [
"black --check --diff .",
"isort --check-only --diff --profile black --gitignore --lai 2 .",
]
fmt = [
"black .",
"isort --profile black --gitignore --lai 2 .",
"check",
]
[[tool.hatch.envs.test.matrix]]
python = ["3.9", "3.10", "3.11"]

View File

@@ -1,6 +1,7 @@
import argparse
import os
from concurrent.futures import ThreadPoolExecutor
from multiprocessing import cpu_count
import librosa
import pyloudnorm as pyln

View File

@@ -8,7 +8,7 @@ import os
import sys
from io import BytesIO
from pathlib import Path
from typing import Optional, Any
from typing import Any, Optional
from urllib.parse import unquote
import GPUtil

View File

@@ -1,5 +1,4 @@
import argparse
import os
import shutil
from pathlib import Path

View File

@@ -6,6 +6,7 @@ from typing import Any
import numpy as np
import torch
from numpy.typing import NDArray
from pyannote.audio import Inference, Model
from tqdm import tqdm
from config import config
@@ -13,8 +14,6 @@ from style_bert_vits2.logging import logger
from style_bert_vits2.models.hyper_parameters import HyperParameters
from style_bert_vits2.utils.stdout_wrapper import SAFE_STDOUT
warnings.filterwarnings("ignore", category=UserWarning)
from pyannote.audio import Inference, Model
model = Model.from_pretrained("pyannote/wespeaker-voxceleb-resnet34-LM")
inference = Inference(model, window="whole")

View File

@@ -1,5 +1,6 @@
import argparse
import datetime
import gc
import os
import platform

View File

@@ -39,7 +39,7 @@ bert_models.load_tokenizer(Languages.EN)
bert_models.load_model(Languages.ZH)
bert_models.load_tokenizer(Languages.ZH)
languages = [l.value for l in Languages]
languages = [lang.value for lang in Languages]
initial_text = "こんにちは、初めまして。あなたの名前はなんていうの?"
@@ -100,7 +100,7 @@ examples = [
],
]
initial_md = f"""
initial_md = """
- Ver 2.3で追加されたエディターのほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。
- 初期からある[jvnvのモデル](https://huggingface.co/litagin/style_bert_vits2_jvnv)は、[JVNVコーパス言語音声と非言語音声を持つ日本語感情音声コーパス](https://sites.google.com/site/shinnosuketakamichi/research-topics/jvnv_corpus)で学習されたモデルです。ライセンスは[CC BY-SA 4.0](https://creativecommons.org/licenses/by-sa/4.0/deed.ja)です。

View File

@@ -400,7 +400,7 @@ def run_tensorboard(model_name):
yield gr.Button("Tensorboardを開く")
how_to_md = f"""
how_to_md = """
## 使い方
- データを準備して、モデル名を入力して、必要なら設定を調整してから、「自動前処理を実行」ボタンを押してください。進捗状況等はターミナルに表示されます。