Update docs

This commit is contained in:
litagin02
2024-02-02 22:53:37 +09:00
parent 3d434fd4c8
commit 59421c07d6
2 changed files with 17 additions and 12 deletions

4
app.py
View File

@@ -191,7 +191,7 @@ examples = [
] ]
initial_md = """ initial_md = """
# Style-Bert-VITS2 音声合成 # Style-Bert-VITS2 ver 2.0 音声合成
注意: 初期からある[jvnvのモデル](https://huggingface.co/litagin/style_bert_vits2_jvnv)は、[JVNVコーパス言語音声と非言語音声を持つ日本語感情音声コーパス](https://sites.google.com/site/shinnosuketakamichi/research-topics/jvnv_corpus)で学習されたモデルです。ライセンスは[CC BY-SA 4.0](https://creativecommons.org/licenses/by-sa/4.0/deed.ja)です。 注意: 初期からある[jvnvのモデル](https://huggingface.co/litagin/style_bert_vits2_jvnv)は、[JVNVコーパス言語音声と非言語音声を持つ日本語感情音声コーパス](https://sites.google.com/site/shinnosuketakamichi/research-topics/jvnv_corpus)で学習されたモデルです。ライセンスは[CC BY-SA 4.0](https://creativecommons.org/licenses/by-sa/4.0/deed.ja)です。
""" """
@@ -215,8 +215,6 @@ model_assets
- `style_vectors.npy`:スタイルベクトルファイル - `style_vectors.npy`:スタイルベクトルファイル
上2つは`Train.bat`による学習で自動的に正しい位置に保存されます。`style_vectors.npy`は`Style.bat`を実行して指示に従って生成してください。 上2つは`Train.bat`による学習で自動的に正しい位置に保存されます。`style_vectors.npy`は`Style.bat`を実行して指示に従って生成してください。
TODO: 現在のところはspeaker_id = 0に固定しており複数話者の合成には対応していません。
""" """
style_md = f""" style_md = f"""

View File

@@ -320,7 +320,7 @@ def train(model_name, skip_style=False, use_jp_extra=True):
initial_md = """ initial_md = """
# Style-Bert-VITS2 学習用WebUI # Style-Bert-VITS2 ver 2.0 学習用WebUI
## 使い方 ## 使い方
@@ -334,6 +334,11 @@ initial_md = """
注意: 音声合成で使うには、スタイルベクトルファイル`style_vectors.npy`を作る必要があります。これは、`Style.bat`を実行してそこで作成してください。 注意: 音声合成で使うには、スタイルベクトルファイル`style_vectors.npy`を作る必要があります。これは、`Style.bat`を実行してそこで作成してください。
動作は軽いはずなので、学習中でも実行でき、何度でも繰り返して試せます。 動作は軽いはずなので、学習中でも実行でき、何度でも繰り返して試せます。
## JP-Extra版について
元とするモデル構造として [Bert-VITS2 Japanese-Extra](https://github.com/fishaudio/Bert-VITS2/releases/tag/JP-Exta) を使うことができます。
日本語のアクセントやイントネーションや自然性が上がる傾向にありますが、英語と中国語は話せなくなります。
""" """
prepare_md = """ prepare_md = """
@@ -371,15 +376,13 @@ if __name__ == "__main__":
gr.Markdown(initial_md) gr.Markdown(initial_md)
with gr.Accordion(label="データの前準備", open=False): with gr.Accordion(label="データの前準備", open=False):
gr.Markdown(prepare_md) gr.Markdown(prepare_md)
model_name = gr.Textbox( model_name = gr.Textbox(label="モデル名")
label="モデル名",
)
gr.Markdown("### 自動前処理") gr.Markdown("### 自動前処理")
with gr.Row(variant="panel"): with gr.Row(variant="panel"):
with gr.Column(): with gr.Column():
use_jp_extra = gr.Checkbox( use_jp_extra = gr.Checkbox(
label="日本語特化版を使う(日本語の性能が上がるが英語と中国語は話せなくなる)", label="JP-Extra版を使う(日本語の性能が上がるが英語と中国語は話せなくなる)",
value=False, value=True,
) )
batch_size = gr.Slider( batch_size = gr.Slider(
label="バッチサイズ", label="バッチサイズ",
@@ -454,7 +457,7 @@ if __name__ == "__main__":
with gr.Column(): with gr.Column():
gr.Markdown(value="#### Step 1: 設定ファイルの生成") gr.Markdown(value="#### Step 1: 設定ファイルの生成")
use_jp_extra_manual = gr.Checkbox( use_jp_extra_manual = gr.Checkbox(
label="日本語特化版を使う", label="JP-Extra版を使う",
value=False, value=False,
) )
batch_size_manual = gr.Slider( batch_size_manual = gr.Slider(
@@ -555,7 +558,7 @@ if __name__ == "__main__":
value=False, value=False,
) )
use_jp_extra_train = gr.Checkbox( use_jp_extra_train = gr.Checkbox(
label="日本語特化版を使う", label="JP-Extra版を使う",
value=True, value=True,
) )
train_btn = gr.Button(value="学習を開始する", variant="primary") train_btn = gr.Button(value="学習を開始する", variant="primary")
@@ -580,6 +583,8 @@ if __name__ == "__main__":
], ],
outputs=[info_all], outputs=[info_all],
) )
# Manual preprocess
generate_config_btn.click( generate_config_btn.click(
second_elem_of(initialize), second_elem_of(initialize),
inputs=[ inputs=[
@@ -608,7 +613,7 @@ if __name__ == "__main__":
) )
preprocess_text_btn.click( preprocess_text_btn.click(
second_elem_of(preprocess_text), second_elem_of(preprocess_text),
inputs=[model_name], inputs=[model_name, use_jp_extra_manual],
outputs=[info_preprocess_text], outputs=[info_preprocess_text],
) )
bert_gen_btn.click( bert_gen_btn.click(
@@ -621,6 +626,8 @@ if __name__ == "__main__":
inputs=[model_name, num_processes_style], inputs=[model_name, num_processes_style],
outputs=[info_style], outputs=[info_style],
) )
# Train
train_btn.click( train_btn.click(
second_elem_of(train), second_elem_of(train),
inputs=[model_name, skip_style, use_jp_extra_train], inputs=[model_name, skip_style, use_jp_extra_train],