Merge branch 'master' into dev

This commit is contained in:
litagin02
2024-06-02 16:25:24 +09:00
8 changed files with 28 additions and 13 deletions

11
Initialize.bat Normal file
View File

@@ -0,0 +1,11 @@
chcp 65001 > NUL
@echo off
pushd %~dp0
echo Running initialize.py...
venv\Scripts\python initialize.py
if %errorlevel% neq 0 ( pause & popd & exit /b %errorlevel% )
popd
pause

View File

@@ -10,7 +10,7 @@ You can install via `pip install style-bert-vits2` (inference only), see [librar
- **解説チュートリアル動画** [YouTube](https://youtu.be/aTUSzgDl1iY) [ニコニコ動画](https://www.nicovideo.jp/watch/sm43391524) - **解説チュートリアル動画** [YouTube](https://youtu.be/aTUSzgDl1iY) [ニコニコ動画](https://www.nicovideo.jp/watch/sm43391524)
- [![Open In Colab](https://colab.research.google.com/assets/colab-badge.svg)](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb) - [![Open In Colab](https://colab.research.google.com/assets/colab-badge.svg)](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb)
- [FAQ](/docs/FAQ.md) - [**よくある質問** (FAQ)](/docs/FAQ.md)
- [🤗 オンラインデモはこちらから](https://huggingface.co/spaces/litagin/Style-Bert-VITS2-Editor-Demo) - [🤗 オンラインデモはこちらから](https://huggingface.co/spaces/litagin/Style-Bert-VITS2-Editor-Demo)
- [Zennの解説記事](https://zenn.dev/litagin/articles/034819a5256ff4) - [Zennの解説記事](https://zenn.dev/litagin/articles/034819a5256ff4)

7
app.py
View File

@@ -10,7 +10,6 @@ from gradio_tabs.inference import create_inference_app
from gradio_tabs.merge import create_merge_app from gradio_tabs.merge import create_merge_app
from gradio_tabs.style_vectors import create_style_vectors_app from gradio_tabs.style_vectors import create_style_vectors_app
from gradio_tabs.train import create_train_app from gradio_tabs.train import create_train_app
from initialize import download_default_models
from style_bert_vits2.constants import GRADIO_THEME, VERSION from style_bert_vits2.constants import GRADIO_THEME, VERSION
from style_bert_vits2.nlp.japanese import pyopenjtalk_worker from style_bert_vits2.nlp.japanese import pyopenjtalk_worker
from style_bert_vits2.nlp.japanese.user_dict import update_dict from style_bert_vits2.nlp.japanese.user_dict import update_dict
@@ -30,15 +29,15 @@ parser.add_argument("--host", type=str, default="127.0.0.1")
parser.add_argument("--port", type=int, default=None) parser.add_argument("--port", type=int, default=None)
parser.add_argument("--no_autolaunch", action="store_true") parser.add_argument("--no_autolaunch", action="store_true")
parser.add_argument("--share", action="store_true") parser.add_argument("--share", action="store_true")
parser.add_argument("--skip_default_models", action="store_true") # parser.add_argument("--skip_default_models", action="store_true")
args = parser.parse_args() args = parser.parse_args()
device = args.device device = args.device
if device == "cuda" and not torch.cuda.is_available(): if device == "cuda" and not torch.cuda.is_available():
device = "cpu" device = "cpu"
if not args.skip_default_models: # if not args.skip_default_models:
download_default_models() # download_default_models()
path_config = get_path_config() path_config = get_path_config()
model_holder = TTSModelHolder(Path(path_config.assets_root), device) model_holder = TTSModelHolder(Path(path_config.assets_root), device)

View File

@@ -423,7 +423,7 @@
"outputs": [], "outputs": [],
"source": [ "source": [
"# 学習結果を試す・マージ・スタイル分けはこちらから\n", "# 学習結果を試す・マージ・スタイル分けはこちらから\n",
"!python app.py --share --skip_default_models" "!python app.py --share"
] ]
} }
], ],

View File

@@ -6,8 +6,8 @@
### 新機能等 ### 新機能等
- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した**小春音アミ**と**あみたろ**モデルを追加(あみたろ様には事前に連絡して許諾を得ています) - デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した[**小春音アミ**](https://huggingface.co/litagin/sbv2_koharune_ami)と[**あみたろ**](https://huggingface.co/litagin/sbv2_amitaro)モデルを追加(あみたろ様には事前に連絡して許諾を得ています)
- アプデの場合は新たに`App.bat``Editor.bat`を起動した際に自動でダウンロードされます - アプデの場合は`Initialize.bat`をダブルクリックすればモデルをダウンロードできます(手動でダウンロードして`model_assets`フォルダに入れることも可能)
- 学習時に音声データをスタイルごとにフォルダ分けしておくことで、そのフォルダごとのスタイルを学習時に自動的に作成するように - 学習時に音声データをスタイルごとにフォルダ分けしておくことで、そのフォルダごとのスタイルを学習時に自動的に作成するように
- `inputs`からスライスして使う場合は`inputs`直下に作りたいスタイルだけサブフォルダを作りそこに音声ファイルを配置 - `inputs`からスライスして使う場合は`inputs`直下に作りたいスタイルだけサブフォルダを作りそこに音声ファイルを配置
- `Data/モデル名/raw`から使う場合も`raw`直下に同様に配置 - `Data/モデル名/raw`から使う場合も`raw`直下に同様に配置

View File

@@ -1,5 +1,10 @@
# よくある質問 # よくある質問
## Google Colabでの学習がエラーが何か出て動かない
Google Colabのートブックは以前のバージョンのートブックのコピーを使っていませんか
Colabートブックは最新のバージョンに合ったートブックで動かすことを前提としています。ートブック記載のバージョンを確認して、[最新のcolabートブック](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb)(を必要ならコピーして)から使うようにしてください。
## 学習に時間がかかりすぎる ## 学習に時間がかかりすぎる
デフォルトの100エポックは音声データ量によっては過剰な場合があります。デフォルトでは1000ステップごとにモデルが保存されるはずなので、途中で学習を中断してみて途中のもので試してみてもいいでしょう。 デフォルトの100エポックは音声データ量によっては過剰な場合があります。デフォルトでは1000ステップごとにモデルが保存されるはずなので、途中で学習を中断してみて途中のもので試してみてもいいでしょう。
@@ -36,4 +41,3 @@
## その他 ## その他
ググったり調べたりChatGPTに聞くか、それでも分からない場合・または手順通りやってもエラーが出る等明らかに不具合やバグと思われる場合は、GitHubの[Issue](https://github.com/litagin02/Style-Bert-VITS2/issues)に投稿してください。 ググったり調べたりChatGPTに聞くか、それでも分からない場合・または手順通りやってもエラーが出る等明らかに不具合やバグと思われる場合は、GitHubの[Issue](https://github.com/litagin02/Style-Bert-VITS2/issues)に投稿してください。

View File

@@ -98,6 +98,8 @@ examples = [
initial_md = """ initial_md = """
- Ver 2.5で追加されたデフォルトの [`koharune-ami`(小春音アミ)モデル](https://huggingface.co/litagin/sbv2_koharune_ami) と[`amitaro`(あみたろ)モデル](https://huggingface.co/litagin/sbv2_amitaro) は、[あみたろの声素材工房](https://amitaro.net/)で公開されているコーパス音源・ライブ配信音声を利用して事前に許可を得て学習したモデルです。下記の**利用規約を必ず読んで**からご利用ください。 - Ver 2.5で追加されたデフォルトの [`koharune-ami`(小春音アミ)モデル](https://huggingface.co/litagin/sbv2_koharune_ami) と[`amitaro`(あみたろ)モデル](https://huggingface.co/litagin/sbv2_amitaro) は、[あみたろの声素材工房](https://amitaro.net/)で公開されているコーパス音源・ライブ配信音声を利用して事前に許可を得て学習したモデルです。下記の**利用規約を必ず読んで**からご利用ください。
- Ver 2.5のアップデート後に上記モデルをダウンロードするには、`Initialize.bat`をダブルクリックするか、手動でダウンロードして`model_assets`ディレクトリに配置してください。
- Ver 2.3で追加された**エディター版**のほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。 - Ver 2.3で追加された**エディター版**のほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。
""" """

View File

@@ -30,7 +30,6 @@ from pydantic import BaseModel
from scipy.io import wavfile from scipy.io import wavfile
from config import get_path_config from config import get_path_config
from initialize import download_default_models
from style_bert_vits2.constants import ( from style_bert_vits2.constants import (
DEFAULT_ASSIST_TEXT_WEIGHT, DEFAULT_ASSIST_TEXT_WEIGHT,
DEFAULT_NOISE, DEFAULT_NOISE,
@@ -183,7 +182,7 @@ parser.add_argument("--port", type=int, default=8000)
parser.add_argument("--inbrowser", action="store_true") parser.add_argument("--inbrowser", action="store_true")
parser.add_argument("--line_length", type=int, default=None) parser.add_argument("--line_length", type=int, default=None)
parser.add_argument("--line_count", type=int, default=None) parser.add_argument("--line_count", type=int, default=None)
parser.add_argument("--skip_default_models", action="store_true") # parser.add_argument("--skip_default_models", action="store_true")
parser.add_argument("--skip_static_files", action="store_true") parser.add_argument("--skip_static_files", action="store_true")
args = parser.parse_args() args = parser.parse_args()
device = args.device device = args.device
@@ -191,8 +190,8 @@ if device == "cuda" and not torch.cuda.is_available():
device = "cpu" device = "cpu"
model_dir = Path(args.model_dir) model_dir = Path(args.model_dir)
port = int(args.port) port = int(args.port)
if not args.skip_default_models: # if not args.skip_default_models:
download_default_models() # download_default_models()
skip_static_files = bool(args.skip_static_files) skip_static_files = bool(args.skip_static_files)
model_holder = TTSModelHolder(model_dir, device) model_holder = TTSModelHolder(model_dir, device)