diff --git a/Initialize.bat b/Initialize.bat new file mode 100644 index 0000000..8669f55 --- /dev/null +++ b/Initialize.bat @@ -0,0 +1,11 @@ +chcp 65001 > NUL +@echo off + +pushd %~dp0 +echo Running initialize.py... +venv\Scripts\python initialize.py + +if %errorlevel% neq 0 ( pause & popd & exit /b %errorlevel% ) + +popd +pause \ No newline at end of file diff --git a/README.md b/README.md index 8a7e1ee..355bb65 100644 --- a/README.md +++ b/README.md @@ -10,7 +10,7 @@ You can install via `pip install style-bert-vits2` (inference only), see [librar - **解説チュートリアル動画** [YouTube](https://youtu.be/aTUSzgDl1iY) [ニコニコ動画](https://www.nicovideo.jp/watch/sm43391524) - [![Open In Colab](https://colab.research.google.com/assets/colab-badge.svg)](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb) -- [FAQ](/docs/FAQ.md) +- [**よくある質問** (FAQ)](/docs/FAQ.md) - [🤗 オンラインデモはこちらから](https://huggingface.co/spaces/litagin/Style-Bert-VITS2-Editor-Demo) - [Zennの解説記事](https://zenn.dev/litagin/articles/034819a5256ff4) diff --git a/app.py b/app.py index 46684ef..987739b 100644 --- a/app.py +++ b/app.py @@ -10,7 +10,6 @@ from gradio_tabs.inference import create_inference_app from gradio_tabs.merge import create_merge_app from gradio_tabs.style_vectors import create_style_vectors_app from gradio_tabs.train import create_train_app -from initialize import download_default_models from style_bert_vits2.constants import GRADIO_THEME, VERSION from style_bert_vits2.nlp.japanese import pyopenjtalk_worker from style_bert_vits2.nlp.japanese.user_dict import update_dict @@ -30,15 +29,15 @@ parser.add_argument("--host", type=str, default="127.0.0.1") parser.add_argument("--port", type=int, default=None) parser.add_argument("--no_autolaunch", action="store_true") parser.add_argument("--share", action="store_true") -parser.add_argument("--skip_default_models", action="store_true") +# parser.add_argument("--skip_default_models", action="store_true") args = parser.parse_args() device = args.device if device == "cuda" and not torch.cuda.is_available(): device = "cpu" -if not args.skip_default_models: - download_default_models() +# if not args.skip_default_models: +# download_default_models() path_config = get_path_config() model_holder = TTSModelHolder(Path(path_config.assets_root), device) diff --git a/colab.ipynb b/colab.ipynb index 0234e86..e3ad010 100644 --- a/colab.ipynb +++ b/colab.ipynb @@ -423,7 +423,7 @@ "outputs": [], "source": [ "# 学習結果を試す・マージ・スタイル分けはこちらから\n", - "!python app.py --share --skip_default_models" + "!python app.py --share" ] } ], diff --git a/docs/CHANGELOG.md b/docs/CHANGELOG.md index 88b7669..dda8df7 100644 --- a/docs/CHANGELOG.md +++ b/docs/CHANGELOG.md @@ -6,8 +6,8 @@ ### 新機能等 -- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した**小春音アミ**と**あみたろ**モデルを追加(あみたろ様には事前に連絡して許諾を得ています) - - アプデの場合は新たに`App.bat`や`Editor.bat`を起動した際に自動でダウンロードされます +- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した[**小春音アミ**](https://huggingface.co/litagin/sbv2_koharune_ami)と[**あみたろ**](https://huggingface.co/litagin/sbv2_amitaro)モデルを追加(あみたろ様には事前に連絡して許諾を得ています) + - アプデの場合は`Initialize.bat`をダブルクリックすればモデルをダウンロードできます(手動でダウンロードして`model_assets`フォルダに入れることも可能) - 学習時に音声データをスタイルごとにフォルダ分けしておくことで、そのフォルダごとのスタイルを学習時に自動的に作成するように - `inputs`からスライスして使う場合は`inputs`直下に作りたいスタイルだけサブフォルダを作りそこに音声ファイルを配置 - `Data/モデル名/raw`から使う場合も`raw`直下に同様に配置 diff --git a/docs/FAQ.md b/docs/FAQ.md index 4ea3f98..ffbd468 100644 --- a/docs/FAQ.md +++ b/docs/FAQ.md @@ -1,5 +1,10 @@ # よくある質問 +## Google Colabでの学習がエラーが何か出て動かない + +Google Colabのノートブックは以前のバージョンのノートブックのコピーを使っていませんか? +Colabノートブックは最新のバージョンに合ったノートブックで動かすことを前提としています。ノートブック記載のバージョンを確認して、[最新のcolabノートブック](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb)(を必要ならコピーして)から使うようにしてください。 + ## 学習に時間がかかりすぎる デフォルトの100エポックは音声データ量によっては過剰な場合があります。デフォルトでは1000ステップごとにモデルが保存されるはずなので、途中で学習を中断してみて途中のもので試してみてもいいでしょう。 @@ -36,4 +41,3 @@ ## その他 ググったり調べたりChatGPTに聞くか、それでも分からない場合・または手順通りやってもエラーが出る等明らかに不具合やバグと思われる場合は、GitHubの[Issue](https://github.com/litagin02/Style-Bert-VITS2/issues)に投稿してください。 - diff --git a/gradio_tabs/inference.py b/gradio_tabs/inference.py index 548f0e7..3e24d0d 100644 --- a/gradio_tabs/inference.py +++ b/gradio_tabs/inference.py @@ -98,6 +98,8 @@ examples = [ initial_md = """ - Ver 2.5で追加されたデフォルトの [`koharune-ami`(小春音アミ)モデル](https://huggingface.co/litagin/sbv2_koharune_ami) と[`amitaro`(あみたろ)モデル](https://huggingface.co/litagin/sbv2_amitaro) は、[あみたろの声素材工房](https://amitaro.net/)で公開されているコーパス音源・ライブ配信音声を利用して事前に許可を得て学習したモデルです。下記の**利用規約を必ず読んで**からご利用ください。 +- Ver 2.5のアップデート後に上記モデルをダウンロードするには、`Initialize.bat`をダブルクリックするか、手動でダウンロードして`model_assets`ディレクトリに配置してください。 + - Ver 2.3で追加された**エディター版**のほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。 """ diff --git a/server_editor.py b/server_editor.py index 8caea47..cde2c7d 100644 --- a/server_editor.py +++ b/server_editor.py @@ -30,7 +30,6 @@ from pydantic import BaseModel from scipy.io import wavfile from config import get_path_config -from initialize import download_default_models from style_bert_vits2.constants import ( DEFAULT_ASSIST_TEXT_WEIGHT, DEFAULT_NOISE, @@ -183,7 +182,7 @@ parser.add_argument("--port", type=int, default=8000) parser.add_argument("--inbrowser", action="store_true") parser.add_argument("--line_length", type=int, default=None) parser.add_argument("--line_count", type=int, default=None) -parser.add_argument("--skip_default_models", action="store_true") +# parser.add_argument("--skip_default_models", action="store_true") parser.add_argument("--skip_static_files", action="store_true") args = parser.parse_args() device = args.device @@ -191,8 +190,8 @@ if device == "cuda" and not torch.cuda.is_available(): device = "cpu" model_dir = Path(args.model_dir) port = int(args.port) -if not args.skip_default_models: - download_default_models() +# if not args.skip_default_models: +# download_default_models() skip_static_files = bool(args.skip_static_files) model_holder = TTSModelHolder(model_dir, device)