diff --git a/Initialize.bat b/Initialize.bat new file mode 100644 index 0000000..8669f55 --- /dev/null +++ b/Initialize.bat @@ -0,0 +1,11 @@ +chcp 65001 > NUL +@echo off + +pushd %~dp0 +echo Running initialize.py... +venv\Scripts\python initialize.py + +if %errorlevel% neq 0 ( pause & popd & exit /b %errorlevel% ) + +popd +pause \ No newline at end of file diff --git a/app.py b/app.py index 46684ef..987739b 100644 --- a/app.py +++ b/app.py @@ -10,7 +10,6 @@ from gradio_tabs.inference import create_inference_app from gradio_tabs.merge import create_merge_app from gradio_tabs.style_vectors import create_style_vectors_app from gradio_tabs.train import create_train_app -from initialize import download_default_models from style_bert_vits2.constants import GRADIO_THEME, VERSION from style_bert_vits2.nlp.japanese import pyopenjtalk_worker from style_bert_vits2.nlp.japanese.user_dict import update_dict @@ -30,15 +29,15 @@ parser.add_argument("--host", type=str, default="127.0.0.1") parser.add_argument("--port", type=int, default=None) parser.add_argument("--no_autolaunch", action="store_true") parser.add_argument("--share", action="store_true") -parser.add_argument("--skip_default_models", action="store_true") +# parser.add_argument("--skip_default_models", action="store_true") args = parser.parse_args() device = args.device if device == "cuda" and not torch.cuda.is_available(): device = "cpu" -if not args.skip_default_models: - download_default_models() +# if not args.skip_default_models: +# download_default_models() path_config = get_path_config() model_holder = TTSModelHolder(Path(path_config.assets_root), device) diff --git a/colab.ipynb b/colab.ipynb index 0234e86..e3ad010 100644 --- a/colab.ipynb +++ b/colab.ipynb @@ -423,7 +423,7 @@ "outputs": [], "source": [ "# 学習結果を試す・マージ・スタイル分けはこちらから\n", - "!python app.py --share --skip_default_models" + "!python app.py --share" ] } ], diff --git a/docs/CHANGELOG.md b/docs/CHANGELOG.md index 88b7669..dda8df7 100644 --- a/docs/CHANGELOG.md +++ b/docs/CHANGELOG.md @@ -6,8 +6,8 @@ ### 新機能等 -- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した**小春音アミ**と**あみたろ**モデルを追加(あみたろ様には事前に連絡して許諾を得ています) - - アプデの場合は新たに`App.bat`や`Editor.bat`を起動した際に自動でダウンロードされます +- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した[**小春音アミ**](https://huggingface.co/litagin/sbv2_koharune_ami)と[**あみたろ**](https://huggingface.co/litagin/sbv2_amitaro)モデルを追加(あみたろ様には事前に連絡して許諾を得ています) + - アプデの場合は`Initialize.bat`をダブルクリックすればモデルをダウンロードできます(手動でダウンロードして`model_assets`フォルダに入れることも可能) - 学習時に音声データをスタイルごとにフォルダ分けしておくことで、そのフォルダごとのスタイルを学習時に自動的に作成するように - `inputs`からスライスして使う場合は`inputs`直下に作りたいスタイルだけサブフォルダを作りそこに音声ファイルを配置 - `Data/モデル名/raw`から使う場合も`raw`直下に同様に配置 diff --git a/gradio_tabs/inference.py b/gradio_tabs/inference.py index 548f0e7..3e24d0d 100644 --- a/gradio_tabs/inference.py +++ b/gradio_tabs/inference.py @@ -98,6 +98,8 @@ examples = [ initial_md = """ - Ver 2.5で追加されたデフォルトの [`koharune-ami`(小春音アミ)モデル](https://huggingface.co/litagin/sbv2_koharune_ami) と[`amitaro`(あみたろ)モデル](https://huggingface.co/litagin/sbv2_amitaro) は、[あみたろの声素材工房](https://amitaro.net/)で公開されているコーパス音源・ライブ配信音声を利用して事前に許可を得て学習したモデルです。下記の**利用規約を必ず読んで**からご利用ください。 +- Ver 2.5のアップデート後に上記モデルをダウンロードするには、`Initialize.bat`をダブルクリックするか、手動でダウンロードして`model_assets`ディレクトリに配置してください。 + - Ver 2.3で追加された**エディター版**のほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。 """ diff --git a/server_editor.py b/server_editor.py index 8caea47..cde2c7d 100644 --- a/server_editor.py +++ b/server_editor.py @@ -30,7 +30,6 @@ from pydantic import BaseModel from scipy.io import wavfile from config import get_path_config -from initialize import download_default_models from style_bert_vits2.constants import ( DEFAULT_ASSIST_TEXT_WEIGHT, DEFAULT_NOISE, @@ -183,7 +182,7 @@ parser.add_argument("--port", type=int, default=8000) parser.add_argument("--inbrowser", action="store_true") parser.add_argument("--line_length", type=int, default=None) parser.add_argument("--line_count", type=int, default=None) -parser.add_argument("--skip_default_models", action="store_true") +# parser.add_argument("--skip_default_models", action="store_true") parser.add_argument("--skip_static_files", action="store_true") args = parser.parse_args() device = args.device @@ -191,8 +190,8 @@ if device == "cuda" and not torch.cuda.is_available(): device = "cpu" model_dir = Path(args.model_dir) port = int(args.port) -if not args.skip_default_models: - download_default_models() +# if not args.skip_default_models: +# download_default_models() skip_static_files = bool(args.skip_static_files) model_holder = TTSModelHolder(model_dir, device)