Merge branch 'master' into dev
This commit is contained in:
11
Initialize.bat
Normal file
11
Initialize.bat
Normal file
@@ -0,0 +1,11 @@
|
|||||||
|
chcp 65001 > NUL
|
||||||
|
@echo off
|
||||||
|
|
||||||
|
pushd %~dp0
|
||||||
|
echo Running initialize.py...
|
||||||
|
venv\Scripts\python initialize.py
|
||||||
|
|
||||||
|
if %errorlevel% neq 0 ( pause & popd & exit /b %errorlevel% )
|
||||||
|
|
||||||
|
popd
|
||||||
|
pause
|
||||||
@@ -10,7 +10,7 @@ You can install via `pip install style-bert-vits2` (inference only), see [librar
|
|||||||
|
|
||||||
- **解説チュートリアル動画** [YouTube](https://youtu.be/aTUSzgDl1iY) [ニコニコ動画](https://www.nicovideo.jp/watch/sm43391524)
|
- **解説チュートリアル動画** [YouTube](https://youtu.be/aTUSzgDl1iY) [ニコニコ動画](https://www.nicovideo.jp/watch/sm43391524)
|
||||||
- [](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb)
|
- [](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb)
|
||||||
- [FAQ](/docs/FAQ.md)
|
- [**よくある質問** (FAQ)](/docs/FAQ.md)
|
||||||
- [🤗 オンラインデモはこちらから](https://huggingface.co/spaces/litagin/Style-Bert-VITS2-Editor-Demo)
|
- [🤗 オンラインデモはこちらから](https://huggingface.co/spaces/litagin/Style-Bert-VITS2-Editor-Demo)
|
||||||
- [Zennの解説記事](https://zenn.dev/litagin/articles/034819a5256ff4)
|
- [Zennの解説記事](https://zenn.dev/litagin/articles/034819a5256ff4)
|
||||||
|
|
||||||
|
|||||||
7
app.py
7
app.py
@@ -10,7 +10,6 @@ from gradio_tabs.inference import create_inference_app
|
|||||||
from gradio_tabs.merge import create_merge_app
|
from gradio_tabs.merge import create_merge_app
|
||||||
from gradio_tabs.style_vectors import create_style_vectors_app
|
from gradio_tabs.style_vectors import create_style_vectors_app
|
||||||
from gradio_tabs.train import create_train_app
|
from gradio_tabs.train import create_train_app
|
||||||
from initialize import download_default_models
|
|
||||||
from style_bert_vits2.constants import GRADIO_THEME, VERSION
|
from style_bert_vits2.constants import GRADIO_THEME, VERSION
|
||||||
from style_bert_vits2.nlp.japanese import pyopenjtalk_worker
|
from style_bert_vits2.nlp.japanese import pyopenjtalk_worker
|
||||||
from style_bert_vits2.nlp.japanese.user_dict import update_dict
|
from style_bert_vits2.nlp.japanese.user_dict import update_dict
|
||||||
@@ -30,15 +29,15 @@ parser.add_argument("--host", type=str, default="127.0.0.1")
|
|||||||
parser.add_argument("--port", type=int, default=None)
|
parser.add_argument("--port", type=int, default=None)
|
||||||
parser.add_argument("--no_autolaunch", action="store_true")
|
parser.add_argument("--no_autolaunch", action="store_true")
|
||||||
parser.add_argument("--share", action="store_true")
|
parser.add_argument("--share", action="store_true")
|
||||||
parser.add_argument("--skip_default_models", action="store_true")
|
# parser.add_argument("--skip_default_models", action="store_true")
|
||||||
|
|
||||||
args = parser.parse_args()
|
args = parser.parse_args()
|
||||||
device = args.device
|
device = args.device
|
||||||
if device == "cuda" and not torch.cuda.is_available():
|
if device == "cuda" and not torch.cuda.is_available():
|
||||||
device = "cpu"
|
device = "cpu"
|
||||||
|
|
||||||
if not args.skip_default_models:
|
# if not args.skip_default_models:
|
||||||
download_default_models()
|
# download_default_models()
|
||||||
|
|
||||||
path_config = get_path_config()
|
path_config = get_path_config()
|
||||||
model_holder = TTSModelHolder(Path(path_config.assets_root), device)
|
model_holder = TTSModelHolder(Path(path_config.assets_root), device)
|
||||||
|
|||||||
@@ -423,7 +423,7 @@
|
|||||||
"outputs": [],
|
"outputs": [],
|
||||||
"source": [
|
"source": [
|
||||||
"# 学習結果を試す・マージ・スタイル分けはこちらから\n",
|
"# 学習結果を試す・マージ・スタイル分けはこちらから\n",
|
||||||
"!python app.py --share --skip_default_models"
|
"!python app.py --share"
|
||||||
]
|
]
|
||||||
}
|
}
|
||||||
],
|
],
|
||||||
|
|||||||
@@ -6,8 +6,8 @@
|
|||||||
|
|
||||||
### 新機能等
|
### 新機能等
|
||||||
|
|
||||||
- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した**小春音アミ**と**あみたろ**モデルを追加(あみたろ様には事前に連絡して許諾を得ています)
|
- デフォルトモデルに [あみたろの声素材工房](https://amitaro.net/) のあみたろ様が公開しているコーパスとライブ配信音声を利用して学習した[**小春音アミ**](https://huggingface.co/litagin/sbv2_koharune_ami)と[**あみたろ**](https://huggingface.co/litagin/sbv2_amitaro)モデルを追加(あみたろ様には事前に連絡して許諾を得ています)
|
||||||
- アプデの場合は新たに`App.bat`や`Editor.bat`を起動した際に自動でダウンロードされます
|
- アプデの場合は`Initialize.bat`をダブルクリックすればモデルをダウンロードできます(手動でダウンロードして`model_assets`フォルダに入れることも可能)
|
||||||
- 学習時に音声データをスタイルごとにフォルダ分けしておくことで、そのフォルダごとのスタイルを学習時に自動的に作成するように
|
- 学習時に音声データをスタイルごとにフォルダ分けしておくことで、そのフォルダごとのスタイルを学習時に自動的に作成するように
|
||||||
- `inputs`からスライスして使う場合は`inputs`直下に作りたいスタイルだけサブフォルダを作りそこに音声ファイルを配置
|
- `inputs`からスライスして使う場合は`inputs`直下に作りたいスタイルだけサブフォルダを作りそこに音声ファイルを配置
|
||||||
- `Data/モデル名/raw`から使う場合も`raw`直下に同様に配置
|
- `Data/モデル名/raw`から使う場合も`raw`直下に同様に配置
|
||||||
|
|||||||
@@ -1,5 +1,10 @@
|
|||||||
# よくある質問
|
# よくある質問
|
||||||
|
|
||||||
|
## Google Colabでの学習がエラーが何か出て動かない
|
||||||
|
|
||||||
|
Google Colabのノートブックは以前のバージョンのノートブックのコピーを使っていませんか?
|
||||||
|
Colabノートブックは最新のバージョンに合ったノートブックで動かすことを前提としています。ノートブック記載のバージョンを確認して、[最新のcolabノートブック](http://colab.research.google.com/github/litagin02/Style-Bert-VITS2/blob/master/colab.ipynb)(を必要ならコピーして)から使うようにしてください。
|
||||||
|
|
||||||
## 学習に時間がかかりすぎる
|
## 学習に時間がかかりすぎる
|
||||||
|
|
||||||
デフォルトの100エポックは音声データ量によっては過剰な場合があります。デフォルトでは1000ステップごとにモデルが保存されるはずなので、途中で学習を中断してみて途中のもので試してみてもいいでしょう。
|
デフォルトの100エポックは音声データ量によっては過剰な場合があります。デフォルトでは1000ステップごとにモデルが保存されるはずなので、途中で学習を中断してみて途中のもので試してみてもいいでしょう。
|
||||||
@@ -36,4 +41,3 @@
|
|||||||
## その他
|
## その他
|
||||||
|
|
||||||
ググったり調べたりChatGPTに聞くか、それでも分からない場合・または手順通りやってもエラーが出る等明らかに不具合やバグと思われる場合は、GitHubの[Issue](https://github.com/litagin02/Style-Bert-VITS2/issues)に投稿してください。
|
ググったり調べたりChatGPTに聞くか、それでも分からない場合・または手順通りやってもエラーが出る等明らかに不具合やバグと思われる場合は、GitHubの[Issue](https://github.com/litagin02/Style-Bert-VITS2/issues)に投稿してください。
|
||||||
|
|
||||||
|
|||||||
@@ -98,6 +98,8 @@ examples = [
|
|||||||
initial_md = """
|
initial_md = """
|
||||||
- Ver 2.5で追加されたデフォルトの [`koharune-ami`(小春音アミ)モデル](https://huggingface.co/litagin/sbv2_koharune_ami) と[`amitaro`(あみたろ)モデル](https://huggingface.co/litagin/sbv2_amitaro) は、[あみたろの声素材工房](https://amitaro.net/)で公開されているコーパス音源・ライブ配信音声を利用して事前に許可を得て学習したモデルです。下記の**利用規約を必ず読んで**からご利用ください。
|
- Ver 2.5で追加されたデフォルトの [`koharune-ami`(小春音アミ)モデル](https://huggingface.co/litagin/sbv2_koharune_ami) と[`amitaro`(あみたろ)モデル](https://huggingface.co/litagin/sbv2_amitaro) は、[あみたろの声素材工房](https://amitaro.net/)で公開されているコーパス音源・ライブ配信音声を利用して事前に許可を得て学習したモデルです。下記の**利用規約を必ず読んで**からご利用ください。
|
||||||
|
|
||||||
|
- Ver 2.5のアップデート後に上記モデルをダウンロードするには、`Initialize.bat`をダブルクリックするか、手動でダウンロードして`model_assets`ディレクトリに配置してください。
|
||||||
|
|
||||||
- Ver 2.3で追加された**エディター版**のほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。
|
- Ver 2.3で追加された**エディター版**のほうが実際に読み上げさせるには使いやすいかもしれません。`Editor.bat`か`python server_editor.py --inbrowser`で起動できます。
|
||||||
"""
|
"""
|
||||||
|
|
||||||
|
|||||||
@@ -30,7 +30,6 @@ from pydantic import BaseModel
|
|||||||
from scipy.io import wavfile
|
from scipy.io import wavfile
|
||||||
|
|
||||||
from config import get_path_config
|
from config import get_path_config
|
||||||
from initialize import download_default_models
|
|
||||||
from style_bert_vits2.constants import (
|
from style_bert_vits2.constants import (
|
||||||
DEFAULT_ASSIST_TEXT_WEIGHT,
|
DEFAULT_ASSIST_TEXT_WEIGHT,
|
||||||
DEFAULT_NOISE,
|
DEFAULT_NOISE,
|
||||||
@@ -183,7 +182,7 @@ parser.add_argument("--port", type=int, default=8000)
|
|||||||
parser.add_argument("--inbrowser", action="store_true")
|
parser.add_argument("--inbrowser", action="store_true")
|
||||||
parser.add_argument("--line_length", type=int, default=None)
|
parser.add_argument("--line_length", type=int, default=None)
|
||||||
parser.add_argument("--line_count", type=int, default=None)
|
parser.add_argument("--line_count", type=int, default=None)
|
||||||
parser.add_argument("--skip_default_models", action="store_true")
|
# parser.add_argument("--skip_default_models", action="store_true")
|
||||||
parser.add_argument("--skip_static_files", action="store_true")
|
parser.add_argument("--skip_static_files", action="store_true")
|
||||||
args = parser.parse_args()
|
args = parser.parse_args()
|
||||||
device = args.device
|
device = args.device
|
||||||
@@ -191,8 +190,8 @@ if device == "cuda" and not torch.cuda.is_available():
|
|||||||
device = "cpu"
|
device = "cpu"
|
||||||
model_dir = Path(args.model_dir)
|
model_dir = Path(args.model_dir)
|
||||||
port = int(args.port)
|
port = int(args.port)
|
||||||
if not args.skip_default_models:
|
# if not args.skip_default_models:
|
||||||
download_default_models()
|
# download_default_models()
|
||||||
skip_static_files = bool(args.skip_static_files)
|
skip_static_files = bool(args.skip_static_files)
|
||||||
|
|
||||||
model_holder = TTSModelHolder(model_dir, device)
|
model_holder = TTSModelHolder(model_dir, device)
|
||||||
|
|||||||
Reference in New Issue
Block a user