Files
sbv2-v2/docs/CHANGELOG.md
2023-12-31 15:17:33 +09:00

1.4 KiB
Raw Blame History

Changelog

v1.2 (2023-12-31)

  • グラボがないユーザーでの音声合成をサポート、Install-Style-Bert-VITS2-CPU.batでインストール。
  • Google Colabでの学習をサポート、ノートブックを追加
  • 音声合成のAPIサーバーを追加、python server_fastapi.pyで起動します。API仕様は起動後に/docsにて確認ください。( @darai0512 様によるPRです、ありがとうございます
  • 学習時に自動的にデフォルトスタイル Neutral を生成するように。特にスタイル指定が必要のない方は、学習したらそのまま音声合成を試せます。これまで通りスタイルを自分で作ることもできます。
  • マージ機能の新規追加: Merge.bat, webui_merge.py
  • 前処理のリサンプリング時に音声ファイルの開始・終了部分の無音を削除するオプションを追加(デフォルトでオン)
  • スタイルテキスト (style text)がスタイル指定と紛らわしかったので、アシストテキスト (assist text)に変更
  • その他コードのリファクタリング

v1.1 (2023-12-29)

  • TrainとDatasetのWebUIの改良・調整一括事前処理ボタン等
  • 前処理のリサンプリング時に音量を正規化するオプションを追加(デフォルトでオン)

v1.0 (2023-12-27)

  • 初版