概要
GPT-SoVITS-WebUIは、最小1分の音声データから高品質なText-to-Speech(TTS)モデルをトレーニングできる強力なFew-shot音声変換・テキスト読み上げツールです。
5秒の音声サンプルで即座にTTSが可能なゼロショット機能や、日本語を含む多言語での推論に対応しています。
初心者でもデータセット作成やモデル構築ができるよう、WebUIに音声伴奏分離、自動学習セット分割、中国語ASR、テキストラベリングなどのツールが統合されています。
GPUでの高速推論を想定しており、音声変換やテキスト読み上げに関心のある幅広いユーザーがターゲットです。
互換性・特徴
- Web UI
- Python
- GPU必須
- 日本語対応
- 多言語対応
- Docker対応
基本情報
| ライセンス | MIT |
| Stars | 59,717 |
| Forks | 6,510 |
| カテゴリ | 音声生成 / TTS |
| アクティビティ | high |
最新のissue
- 很好的项目 (更新: 2026-07-13)
- 微调模型-开启Sovits训练报错 (更新: 2026-07-13)
- 通过RVC有效抑制V3电音以及恢复音质 (更新: 2026-07-10)
- 建议增加关于哈气呼吸声笑声的特殊性标注功能 (更新: 2026-07-10)
最新リリース: 20250606v2pro (2025-06-06)
