概要
Fish Speechは、最先端のオープンソーステキスト音声合成(TTS)ツールであり、表情豊かな音声クローンと多言語対応のテキストから音声への変換を提供します。
本ツールは、開発者、研究者、コンテンツクリエーターを対象としており、特にLLMエージェントとの連携も考慮されています。
CLI、WebUI、Dockerを用いたデプロイ、サーバー推論など、多様な利用方法をサポートし、Hugging Face上でもモデルが公開されています。
これにより、高品質な音声合成を手軽に導入し、幅広いアプリケーションで活用することが可能です。
互換性・特徴
- 日本語対応
- CLI
- Web UI
- Docker
- 多言語対応
- Python
基本情報
| ライセンス | NOASSERTION |
| Stars | 31,272 |
| Forks | 2,681 |
| カテゴリ | 音声生成 / TTS |
| アクティビティ | mid |
最新のissue
- Feature Request: Use FunASR for training data annotation (更新: 2026-07-15)
- a way to run this model on DGX Spark GB10 since its basicly arm64 (更新: 2026-07-15)
- How to achieve voice consistency, without cloning. (更新: 2026-07-14)
最新リリース: V1.5.1 (2025-05-31)
