概要
IndexTTS2は、感情豊かで再生時間の厳密な制御が可能な自己回帰型ゼロショットテキスト音声合成(TTS)モデルです。
動画の吹き替えなど、音声と映像の同期が重要なアプリケーションにおいて、音声の長さを正確に指定したり、プロソディ特徴を維持しつつ自由に生成したりすることが可能です。
また、声色と感情表現を独立して制御できるため、ターゲットの声色を再現しつつ、特定の感情を付与した音声を合成できます。
高度な音声生成と感情制御を求める開発者や研究者に最適です。
互換性・特徴
- ゼロショットTTS
- 感情制御
- 時間制御
- Python
- 研究・開発
- API/モデル
基本情報
| ライセンス | NOASSERTION |
| Stars | 21,895 |
| Forks | 2,684 |
| カテゴリ | 音声生成 / TTS |
| アクティビティ | high |
最新のissue
- 是否支持docker部署 (更新: 2026-07-14)
- 感谢开源!能否有一些推理优化做到实时?我做的实时数字人急需! (更新: 2026-07-14)
- 基于 C++/GGML 的 Index-TTS2 在 RTX 5090 上可达到 3 倍实时速度,长文本生成速度比 Python 实现快 5.6 倍 (更新: 2026-07-14)
- Unofficial Training/Finetuning Code for v2 – Multilingual Training, Single Language Training, etc. (更新: 2026-07-02)
最新リリース: IndexTTS-1.5 (2025-09-01)
