概要
Speech Studioは、コンテンツクリエイター向けのオープンソースのデスクトップアプリケーションです。
短い音声クリップから声をクローンし、スクリプトを一行ずつ書いて、その声で合成できます。
感情マーカーをインラインで記述することで、合成音声のトーンを調整することも可能です。
全ての処理はローカルで実行され、音声データが外部に送信されることはありません。
macOS (Apple Silicon)、Windows (x86_64)、Linux (x86_64) に対応しており、オンデバイスで高速な音声合成を実現します。
特に、動画制作者やポッドキャスターなど、多様な感情表現を含む音声コンテンツを効率的に作成したいユーザーに最適です。
互換性・特徴
- デスクトップアプリ
- macOS対応
- Windows対応
- Linux対応
- GPU必須
- 音声クローン
基本情報
| ライセンス | Apache-2.0 |
| Stars | 47 |
| Forks | 9 |
| カテゴリ | 音声生成 / TTS |
| アクティビティ | low |
最新リリース: v0.0.9 (2026-07-05)
