概要
OmniVoice Studioは、オープンソースのElevenLabs代替ツールです。
リアルタイムディクテーション、3秒の音声クリップからゼロショットで声をクローンする機能、ビデオの文字起こし・翻訳・再音声化によるシネマティックビデオ吹き替えを提供します。
646言語に対応し、デスクトップで完全にローカル動作するため、APIキーは不要です。
音声のデザイン、ボーカル分離、話者ダイアライゼーション、バッチ処理、AIウォーターマークなどの高度な機能を備えています。
開発者や、プライバシーを重視し、クラウドサービスに依存しない高品質な音声合成・編集を求める個人ユーザーに最適です。
現在はベータ版です。
互換性・特徴
- macOS対応
- Windows対応
- Linux対応
- Docker対応
- Python
- Web UI
- GPU対応
- ローカル実行
- 日本語対応
基本情報
| ライセンス | NOASSERTION |
| Stars | 8,338 |
| Forks | 1,326 |
| カテゴリ | ASR / 音声認識 |
| アクティビティ | high |
最新のissue
- [Bug] 500 Internal Server Error: Can’t load the model for ‘k2-fsa/OmniVoice’. If you w (更新: 2026-07-13)
- [Bug] The local OmniVoice backend crashed (exit code 1) 38 min ago and is being restar (更新: 2026-07-13)
- [Bug] Transcribe stream dropped before emitting any segments. Likely ASR backend faile (更新: 2026-07-12)
- [Bug] Can’t reach the local OmniVoice backend — it may still be starting up, or it sto (更新: 2026-07-12)
最新リリース: v0.3.21 — OmniVoice Studio (2026-07-12)
