概要
RealtimeSTTは、音声アクティビティ検出、高速な文字起こし、リアルタイムテキスト更新、ウェイクワード機能を備えたPython製音声認識ライブラリです。
アシスタント、ディクテーションツール、ブラウザストリーミングサーバー、プロトタイプなど、少量のコードで音声をテキストに変換したいアプリケーション向けに設計されています。
デフォルトで`faster_whisper`を使用し、`kroko_onnx`などの他のエンジンもサポートしており、効率的かつ低遅延での音声認識を実現します。
互換性・特徴
- Python
- CLI
- リアルタイム処理
- 音声認識
- VAD
- ウェイクワード
基本情報
| ライセンス | MIT |
| Stars | 10,009 |
| Forks | 849 |
| カテゴリ | ASR / 音声認識 |
| アクティビティ | mid |
最新のissue
- openwakeword silent API incompatibility on Python 3.13+ and documentation issues (更新: 2026-07-22)
- Feature: Add FunASR/SenseVoice as alternative STT engine (更新: 2026-07-14)
- Launches but does not display any text (更新: 2026-07-11)
- ModuleNotFoundError: No module named ‘RealtimeSTT’ (更新: 2026-07-11)
最新リリース: v1.0.2 (2026-05-31)
