音声生成 / TTS GitHub CosyVoice
FunAudioLLMが開発するCosyVoiceは、大規模言語モデル(LLM)を基盤とした多言語対応の音声生成モデルです。最新版の…
★ 22.2k ⑂ 2.6k Apache-2.0 2026-05-25
音声生成 / TTS GitHub ebook2audiobook
「ebook2audiobook (E2A)」は、電子書籍(非DRM)を高品質なオーディオブックに変換するツールです。高度なTTSエンジ…
★ 19.5k ⑂ 1.6k Apache-2.0 2026-07-15
LLM GitHub code-review-graph
code-review-graphは、AIコーディングツールがコードベース全体を毎回読み込むことで生じる非効率性と高コストを解決…
★ 19.5k ⑂ 2.1k MIT 2026-06-14
ASR / 音声認識 GitHub FunASR
FunASRは、エンドツーエンドの音声認識に特化した、研究者と開発者向けのツールキットです。音声認識(ASR)、音声活…
★ 19.2k ⑂ 1.9k MIT 2026-07-14
音声生成 / TTS GitHub NeMo
NVIDIA NeMo Speechは、大規模言語モデル、マルチモーダル、音声AI(自動音声認識、Text-to-Speech)向けにNVIDIAが…
★ 17.8k ⑂ 3.5k Apache-2.0 2026-07-27
音声生成 / TTS GitHub VideoLingo
VideoLingoは、YouTube動画のダウンロードから翻訳、ローカライズ、吹き替えまでをオールインワンで行うツールです。…
★ 17.7k ⑂ 2.0k Apache-2.0 2026-07-02
動画生成 GitHub Duix-Avatar
Duix.Avatarは、Duix.comによって開発された、完全にオープンソースのAIアバターツールキットです。本ツールは、ユー…
★ 14.0k ⑂ 2.3k NOASSERTION 2026-04-21
音声生成 / TTS GitHub supertonic
Supertonicは、ONNX Runtimeを介してデバイス上で動作する、超高速かつ高品質な多言語テキスト読み上げシステムです…
★ 13.5k ⑂ 1.4k MIT 2026-07-24
音声生成 / TTS GitHub voice-pro
Voice-Proは、YouTube動画の処理、音声認識、翻訳、テキスト読み上げ、音声クローン、多言語翻訳を統合したAIパワー…
★ 11.2k ⑂ 1.6k GPL-3.0 2026-07-13
音声生成 / TTS GitHub KrillinAI
KrillinAIは、AIを活用したビデオの翻訳・吹き替えを可能にする多機能ツールです。ビデオのダウンロード、音声認識、…
★ 10.6k ⑂ 982 GPL-3.0 2026-07-24
LLM GitHub learn-harness-engineering
AIコーディングエージェントが確実に動作するためのHarness Engineeringに特化したプロジェクトベースの学習コースで…
★ 10.4k ⑂ 1.1k MIT 2026-07-10
マルチモーダル GitHub X-AnyLabeling
X-AnyLabelingは、Segment Anythingなどの強力なAIモデルを活用し、データラベリングを効率化するツールです。自動ラ…
★ 9.8k ⑂ 1.1k GPL-3.0 2026-07-13
LLM GitHub garden-skills
Garden Skillsは、Claude Code、Cursor、CodexなどのAIコーディングエージェント向けに、Webデザイン、知識検索、画…
★ 9.5k ⑂ 1.3k MIT 2026-07-12
音声生成 / TTS GitHub moonshine
Moonshine Voiceは、開発者向けのオープンソースAIツールキットで、リアルタイムの音声エージェントやアプリケーショ…
★ 8.7k ⑂ 476 NOASSERTION 2026-07-12
ASR / 音声認識 GitHub OmniVoice-Studio
OmniVoice Studioは、オープンソースのElevenLabs代替ツールです。リアルタイムディクテーション、3秒の音声クリップ…
★ 8.3k ⑂ 1.3k NOASSERTION 2026-07-13
画像生成 GitHub awesome-gpt-image-2
YouMind-OpenLabが提供する「Awesome GPT Image 2 Prompts」は、OpenAIの次世代画像生成モデル「GPT Image 2」に特化…
★ 8.2k ⑂ 741 NOASSERTION 2026-07-13
AIエージェント GitHub ShortGPT
ShortGPTは、YouTubeショートやTikTokチャンネルの自動化に特化したAIビデオ自動化フレームワークです。LLM指向の編…
★ 7.7k ⑂ 1.1k MIT 2025-02-10
音声生成 / TTS GitHub MeloTTS
MeloTTSは、MITとMyShell.aiによって開発された、高品質な多言語テキスト読み上げライブラリです。英語(複数アクセ…
★ 7.5k ⑂ 1.1k MIT 2024-12-24
マルチモーダル GitHub Qwen-VL
Qwen-VLは、Alibaba Cloudが開発した大規模ビジョン言語モデル「通义千问-VL」の公式リポジトリです。Qwen-VL-Plusお…
★ 6.7k ⑂ 493 NOASSERTION 2024-08-07
LLM GitHub whichllm
「whichllm」は、ユーザーのコンピューターハードウェア(GPU/CPU/RAM)を自動検出し、その環境で最も性能を発揮する…
★ 6.0k ⑂ 319 MIT 2026-07-08
マルチモーダル GitHub lmms-eval
lmms-evalは、テキスト、画像、ビデオ、オーディオといった様々なモダリティを横断する、オールインワンのマルチモー…
★ 4.3k ⑂ 635 NOASSERTION 2026-08-03
音声生成 / TTS HF XTTS-v2
XTTS-v2は、Coquiが開発した高度な音声生成モデルです。わずか6秒の短い音声クリップを用いることで、既存の声を17種…
❤ 3.7k ↓ 10.0M other 2023-12-11
AIエージェント GitHub MetaClaw
MetaClawは、会話を通じてAIエージェントが自律的に学習し進化するツールです。脳の学習メカニズムに着想を得ており…
★ 3.5k ⑂ 446 MIT 2026-06-07
AIエージェント GitHub goclaw
GoClawは、OpenClawをGo言語で再構築したマルチテナントAIエージェントプラットフォームです。マルチテナント分離、5…
★ 3.4k ⑂ 973 NOASSERTION 2026-07-15