3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Python (2196 repos)
「Python」タグが付いたリポジトリ
← 全リポジトリ
音声生成 / TTS GitHub ghost-narrator
Ghost Narratorは、ブログや静的サイト向けに自己ホスト型のAI音声ナレーションを提供するツールです。ElevenLabsの…
★ 6 ⑂ 1 MIT 2026-07-13
音声生成 / TTS GitHub Awesome-Audio-Generation
この「Awesome-Audio-Generation」リポジトリは、音声生成に関する最新の研究論文、コード、およびプロジェクトを厳…
★ 6 ⑂ 1 2025-10-11
マルチモーダル GitHub Multimodal-Edge-Node
Multimodal-Edge-Nodeは、実験的なノードベースの視覚的推論とマルチモーダル推論キャンバスです。ユーザーはカスタ…
★ 6 Apache-2.0 2026-05-01
音声生成 / TTS GitHub the-muser
The Muserは、SunoやElevenLabs Musicのオープンソース代替として、自然言語による音楽作曲を可能にするツールです。…
★ 6 ⑂ 1 MIT 2026-05-27
マルチモーダル GitHub wgram-lm
W-GRAM-LMは、世界誘導型再帰的アトラクタ言語モデルの研究用コードベースです。潜在世界予測、多軌道推論、解答アト…
★ 6 AGPL-3.0 2026-07-26
3D / NeRF GitHub gsplat-mlx
gsplat-mlxは、Apple Silicon環境で3D Gaussian Splattingを高速に実行・開発するためのコアライブラリです。mlxのC+…
★ 6 MIT 2026-07-29
ComfyUI GitHub ComfyUI-MCP-Server-Python
ComfyUI-MCP-Serverは、ComfyUIのワークフローをAIエージェントが利用可能なパラメータ設定可能なツールに変換するMC…
★ 6 MIT 2026-03-13
音声生成 / TTS GitHub voice-audition
VoiceAuditionは、AIエージェント向けのTTS(Text-to-Speech)音声ディスカバリー・推薦ツールです。9つのTTSプロバ…
★ 6 ⑂ 1 MIT 2026-07-27
LLM GitHub Claude-Agentic-Skills2.0-version
vignesh2027/Claude-Agentic-Skills2.0-versionは、Anthropic社のClaude AI向けの「AgentOS 2.0」として、135以上の…
★ 6 MIT 2026-05-20
音声生成 / TTS GitHub claude-code-audio-recap
このツールは、Claude Codeの作業内容を画面を見ずに音声で把握できるプラグインです。Claude Codeの各ターンの要約…
★ 6 Apache-2.0 2026-06-18
音声生成 / TTS GitHub qwen3-tts-spanish-voices
このツールは、Qwen3-TTSを利用してスペイン語のテキスト読み上げ(TTS)機能を提供します。Apple Silicon搭載のMac…
★ 6 ⑂ 2 MIT 2026-07-12
画像生成 GitHub spade
SPADEは、オフラインブラックボックス最適化において、サポートされていない領域での予測の過信を防ぐためのツールで…
★ 6 MIT 2026-06-09
音楽生成 GitHub PiAPI-Skills
このツールは、AIコーディングエージェントがPiAPIを介してMidjourney、Suno、Kling、Lumaなどの多様なAIモデル群を…
★ 6 MIT 2026-06-24
3D / NeRF GitHub mutual-info-optimization
このリポジトリは、実際の画像とテクスチャ付き3Dメッシュ間の相互情報量(Mutual Information)を利用して、6自由度…
★ 6 2026-03-20
AIエージェント GitHub noah-gen3-type2
「noah-gen3-type2」は、コンテキスト管理、記憶閉ループ、自律進化を特徴とする汎用型AI認知アーキテクチャです。「…
★ 6 2026-07-01
音声生成 / TTS GitHub vocalis
Zencia Vocalisは、Microsoft VibeVoiceを基盤とした、オンデバイスで動作する会話型音声AIです。ユーザーがAIと音声…
★ 6 MIT 2026-05-21
音声生成 / TTS GitHub NeuTTS-Studio
NeuTTS Studioは、オンデバイスでのテキスト読み上げ(TTS)、音声クローニング、リアルタイムストリーミング機能を…
★ 6 NOASSERTION 2026-03-31
AIエージェント GitHub Deep-Research-104
このプロジェクトは、Web検索と高度な推論モデル(OpenAI o3、DeepSeek-R1、ローカルOllamaモデルなど)を組み合わせ…
★ 6 MIT 2026-06-05
ComfyUI GitHub mbq
MBQは、ComfyUIの生成画像を効率的に管理・分析するためのツールセットです。主な機能として、ComfyUIのPNG画像に埋…
★ 6 ⑂ 2 MIT 2026-06-25
画像生成 GitHub FlowSR
FlowSRは、ICCV 2025で発表された、Consistency Rectified Flowを活用した高速画像超解像ツールです。低解像度画像か…
★ 6 NOASSERTION 2026-06-01
LLM GitHub Scraper
Deep Web Scraperは、サイバーセキュリティ研究者、脅威インテリジェンスアナリスト、プライバシー擁護者を対象とし…
★ 6 ⑂ 1 GPL-3.0 2026-05-02
マルチモーダル GitHub multimodal-docs-public
M-LongDocは、EMNLP 2025で採択されたマルチモーダル超長文ドキュメント理解のための挑戦的なベンチマークと、検索対…
★ 6 2026-06-09
ASR / 音声認識 GitHub wisprflow-sdk
WisprFlow SDKは、Wispr Flowデスクトップクライアントの非公式Python SDKです。Wispr Flowの音声APIをリバースエン…
★ 5 ⑂ 1 MIT 2026-06-09
音声生成 / TTS GitHub openvoice-cloning
OpenVoiceは、短い参照音声から瞬時に音声をクローニングできるオーディオ基盤モデルです。ターゲットスピーカーの声…
★ 5 MIT 2026-06-13