3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#Python (2196 repos)

「Python」タグが付いたリポジトリ

← 全リポジトリ

マルチモーダル
GitHub
Qwen-Lens-Studio
Qwen Lens Studioは、単一のQwenビジョン言語モデルを中心に構築されたマルチモーダルAIスタジオです。UIスクリーン…
★ 27 ⑂ 6 2026-04-23
マルチモーダル
GitHub
SR-3D
SR-3Dは、ICLR'26で発表された「3D Aware Region Prompted Vision Language Model」の実装です。単一視点と多視点入…
★ 27 Apache-2.0 2026-02-19
3D / NeRF
GitHub
metashape-mcp
このMetashape MCPサーバーは、AIによるAgisoft Metashape Professionalの写真測量パイプライン自動化を実現するツー…
★ 27 ⑂ 4 MIT 2026-05-07
動画生成
GitHub
awesome-video-diffusions
このツールは、arXivのビデオ拡散・ビデオ生成に関する最新研究論文、プロジェクト、リソースを自動更新で収集し、キ…
★ 27 2026-07-16
3D / NeRF
GitHub
UniVerse
UniVerseは、ICCV 2025で発表された「動画拡散モデルのシーン事前分布を活用したロバストなラディアンスフィールド再…
★ 27 2025-10-03
ASR / 音声認識
GitHub
TypelessMLX
このTypelessMLXは、macOS向けの音声文字変換(ディクテーション)アプリケーションです。Apple Silicon向けに最適化…
★ 27 ⑂ 3 2026-04-26
画像生成
GitHub
codex-image
Codex-imageは、OpenAI Images APIを用いた画像生成・編集に特化したCodexスキルです。ネイティブの画像生成機能とは…
★ 27 ⑂ 3 MIT 2026-05-11
音声生成 / TTS
GitHub
silma-tts
SILMA Arabic TTS v1は、SILMA AIによって開発された軽量かつ高性能なバイリンガル(アラビア語と英語)テキスト音声…
★ 26 ⑂ 6 MIT 2026-05-07
音声生成 / TTS
GitHub
xiaolong-openclaw
「小龙 OpenClaw」は、OpenClawを音声で操作可能にする中国語音声アシスタントです。ユーザーは「小龙小龙」というウ…
★ 26 ⑂ 7 MIT 2026-04-09
マルチモーダル
GitHub
EfficientVideoAgent
EVA(Efficient Video Agent)は、動画エージェントのための効率的な強化学習フレームワークです。このモデルは「pla…
★ 26 2026-05-06
ComfyUI
GitHub
ComfyUI-Sapiens2-Easy
「ComfyUI-Sapiens2-Easy」は、Meta Sapiens2モデルをComfyUIのネイティブノードとして統合するツールです。単一の画…
★ 26 ⑂ 2 NOASSERTION 2026-05-04
3D / NeRF
GitHub
varsplat
VarSplatは、不確実性認識型の3D Gaussian Splattingを基盤とした堅牢なRGB-D SLAMシステムです。個々のスプラットの…
★ 25 MIT 2026-06-14
画像生成
GitHub
modl
modlは、ローカル環境でAI画像生成とLoRA学習を行うためのツールキットです。モデルのダウンロードから依存関係の解…
★ 25 ⑂ 2 AGPL-3.0 2026-05-06
ComfyUI
GitHub
ComfyUI-LongCat-Avatar
rookiestar28/ComfyUI-LongCat-Avatarは、ComfyUI用のカスタムノード集で、LongCat Video Avatar 1.5のオーディオ駆…
★ 25 ⑂ 3 MIT 2026-06-15
音声生成 / TTS
GitHub
claude-tts
claude-ttsは、Claude CodeのAI応答を自動的に音声で読み上げるためのプラグインです。ElevenLabs、OpenAI、Google、…
★ 25 ⑂ 5 2026-05-29
動画生成
GitHub
comfyui-wan-i2v-control
ComfyUI WAN I2V Controlは、WAN Image-to-Video生成において、開始画像の特定の部分を選択的に変換するためのComfyU…
★ 25 ⑂ 1 2026-06-07
画像生成
GitHub
JustRayzist
JustRayzistは、Rayzist Z-Image Turboファインチューンを中心に構築された軽量なCUDAベースのローカル画像生成プラ…
★ 25 ⑂ 1 Apache-2.0 2026-05-19
画像生成
GitHub
ComfyUI-WebUI-Prompt-Bridge
ComfyUI WebUI Prompt Bridgeは、ComfyUIにWebUIスタイルのプロンプト編集機能を提供するノードです。ComfyUIの柔軟…
★ 25 ⑂ 1 MIT 2026-07-14
画像生成
GitHub
SynPS
SynPSは、CVPR 2026で発表された、複雑な非剛体画像編集のためのトレーニング不要な手法です。位置埋め込みと意味情…
★ 25 ⑂ 1 2026-03-09
LLM
GitHub
provenant
Provenantは、AIコーディングエージェント向けに最適化されたローカルコードベースメモリソリューションです。コード…
★ 25 ⑂ 12 2026-05-28
音声生成 / TTS
GitHub
humanness-index
VapiAIが開発・運用する「Humanness Index™」は、音声AIがどれだけ人間らしく聞こえるかを測定するオープンなベンチ…
★ 24 ⑂ 3 Apache-2.0 2026-06-17
音声生成 / TTS
GitHub
claude-voice
このツールは、Claude CodeのAIチャットでClaudeの応答を音声で聞くための、完全にローカルなTTS(Text-to-Speech)…
★ 24 ⑂ 6 MIT 2026-07-10
ComfyUI
GitHub
comfyui_stereoscopic
comfyui_stereoscopic は、ComfyUI向けのカスタムノード、ワークフロー、補助スクリプトをまとめたパッケージで、通…
★ 24 ⑂ 5 NOASSERTION 2026-07-13
ASR / 音声認識
GitHub
decibri
decibriは、Python、Rust、Node.js、ブラウザ向けに統一されたAPIを提供するクロスプラットフォームのオーディオエン…
★ 24 ⑂ 4 Apache-2.0 2026-07-27