3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#Python (2196 repos)

「Python」タグが付いたリポジトリ

← 全リポジトリ

マルチモーダル
GitHub
Qwen3-VL-Video-Grounding
Qwen3-VL-Video-Groundingは、Qwen3-VL多モーダル画像言語モデルを活用したGradioベースのWebアプリケーションです。…
★ 15 ⑂ 3 Apache-2.0 2026-02-28
3D / NeRF
GitHub
RetrieveVGGT
RetrieveVGGTは、トレーニング不要で長時間のストリーミング3D再構築を可能にする革新的なフレームワークです。VGGT…
★ 15 Apache-2.0 2026-05-13
ComfyUI
GitHub
overtli-studio-suite
OvertliDS/overtli-studio-suiteは、Windows環境に最適化されたComfyUIカスタムノードスイートで、ローカルおよびク…
★ 15 ⑂ 4 MIT 2026-04-11
動画生成
GitHub
NanoI2V
NanoI2Vは、最先端の画像-動画変換(I2V)モデルをゼロから構築するためのステップバイステップのガイドです。拡散ベ…
★ 14 MIT 2026-07-03
3D / NeRF
GitHub
stechdrive-3dgs-utils
このツールは、360度カメラで撮影した動画を、3D Gaussian Splatting(3DGS)のトレーニングに利用できる画像、マス…
★ 14 MIT 2026-07-09
3D / NeRF
GitHub
gtsam-splatfactors
このツール「gtsam-splatfactors」は、既存の3D Gaussian Splatting SLAM (3DGS-SLAM) システムが抱える、勾配降下法…
★ 14 MIT 2026-06-05
画像生成
GitHub
minFLUX
minFLUXは、Black Forest LabsによるFLUX.1およびFLUX.2拡散トランスフォーマーの、非公式かつ最小限のPyTorch実装で…
★ 14 ⑂ 2 Apache-2.0 2026-05-13
ComfyUI
GitHub
free-comfyui-colab-pack
このプロジェクトは、人気のComfyUIワークフローをGoogle Colab上で無料で実行できるように設計されたノートブック集…
★ 14 ⑂ 1 NOASSERTION 2026-03-11
動画生成
GitHub
FlashTalk-Training-Code
このリポジトリは、FlashTalkの非公式なトレーニングコード実装です。FlashTalkは音声駆動型のデジタルヒューマンモ…
★ 14 ⑂ 4 Apache-2.0 2026-06-25
音声生成 / TTS
GitHub
OmniVoice-FastAPI
OmniVoice FastAPIは、多言語対応のゼロショットTTS(Text-to-Speech)エンジン「OmniVoice」の機能を、Dockerで手軽…
★ 14 ⑂ 3 Apache-2.0 2026-04-14
3D / NeRF
GitHub
flowing
「FLOWING 🌊: Implicit Neural Flows for Structure-Preserving Morphing」の公式実装で、2025年のNeurIPSで発表さ…
★ 14 ⑂ 1 MIT 2026-05-19
ASR / 音声認識
GitHub
hearsay
hearsayは、YouTube動画、ポッドキャスト、ローカル録音などの多様な音声・動画コンテンツを、クリーンでタイムスタ…
★ 14 ⑂ 1 MIT 2026-06-14
3D / NeRF
GitHub
SceneAligner
SceneAlignerは、様々な実環境画像とラスタライズされたフロアプランを入力として、画像から重力に沿った3D点群を再…
★ 14 2026-05-22
AIエージェント
GitHub
MelonS-Agents
MelonS-Agentsは、自己構築・自己検証型のコロニーシムゲームプロトタイプを開発するAIエージェントです。音楽ビデオ…
★ 14 ⑂ 3 MIT 2026-07-10
画像生成
GitHub
Rex-solver
Rexは、拡散モデルのサンプリング、反転、編集、補間タスクに利用可能な、代数的に可逆な指数型Runge-Kuttaソルバー…
★ 14 ⑂ 1 MIT 2026-08-02
ComfyUI
GitHub
ComfyUI-DreamScene360
このツールは、DreamScene360(ECCV 2024)の「Panorama-to-3D」パスをラップしたComfyUIカスタムノードです。360度…
★ 14 ⑂ 2 2026-04-08
音声生成 / TTS
GitHub
BridgeSpeak
BridgeSpeakは、AIコーディングエージェントに音声機能を提供するBridgeMind製のクロスエージェントスキルです。Open…
★ 14 ⑂ 5 MIT 2026-05-10
動画生成
GitHub
awesome-video-generation
このリストは、テキストから動画を生成するAI、リアルタイム動画、アバター・話し言葉ヘッド、動画のスタイル変換や…
★ 14 ⑂ 13 CC0-1.0 2026-06-17
マルチモーダル
GitHub
xhs-notes-skill
xhs-notes-skillは、中国のソーシャルメディア「小紅書(XHS/RedNote)」向けの画像とテキストコンテンツ作成を支援…
★ 14 MIT 2026-07-04
ASR / 音声認識
GitHub
douyin-living
「Douyin Live AI Clipper」は、抖音(Douyin)ライブ配信を自動で録画し、AIがハイライトシーンを自動で切り出すシ…
★ 14 ⑂ 4 MIT 2026-07-04
ASR / 音声認識
GitHub
Whisper-Skill
whisper-skillは、OpenAI API不要でローカル完結する無料の音声文字変換ツールです。99言語に対応し、Mac/Linux/Wind…
★ 13 ⑂ 9 2026-05-11
3D / NeRF
GitHub
ODE-GS
ODE-GSは、ICLR 2026で発表された「Latent ODEs for Dynamic Scene Extrapolation with 3D Gaussian Splatting」の公…
★ 13 ⑂ 3 MIT 2026-04-25
AIエージェント
GitHub
web-design-enhancer
「Web Design Enhancer」は、AIエージェントが生成するウェブデザインの品質を劇的に向上させるスキルです。一般的な…
★ 13 ⑂ 2 2026-07-12
動画生成
GitHub
seedance-2.0-api
Seedance 2.0 APIは、ByteDanceが提供する最先端の動画生成モデル「Seedance 2.0」の公式APIです。テキスト、画像、…
★ 13 ⑂ 1 2026-04-09