3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#Python (2196 repos)

「Python」タグが付いたリポジトリ

← 全リポジトリ

画像生成
GitHub
LatentSync
LatentSyncは、音声入力に基づいて動画のリップシンクを生成する、エンドツーエンドの革新的な手法です。既存のピク…
★ 5.9k ⑂ 966 Apache-2.0 2025-06-20
ASR / 音声認識
GitHub
FunClip
FunClipは、オープンソースで高精度かつ使いやすい動画クリッピングツールです。Alibaba TONGYIのFunASR Paraformer…
★ 5.9k ⑂ 710 MIT 2026-07-07
LLM
GitHub
awesome-free-llm-apis
このリポジトリは、永続的な無料利用枠を提供する大規模言語モデル(LLM)APIの厳選されたリストを提供します。コス…
★ 5.8k ⑂ 545 CC0-1.0 2026-06-16
動画生成
GitHub
Awesome-Video-Diffusion
「Awesome Video Diffusion」は、動画生成、編集、復元、理解、NeRFなど、動画関連の多岐にわたるタスクに対応する最…
★ 5.7k ⑂ 366 2026-06-16
画像生成
GitHub
SUPIR
SUPIR(Scaling Up to Excellence: Practicing Model Scaling for Photo-Realistic Image Restoration In the Wild)…
★ 5.6k ⑂ 477 NOASSERTION 2025-05-12
画像生成
GitHub
DALLE-pytorch
このリポジトリは、OpenAIのDALL-E(テキストから画像を生成するTransformerモデル)をPyTorchで実装・再現したもの…
★ 5.6k ⑂ 644 MIT 2024-02-17
AIエージェント
GitHub
semble
Sembleは、AIエージェント向けに設計された高速かつ正確なコード検索ライブラリです。`grep+read`と比較して約98%も…
★ 5.6k ⑂ 236 MIT 2026-07-13
ASR / 音声認識
GitHub
whisper-diarization
このツールは、OpenAI Whisperの自動音声認識(ASR)機能と高度な話者分離(Speaker Diarization)技術を統合したパ…
★ 5.6k ⑂ 501 BSD-2-Clause 2026-02-23
マルチモーダル
GitHub
vllm-omni
vLLM-Omniは、既存のvLLMを拡張し、オムニモダリティモデルの効率的かつ低コストな推論と提供を可能にするフレームワ…
★ 5.6k ⑂ 1.3k Apache-2.0 2026-07-14
画像生成
GitHub
RedInk
RedInkは、Xiaohongshu(小紅書)向けの画像とテキストを生成する統合ツールです。「一文、一画像」のコンセプトで、…
★ 5.4k ⑂ 1.0k NOASSERTION 2026-06-30
3D / NeRF
GitHub
gsplat
gsplatは、3D Gaussian Splatting技術のCUDA高速化ラスタライゼーションを実現するオープンソースライブラリで、Pyth…
★ 5.4k ⑂ 910 Apache-2.0 2026-07-09
マルチモーダル
GitHub
mlx-vlm
MLX-VLMは、Apple Silicon Mac上でMLXを利用してVision Language Models(VLM)および音声・動画対応のOmni Modelsの…
★ 5.3k ⑂ 684 MIT 2026-07-27
ASR / 音声認識
GitHub
wenet
WeNetは、「Production First and Production Ready」を掲げるエンドツーエンド音声認識ツールキットです。最先端の…
★ 5.2k ⑂ 1.2k Apache-2.0 2026-06-15
3D / NeRF
GitHub
kaolin
NVIDIA Kaolinは、3D深層学習研究を加速するために設計されたPyTorchライブラリです。GPUに最適化された操作群を提供…
★ 5.1k ⑂ 628 Apache-2.0 2026-07-01
画像生成
GitHub
transformerlab-app
Transformer Labは、AI研究者向けに設計されたオープンソースの機械学習プラットフォームです。モデルの訓練、評価、…
★ 5.1k ⑂ 535 AGPL-3.0 2026-07-10
動画生成
GitHub
VideoCrafter
VideoCrafter2は、データ制約を克服し高品質な動画を生成するためのオープンソースの動画生成および編集ツールボック…
★ 5.1k ⑂ 415 NOASSERTION 2026-01-09
AIエージェント
GitHub
agents-cli
agents-cliは、Google Cloud上でAIエージェントを構築、評価、デプロイするためのコマンドラインインターフェース(C…
★ 5.0k ⑂ 536 Apache-2.0 2026-07-10
画像生成
GitHub
multidiffusion-upscaler-for-automatic1111
「Tiled Diffusion & VAE extension for sd-webui」は、Automatic1111のStable Diffusion Web UI向けの拡張機能です…
★ 5.0k ⑂ 347 NOASSERTION 2024-08-07
画像生成
GitHub
DragGAN
OpenGVLab/DragGANは、「Drag Your GAN」の非公式実装で、GAN(敵対的生成ネットワーク)で生成された画像をインタラ…
★ 5.0k ⑂ 475 2023-07-17
ASR / 音声認識
GitHub
whisper-jax
Whisper JAXは、OpenAIのWhisperモデルをJAXで実装したもので、特にTPUでの実行時にOpenAIのPyTorch版と比較して最大…
★ 4.7k ⑂ 413 Apache-2.0 2024-04-03
マルチモーダル
GitHub
align-anything
Align-Anythingは、あらゆるモダリティの大規模モデル(any-to-anyモデル)を人間の意図や価値観に合わせることを目…
★ 4.7k ⑂ 505 Apache-2.0 2025-11-27
動画生成
GitHub
echomimic_v2
EchoMimicV2は、Ant Groupが開発した、印象的で簡素化された半身の人間アニメーションを生成するための研究プロジェ…
★ 4.6k ⑂ 540 Apache-2.0 2026-02-23
3D / NeRF
GitHub
neuralangelo
「Neuralangelo」は、CVPR 2023で発表された高精度なニューラル表面再構成のための公式実装ツールです。既存の動画か…
★ 4.6k ⑂ 404 NOASSERTION 2024-04-14
画像生成
GitHub
PyTorch-Tutorial-2nd
「PyTorch実用教程(第二版)」は、PyTorchの基礎から応用、実運用までを網羅した包括的なチュートリアルです。深度…
★ 4.6k ⑂ 485 2025-01-27