3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

音楽生成
GitHub
studiomi300
studiomi300は、1つのプロンプトから30秒のシネマティックなリール動画を生成するエンドツーエンドのツールです。Dir…
★ 43 ⑂ 9 MIT 2026-05-22
ComfyUI
GitHub
ComfyUI_StableAvatar
ComfyUI上でStableAvatarを使い、音声に合わせてアバター動画を生成するためのカスタムノードです。音声の長さに応じ…
★ 43 ⑂ 6 MIT 2025-08-21
ComfyUI
GitHub
VantageLongWanVideo
VantageLongWanVideoは、ComfyUIで長時間のプロンプト駆動型ビデオ生成を行うための軽量なプロジェクト管理システム…
★ 43 ⑂ 14 MIT 2025-09-25
ComfyUI
GitHub
ComfyUI-SAMURAI–SAM2-
このツールは、ComfyUI用のSAMURAIモデルベースの動画オブジェクトセグメンテーションノードを提供します。ユーザー…
★ 43 ⑂ 5 Apache-2.0 2024-12-01
3D / NeRF
GitHub
msplat
rayanht/msplatは、Apple Siliconデバイス向けにMetalをフル活用した3D Gaussian Splattingのトレーニングエンジンで…
★ 42 ⑂ 14 Apache-2.0 2026-03-10
画像生成
GitHub
Coarse-guided-Gen
「Coarse-guided-Gen」は、粗いサンプルをガイドとして、条件付きのビジュアルコンテンツ生成を可能にするツールです…
★ 42 ⑂ 4 2026-05-08
マルチモーダル
GitHub
VL-Calibration
VL-Calibrationは、大規模視覚言語モデル(LVLMs)の推論における信頼性キャリブレーションを向上させるためのフレー…
★ 42 Apache-2.0 2026-04-13
マルチモーダル
HF
music-flamingo-think-2601-hf
Music Flamingo Thinkは、音楽や楽曲音声を入力として詳細な説明や質疑応答を行えるNVIDIAの音声言語モデルです。ジ…
❤ 41 ↓ 747 other 2026-04-07
ComfyUI
GitHub
ComfyUI-FBCNN
「ComfyUI-FBCNN」は、人気の画像生成UI「ComfyUI」に、JPEG画像の圧縮ノイズ(アーティファクト)除去に特化したFBC…
★ 41 ⑂ 7 GPL-3.0 2025-02-24
LLM
GitHub
bit-brain
BitBrainは、最小限のGPUリソース(RTX 3090以上)で独自の小型LLM(miniLLM)を学習できるプロジェクトです。Qwen3-…
★ 41 ⑂ 2 Apache-2.0 2026-05-04
ComfyUI
GitHub
ComfyUI-MediaMixer
「MediaMixer」は、ComfyUI向けの動画ユーティリティノード集です。動画結合、最終・初回フレーム抽出、YouTube動画…
★ 40 ⑂ 8 CC0-1.0 2024-12-05
音声生成 / TTS
GitHub
supertonic3-voice-clone
Supertone/supertonic-3モデル向けに、音声スタイル(.jsonファイル)を学習させるためのツールです。低GPU使用量(…
★ 40 ⑂ 10 MIT 2026-07-08
ComfyUI
GitHub
ComfyUI-sudo-latent-upscale
ComfyUI向けの潜在空間アップスケール用カスタム実装・モデル集です。画像をRGBで拡大してから再エンコードするので…
★ 40 ⑂ 7 BSD-3-Clause 2024-05-22
画像生成
GitHub
colored-noise-sampling
Colored Noise Diffusion Sampling (CNS)は、拡散モデルの画像生成プロセスを最適化するプラグアンドプレイ型のSDEサ…
★ 39 ⑂ 3 MIT 2026-06-01
画像生成
GitHub
RTDMD
RTDMD(Reward-Tilted Distribution Matching Distillation)は、少ないステップ数で高品質な画像を生成する「few-st…
★ 39 ⑂ 1 Apache-2.0 2026-06-06
ComfyUI
GitHub
ComfyUI-Img2Img-Turbo
このツールは、人気の画像生成UIであるComfyUIのImg2Img機能を高速化するための拡張機能です。GaParmar氏のImg2Img-T…
★ 39 ⑂ 7 MIT 2024-05-22
マルチモーダル
GitHub
synthvision
SynthVisionは、医療画像VQA(Visual Question Answering)データセットの生成と、それを用いたVLM(Vision Language…
★ 39 ⑂ 5 2026-03-23
ComfyUI
GitHub
ComfyUI-OpenPose
このリポジトリは、OpenPoseモデルを使用して人間のポーズキーポイントを抽出し、視覚化するPython実装を提供します…
★ 38 ⑂ 5 GPL-3.0 2024-07-31
画像生成
GitHub
StyleExpert
StyleExpertは、HVision-NKUによって開発された、多様な画像スタイル変換を可能にするツールです。Mixture of Style …
★ 38 2026-03-19
動画生成
GitHub
Lightning-Unified-Video-Editor-via-In-Context-Sparse-Attention
LIVEditor-14Bは、文脈に即したスパースアテンション(In-Context Sparse Attention)を活用することで、動画編集に…
★ 37 2026-05-15
LLM
GitHub
attn_res
このプロジェクトは、Kimi TeamとMoonshotAIによる「Attention Residuals」のPyTorch実装です。Grouped Query Attent…
★ 37 ⑂ 3 Apache-2.0 2026-03-16
LLM
GitHub
TimeOmni-1
TimeOmni-1は、ICLR 2026に採択された研究に基づく、大規模言語モデルが時系列データを用いた複雑な推論を行うことを…
★ 36 ⑂ 3 Apache-2.0 2026-06-12
3D / NeRF
GitHub
NeRAF
NeRAFは、ICLR 2025で発表された、3Dシーンの情報を統合したニューラルラディアンスフィールドとアコースティックフ…
★ 36 ⑂ 2 NOASSERTION 2026-03-11
3D / NeRF
GitHub
TRELLIS-AMD
このツールは、MicrosoftのImage-to-3D生成ツール「TRELLIS」を、AMD製GPU(特にROCm対応モデル)で動作するように修…
★ 35 ⑂ 5 MIT 2026-05-09