3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

動画生成
GitHub
Google-Colab_Notebooks
このリポジトリは、様々なAIプロジェクトのためのGoogle Colabノートブック集です。特に、ビジュアルプログラミング…
★ 491 ⑂ 168 2026-06-20
LLM
GitHub
KVarN
KVarNは、LLMのKVキャッシュ量子化をvLLM環境で実現するネイティブバックエンドです。特に、エージェントや長文コン…
★ 435 ⑂ 28 Apache-2.0 2026-06-22
ASR / 音声認識
GitHub
LiveTranslate
LiveTranslateは、Windows向けのリアルタイム音声翻訳ツールです。システムオーディオとマイク入力をキャプチャし、A…
★ 430 ⑂ 37 MIT 2026-07-11
マルチモーダル
GitHub
VEGA-3D
VEGA-3Dは、「Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding」の公式実装…
★ 421 ⑂ 23 Apache-2.0 2026-06-18
3D / NeRF
GitHub
MasterSelects
MasterSelectsは、ブラウザ上で動作するローカルファーストのメディアエディターで、ビデオ、オーディオ、ベクターア…
★ 416 ⑂ 55 MIT 2026-07-27
画像生成
GitHub
FluxRT
FluxRTは、FLUX.2-klein-4Bモデルを搭載し、消費者向けGPUに最適化されたリアルタイムストリーム編集パイプラインで…
★ 414 ⑂ 56 Unlicense 2026-06-13
動画生成
GitHub
World-R1
World-R1は、テキストからビデオを生成する際に、3Dの幾何学的制約を強化学習で強化する新しいフレームワークです。…
★ 407 ⑂ 16 MIT 2026-06-03
LLM
GitHub
TurboOCR
TurboOCRは、C++、CUDA、TensorRT技術を活用した高速GPU OCRサーバーです。FUNSDデータセットで270 img/s、疎な画像…
★ 383 ⑂ 50 MIT 2026-07-15
画像生成
GitHub
RefAlign
RefAlignは、参照画像をもとに動画を生成するReference-to-Video向けのPyTorch実装です。学習時にDiTの参照分岐特徴…
★ 376 ⑂ 20 NOASSERTION 2026-06-19
3D / NeRF
GitHub
OmniVGGT-official
OmniVGGTは、空間認識のための最先端の基盤モデルです。本ツールは、深度、カメラ内部パラメータ、ポーズといった任…
★ 365 ⑂ 31 MIT 2026-05-21
画像生成
GitHub
Hallo-Live
Hallo-Liveは、テキスト入力からリアルタイムでアバターのビデオと音声を生成する先進的なフレームワークです。因果…
★ 330 ⑂ 52 MIT 2026-06-24
ComfyUI
GitHub
ComfyUI-Pixaroma
ComfyUI Pixaromaは、Stable DiffusionのWeb UIであるComfyUIのワークフローを、プロフェッショナルグレードのクリエ…
★ 258 ⑂ 17 MIT 2026-07-13
ComfyUI
GitHub
ComfyUI-Whisper
ComfyUI Whisperは、OpenAIのWhisperモデルを利用して音声の文字起こしや動画への字幕追加を可能にするComfyUIの拡張…
★ 250 ⑂ 40 NOASSERTION 2026-06-07
音楽生成
GitHub
ACE-Step-Studio
ACE-Step Studioは、AIを駆使してフルソング、ボーカル、歌詞、カバー、リミックス、ミュージックビデオなどを生成で…
★ 249 ⑂ 33 MIT 2026-07-13
3D / NeRF
GitHub
habitat-gs
Habitat-GSは、Facebook ResearchのHabitat-Simを基盤とした、高忠実度ナビゲーションシミュレーターです。3D Gaussi…
★ 246 ⑂ 11 MIT 2026-07-08
3D / NeRF
GitHub
gsplat-unity
gsplat-unityは、Unity 2021以降で3D Gaussian Splatting (3DGS) をレンダリングするためのパッケージです。PlayCanv…
★ 236 ⑂ 32 MIT 2026-06-22
マルチモーダル
GitHub
count-anything
Count Anythingは、テキストクエリに基づいて画像内のあらゆるオブジェクトを数えることができる汎用モデルです。自…
★ 233 ⑂ 16 Apache-2.0 2026-07-20
LLM
GitHub
steerling
Steerlingは、解釈可能な因果拡散言語モデルであり、マスク型拡散言語モデリングとコンセプト分解を統合しています。…
★ 233 ⑂ 14 Apache-2.0 2026-07-13
3D / NeRF
GitHub
TokenGS
TokenGSは、自己教師ありレンダリング目的で3Dガウスを予測する革新的なツールです。学習可能なガウストークンをエン…
★ 229 ⑂ 9 Apache-2.0 2026-06-15
マルチモーダル
HF
nemotron-ocr-v2
Nemotron OCR v2は、複雑な実写画像や文書画像から文字を高精度かつ高速に抽出する、NVIDIAの商用利用可能な多言語OC…
❤ 228 ↓ 12.5k other 2026-05-22
マルチモーダル
HF
Qwopus3.6-35B-A3B-v1-GGUF
Qwopus3.6-35B-A3B-v1-GGUFは、Qwen3.6-35B-A3BをベースにLoRAで推論能力を強化した実験的なGGUF形式モデルです。35B…
❤ 218 ↓ 58.2k apache-2.0 2026-07-09
マルチモーダル
GitHub
autoresearch-qwen
autoresearch-qwenは、Qwen3-VL-4B-InstructモデルをDocumentVQAベンチマークで自律的に改善することを目的とした研…
★ 211 ⑂ 33 MIT 2026-06-14