3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

画像生成
HF
Flux2-Klein-9B-Consistency
Flux2-Klein-9B-Consistencyは、black-forest-labs/FLUX.2-klein-9B向けのLoRAで、追加のキーワードなしでもキャラク…
❤ 445 ↓ 41.8k apache-2.0 2026-04-19
LLM
GitHub
KVarN
KVarNは、LLMのKVキャッシュ量子化をvLLM環境で実現するネイティブバックエンドです。特に、エージェントや長文コン…
★ 435 ⑂ 28 Apache-2.0 2026-06-22
ASR / 音声認識
GitHub
LiveTranslate
LiveTranslateは、Windows向けのリアルタイム音声翻訳ツールです。システムオーディオとマイク入力をキャプチャし、A…
★ 430 ⑂ 37 MIT 2026-07-11
マルチモーダル
HF
sam3.1
SAM 3.1は、Metaの画像・動画向け統合基盤モデルで、プロンプト指定可能なセグメンテーションを提供します。テキスト…
❤ 424 ↓ 84.8k other 2026-03-27
3D / NeRF
HF
HY-Motion-1.0
「HY-Motion 1.0」は、Tencentが開発した、テキストプロンプトから3Dヒューマンモーションを生成するための最先端モ…
❤ 422 ↓ 231 other 2025-12-31
マルチモーダル
GitHub
VEGA-3D
VEGA-3Dは、「Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding」の公式実装…
★ 421 ⑂ 23 Apache-2.0 2026-06-18
3D / NeRF
GitHub
MasterSelects
MasterSelectsは、ブラウザ上で動作するローカルファーストのメディアエディターで、ビデオ、オーディオ、ベクターア…
★ 416 ⑂ 55 MIT 2026-07-27
画像生成
GitHub
FluxRT
FluxRTは、FLUX.2-klein-4Bモデルを搭載し、消費者向けGPUに最適化されたリアルタイムストリーム編集パイプラインで…
★ 414 ⑂ 56 Unlicense 2026-06-13
動画生成
GitHub
World-R1
World-R1は、テキストからビデオを生成する際に、3Dの幾何学的制約を強化学習で強化する新しいフレームワークです。…
★ 407 ⑂ 16 MIT 2026-06-03
3D / NeRF
GitHub
HDR-GS
HDR-GSは、Gaussian Splatting技術を用いて、HDR(ハイダイナミックレンジ)の新規視点合成を1000倍の速度で効率的に…
★ 386 ⑂ 15 MIT 2025-10-10
LLM
GitHub
TurboOCR
TurboOCRは、C++、CUDA、TensorRT技術を活用した高速GPU OCRサーバーです。FUNSDデータセットで270 img/s、疎な画像…
★ 383 ⑂ 50 MIT 2026-07-15
ComfyUI
GitHub
ComfyUI_FlashVSR
ComfyUI_FlashVSRは、リアルタイム拡散ベースのストリーミングビデオ超解像技術「FlashVSR」をComfyUI上で利用可能に…
★ 376 ⑂ 23 Apache-2.0 2026-02-23
画像生成
GitHub
RefAlign
RefAlignは、参照画像をもとに動画を生成するReference-to-Video向けのPyTorch実装です。学習時にDiTの参照分岐特徴…
★ 376 ⑂ 20 NOASSERTION 2026-06-19
3D / NeRF
GitHub
sam-body4d
SAM-Body4Dは、動画からトレーニング不要で一時的に一貫性のある堅牢な4D人体メッシュを復元するツールです。SAM-3、…
★ 366 ⑂ 34 MIT 2026-05-11
3D / NeRF
GitHub
OmniVGGT-official
OmniVGGTは、空間認識のための最先端の基盤モデルです。本ツールは、深度、カメラ内部パラメータ、ポーズといった任…
★ 365 ⑂ 31 MIT 2026-05-21
ComfyUI
GitHub
ComfyUI-Depthflow-Nodes
「ComfyUI-Depthflow-Nodes」は、2D画像を魅力的な2.5Dパララックスアニメーションに変換するためのComfyUI用ノード…
★ 358 ⑂ 22 AGPL-3.0 2026-02-15
画像生成
GitHub
Hallo-Live
Hallo-Liveは、テキスト入力からリアルタイムでアバターのビデオと音声を生成する先進的なフレームワークです。因果…
★ 330 ⑂ 52 MIT 2026-06-24
LLM
GitHub
NexusRAG
NexusRAGは、ベクトル検索、ナレッジグラフ、クロスエンコーダー再ランキングを統合した高度なハイブリッドRAGシステ…
★ 327 ⑂ 66 2026-04-20
ComfyUI
GitHub
Comfy-Photoshop-SD
Comfy-Photoshop-SDは、画像生成AIツールComfyUIとPhotoshopのAuto-Photoshop-SDプラグインを連携させる拡張機能です…
★ 319 ⑂ 20 MIT 2024-06-14
ComfyUI
GitHub
style_aligned_comfy
ComfyUI向けにStyleAligned技術を実装したツールです。このツールは、画像生成において一貫したスタイルを適用するこ…
★ 307 ⑂ 17 MIT 2025-03-24
動画生成
GitHub
Kiwi-Edit
Kiwi-Editは、自然言語の指示と参照画像を活用した多機能な動画編集を可能にする、完全にオープンソースのフレームワ…
★ 302 ⑂ 25 MIT 2026-05-13
音声生成 / TTS
GitHub
AudioStory
AudioStoryは、大規模言語モデル(LLM)とText-to-Audio (TTA) システムを統合し、長尺の物語音声生成を可能にする統…
★ 301 ⑂ 22 2025-09-21
ASR / 音声認識
GitHub
parakeet.cpp
parakeet.cppは、NVIDIAのParakeet音声認識モデルを超高速でC++に実装し、デバイス上での推論を可能にするライブラリ…
★ 297 ⑂ 14 MIT 2026-05-04