3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

ComfyUI
GitHub
ComfyUI_LucidFlux
ComfyUI向けのカスタムノードで、LucidFluxを使った画像復元をComfyUI上で実行できるツールです。劣化画像の修復や高…
★ 62 ⑂ 2 Apache-2.0 2026-05-27
画像生成
GitHub
SesquiLSR
SesquiLSRは、SDXL、Flux、Flux2、Wan 2.1/Anima/Qwen Imageといった多様なモデル/VAEに対応し、1.0倍から2.0倍の範…
★ 62 ⑂ 3 MIT 2026-07-06
画像生成
GitHub
Fizgig
Fizgigは、Flux 2 Klein 9B LoRAに特化した統合スタジオです。LoRAのトレーニング、プロファイリング、修復、抽出を…
★ 60 ⑂ 3 Apache-2.0 2026-07-11
マルチモーダル
GitHub
GEditBench_v2
GEditBench v2は、汎用画像編集モデルの性能を人間が調整した基準で評価するための包括的なベンチマークです。1,200…
★ 59 ⑂ 1 2026-06-18
3D / NeRF
GitHub
dvlt.cu
dvlt.cuは、NVIDIAのDVLT (Déjà View Looping Transformer) をCUDA/C++で再実装した、依存関係のない高速な3D再構築…
★ 59 ⑂ 7 Apache-2.0 2026-06-04
3D / NeRF
GitHub
EcoSplat
EcoSplatは、効率制御可能なフィードフォワード3D Gaussian Splatting技術を実装したツールです。マルチビュー画像か…
★ 56 ⑂ 2 MIT 2026-06-11
画像生成
GitHub
LeapAlign_Code
LeapAlignは、フローマッチングモデルを人間の好みに合わせて微調整するための学習後手法です。完全なサンプリング軌…
★ 54 ⑂ 1 Apache-2.0 2026-06-13
音声生成 / TTS
GitHub
Audio-Oscar
Audio-Oscarは、複雑な音声シーン記述から長尺で制御可能な音声を生成するためのマルチエージェントフレームワークで…
★ 51 ⑂ 5 Apache-2.0 2026-06-08
画像生成
GitHub
RvR
RvR (Refinement via Regeneration) は、清華大学とTencent Hunyuanが開発した、画像リファインメントのための革新的…
★ 50 ⑂ 1 MIT 2026-05-26
画像生成
GitHub
gpic
GPIC(Giant Permissive Image Corpus)は、視覚生成モデリング研究のための巨大で許容性の高い画像コーパスです。約…
★ 50 ⑂ 2 MIT 2026-06-04
3D / NeRF
GitHub
OpenSfM
OpenSfMは、PythonとC++で開発されたオープンソースのStructure from Motion(SfM)ライブラリです。順序付けされて…
★ 49 ⑂ 11 BSD-2-Clause 2026-07-12
音声生成 / TTS
GitHub
Irodori-TTS-Server
「Irodori OpenAI TTS Server」は、Aratako/Irodori-TTSの500M v3ベースモデル向けに開発された、OpenAI Text-to-Spe…
★ 49 ⑂ 17 MIT 2026-07-10
ASR / 音声認識
GitHub
ora
Oraは、macOS向けのリアルタイムローカル音声翻訳アプリケーションです。Apple Silicon Mac上で動作し、全ての処理を…
★ 49 ⑂ 4 MIT 2026-06-04
画像生成
GitHub
MagicBokeh
MagicBokehは、高ズームで撮影された写真に対し、フォトリアリスティックで高品質なボケ効果を効率的に生成するため…
★ 48 ⑂ 1 2026-06-17
LLM
GitHub
spark-evals
このリポジトリは、DGX Sparkという特定のハードウェア環境で動作する、小規模な言語モデルや量子化モデルのベンチマ…
★ 47 ⑂ 1 2026-07-25
3D / NeRF
GitHub
OVGGT
OVGGTは、トレーニング不要で、任意に長いビデオストリームからリアルタイムで3D再構成を可能にする革新的なフレーム…
★ 45 ⑂ 1 NOASSERTION 2026-07-06
3D / NeRF
GitHub
vggt-factor-refinement
このプロジェクトは、ビデオから3D再構築を効率的に行うためのツールです。VGGT(Video-based General-purpose Geome…
★ 45 ⑂ 2 2026-06-16
音楽生成
GitHub
studiomi300
studiomi300は、1つのプロンプトから30秒のシネマティックなリール動画を生成するエンドツーエンドのツールです。Dir…
★ 43 ⑂ 9 MIT 2026-05-22
音声生成 / TTS
GitHub
supertonic3-voice-clone
Supertone/supertonic-3モデル向けに、音声スタイル(.jsonファイル)を学習させるためのツールです。低GPU使用量(…
★ 40 ⑂ 10 MIT 2026-07-08
画像生成
GitHub
colored-noise-sampling
Colored Noise Diffusion Sampling (CNS)は、拡散モデルの画像生成プロセスを最適化するプラグアンドプレイ型のSDEサ…
★ 39 ⑂ 3 MIT 2026-06-01
画像生成
GitHub
RTDMD
RTDMD(Reward-Tilted Distribution Matching Distillation)は、少ないステップ数で高品質な画像を生成する「few-st…
★ 39 ⑂ 1 Apache-2.0 2026-06-06
LLM
GitHub
TimeOmni-1
TimeOmni-1は、ICLR 2026に採択された研究に基づく、大規模言語モデルが時系列データを用いた複雑な推論を行うことを…
★ 36 ⑂ 3 Apache-2.0 2026-06-12
ComfyUI
GitHub
Dots-TTS-ComfyUI
このツールは、ComfyUI向けのカスタムノードコレクションであり、Dots TTSによる高品質なテキスト音声合成、音声クロ…
★ 34 ⑂ 4 Apache-2.0 2026-06-11
LLM
GitHub
Prism
PRISMは、マルチモーダル大規模言語モデル(特にLLaVA)の継続的学習設定における命令チューニングのためのPyTorchベ…
★ 33 ⑂ 6 MIT 2026-06-15