3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

画像生成
GitHub
UNITE-tokenization-generation
UNITEは、画像や分子などのモダリティに対応した、トークン化と潜在拡散モデルの生成を単一ステージでend-to-endに学…
★ 116 ⑂ 1 2026-03-24
3D / NeRF
GitHub
NAS3R
NAS3Rは、新規ビュー合成を介して自己教師あり3D再構築を行うためのフィードフォワードフレームワークです。このツー…
★ 114 ⑂ 8 MIT 2026-06-30
3D / NeRF
GitHub
SpatialBench
SpatialBenchは、マルチモーダル大規模言語モデル(MLLM)のビデオ空間理解能力を評価するオープンソースベンチマー…
★ 113 2026-05-28
動画生成
HF
Motif-Video-2B
Motif-Video 2BはMotif Technologiesが開発した、テキストや画像から動画を生成する低予算の拡散トランスフォーマー…
❤ 112 ↓ 118 apache-2.0 2026-05-15
音声生成 / TTS
GitHub
Qwen3-TTS-EasyFinetuning
「Qwen3-TTS Easy Finetuning」は、Qwen3-TTSモデルのファインチューニングを簡素化し、高速かつ高品質な音声クロー…
★ 112 ⑂ 20 Apache-2.0 2026-05-29
画像生成
GitHub
ComfyUI-PuLID-Flux2
このツールは、ComfyUIユーザー向けにFLUX.2モデルでの顔の一貫性を実現するPuLIDの初めての実装です。特に、生成さ…
★ 111 ⑂ 9 MIT 2026-05-21
ComfyUI
GitHub
comfyui_lora_tag_loader
このツールは、ComfyUI用のカスタムノード「LoRA Tag Loader for ComfyUI」です。テキストプロンプト内に記述されたL…
★ 110 ⑂ 17 GPL-3.0 2024-05-22
LLM
GitHub
PersonaVLM
PersonaVLMは、長期的なパーソナライゼーションを実現する革新的なマルチモーダルLLMエージェントフレームワークです…
★ 110 ⑂ 8 Apache-2.0 2026-04-16
3D / NeRF
GitHub
superfit
SuperFitは、CVPR 2026で発表された、3D形状にSuperFrusta、直方体、超二次曲面といったコンパクトなプリミティブア…
★ 108 ⑂ 6 NOASSERTION 2026-05-23
音楽生成
GitHub
theDAW
「theDAW」はGANTASMOが開発したAI音楽制作のためのオールインワンスタジオです。既存のオーディオ、テキストプロン…
★ 108 ⑂ 16 MIT 2026-07-10
画像生成
GitHub
ComfyUI-PiD
ComfyUI-PiDは、NVIDIAのPiD(Pixel Diffusion)技術をComfyUI上で利用するためのカスタムノード集です。画素拡散デ…
★ 107 ⑂ 9 MIT 2026-07-16
画像生成
GitHub
HiFi-Inpaint
HiFi-Inpaintは、CVPR 2026で発表された、人間と商品を組み合わせた高品質な画像を生成するための参照ベースのインペ…
★ 104 ⑂ 5 Apache-2.0 2026-06-07
ComfyUI
GitHub
ComfyUI-Foundation-1
ComfyUI-Foundation-1は、音楽制作のための構造化されたText-to-Sample拡散モデル「Foundation-1」に対応するComfyUI…
★ 104 ⑂ 17 NOASSERTION 2026-03-22
ComfyUI
GitHub
ComfyUI-DiffSynth-Studio
このツール「ComfyUI-DiffSynth-Studio」は、最先端の動画生成・スタイル変換AIである「DiffSynth-Studio」の機能を…
★ 102 ⑂ 15 Apache-2.0 2024-08-05
画像生成
GitHub
LongLive-RAG
LongLive-RAGは、長尺動画生成における品質と一貫性の課題を解決するための汎用的なRetrieval-Augmented Frameworkで…
★ 100 ⑂ 2 Apache-2.0 2026-06-04
画像生成
GitHub
FlowInOne
FlowInOneは、画像を入力として画像を出力する、ビジョン中心のマルチモーダル画像生成モデルです。Image-in, Image-…
★ 98 ⑂ 5 MIT 2026-06-18
マルチモーダル
HF
MOSS-VL-Instruct-0408
MOSS-VL-Instruct-0408は、OpenMOSS系の視覚言語モデルを教師あり微調整したマルチモーダル推論用チェックポイントで…
❤ 97 ↓ 1.2k apache-2.0 2026-04-22
マルチモーダル
GitHub
locate-anything
「locate-anything」は、NVIDIAのLocateAnything-3Bモデルを利用した、モバイルフレンドリーなWebインターフェースで…
★ 95 ⑂ 13 Apache-2.0 2026-07-15
ComfyUI
GitHub
ComfyUI_PhotoDoodle
PhotoDoodleは、限られたペアデータから芸術的な画像編集を学習する手法をComfyUIで利用可能にするツールです。本ツ…
★ 93 ⑂ 2 MIT 2025-03-20
3D / NeRF
GitHub
NeRF2Physics
NeRF2Physicsは、CVPR 2024で発表された、言語埋め込み特徴フィールドから物理的特性を理解するためのツールです。Ne…
★ 93 ⑂ 4 MIT 2025-11-16
ComfyUI
GitHub
ComfyUI-DiffusersImageOutpaint
ComfyUI上でDiffusersベースの画像アウトペイントを行うためのカスタムノード集です。SDXL系のUNetとControlNetを読…
★ 92 ⑂ 5 Apache-2.0 2026-07-06
画像生成
HF
PixelSmile
PixelSmileは、既存の顔画像に対して笑顔・喜びなどの表情を細かく編集するための画像生成・編集モデルです。Qwen-Im…
❤ 91 ↓ 759 apache-2.0 2026-05-08
画像生成
GitHub
ReactiveGWM
ReactiveGWMは、プレイヤー操作とNPCの自律性を分離することで、ゲーム内のNPCをより動的に制御する新しいゲーム世界…
★ 91 ⑂ 11 2026-06-16
動画生成
GitHub
MobileI2V
「MobileI2V」は、画像から高品質な動画を高速で生成できるツールです。特にモバイルデバイスでの利用に最適化されて…
★ 89 ⑂ 5 Apache-2.0 2026-05-20