3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

音楽生成
GitHub
studiomi300
studiomi300は、1つのプロンプトから30秒のシネマティックなリール動画を生成するエンドツーエンドのツールです。Dir…
★ 43 ⑂ 9 MIT 2026-05-22
音声生成 / TTS
GitHub
supertonic3-voice-clone
Supertone/supertonic-3モデル向けに、音声スタイル(.jsonファイル)を学習させるためのツールです。低GPU使用量(…
★ 40 ⑂ 10 MIT 2026-07-08
画像生成
GitHub
colored-noise-sampling
Colored Noise Diffusion Sampling (CNS)は、拡散モデルの画像生成プロセスを最適化するプラグアンドプレイ型のSDEサ…
★ 39 ⑂ 3 MIT 2026-06-01
画像生成
GitHub
RTDMD
RTDMD(Reward-Tilted Distribution Matching Distillation)は、少ないステップ数で高品質な画像を生成する「few-st…
★ 39 ⑂ 1 Apache-2.0 2026-06-06
LLM
GitHub
TimeOmni-1
TimeOmni-1は、ICLR 2026に採択された研究に基づく、大規模言語モデルが時系列データを用いた複雑な推論を行うことを…
★ 36 ⑂ 3 Apache-2.0 2026-06-12
ComfyUI
GitHub
Dots-TTS-ComfyUI
このツールは、ComfyUI向けのカスタムノードコレクションであり、Dots TTSによる高品質なテキスト音声合成、音声クロ…
★ 34 ⑂ 4 Apache-2.0 2026-06-11
動画生成
GitHub
seedance-api
Seedance 2.0 APIは、ByteDanceが開発したAI動画生成エンジンへの非公式アクセスを提供するツールです。このAPIは、…
★ 33 ⑂ 5 2026-06-24
LLM
GitHub
Prism
PRISMは、マルチモーダル大規模言語モデル(特にLLaVA)の継続的学習設定における命令チューニングのためのPyTorchベ…
★ 33 ⑂ 6 MIT 2026-06-15
ASR / 音声認識
GitHub
FastWord
FastWordは、macOSユーザー向けのプライベートでローカルなプッシュトゥトーク音声入力アプリケーションです。ホット…
★ 32 ⑂ 3 2026-05-23
音声生成 / TTS
GitHub
wavlm-vocoder-french
本ツールは、WavLM表現から高品質なフランス語音声を再構築するニューラルボコーダーです。JEP 2026に採択された論文…
★ 31 MIT 2026-06-30
画像生成
GitHub
mold
moldは、ローカルGPUを活用して画像や短いビデオクリップを生成する強力なCLIツールです。クラウドやPython環境を必…
★ 30 MIT 2026-07-12
音声生成 / TTS
GitHub
mlx-speech
mlx-speechは、Apple Silicon Mac(M1以降)向けに特化した、純粋なMLXベースの音声技術ツールキットです。クラウド…
★ 30 ⑂ 7 MIT 2026-06-24
画像生成
GitHub
comfyui-ReferenceLatentPlus
このツールはComfyUIの標準`ReferenceLatent`ノードを強化したドロップイン代替品です。画像ごとに参照強度、タイム…
★ 29 ⑂ 4 2026-06-07
3D / NeRF
GitHub
iMaC
このツールは、iMaC(Embodied World Models向けにアクションをモーションとコンタクトイメージに変換するモデル)と…
★ 29 2026-06-21
3D / NeRF
GitHub
HairPort
HairPortは、画像内の顔に参照ヘアスタイルを転送する最先端の3D認識型フレームワークです。このツールは、大規模な…
★ 29 ⑂ 1 NOASSERTION 2026-06-12
3D / NeRF
GitHub
EAG-PT
EAG-PTは、SIGGRAPH 2026で発表された、屋内の拡散反射シーンの再構築と編集を行うための研究プロジェクトです。Emis…
★ 28 ⑂ 4 MIT 2026-07-01
ASR / 音声認識
GitHub
watch
「/watch」は、YouTube、Instagram、X(旧Twitter)など多様なオンライン動画サイトやローカルファイルから、Claude…
★ 28 ⑂ 6 MIT 2026-05-29
ComfyUI
GitHub
fxai-toolkit
ComfyUI - 鳳希全能ノードパックは、ComfyUI専用のAI長尺動画制作ソリューションです。低スペックPCでも動作するよう…
★ 28 ⑂ 7 2026-07-26
ComfyUI
GitHub
ComfyUI-LongCat-Avatar
rookiestar28/ComfyUI-LongCat-Avatarは、ComfyUI用のカスタムノード集で、LongCat Video Avatar 1.5のオーディオ駆…
★ 25 ⑂ 3 MIT 2026-06-15
3D / NeRF
GitHub
varsplat
VarSplatは、不確実性認識型の3D Gaussian Splattingを基盤とした堅牢なRGB-D SLAMシステムです。個々のスプラットの…
★ 25 MIT 2026-06-14
動画生成
GitHub
comfyui-wan-i2v-control
ComfyUI WAN I2V Controlは、WAN Image-to-Video生成において、開始画像の特定の部分を選択的に変換するためのComfyU…
★ 25 ⑂ 1 2026-06-07
画像生成
GitHub
ChaosEngineAI
ChaosEngineAIは、本格的なAI開発者や愛好家向けのローカルAIワークステーションです。オープンウェイトモデルの発見…
★ 23 ⑂ 4 Apache-2.0 2026-07-03
マルチモーダル
GitHub
ETCHR
ETCHR (Editing To Clarify and Harness Reasoning)は、質問条件に基づいて推論を意識した画像エディタです。マルチ…
★ 23 NOASSERTION 2026-05-25
音声生成 / TTS
GitHub
MaidWhisper
MaidWhisperは、GPT-SoVITSを搭載したキャラクターボイスで、Windows上の選択したテキストを読み上げるシステムレベ…
★ 23 ⑂ 1 GPL-3.0 2026-06-05