3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#GPU必須 (827 repos)
「GPU必須」タグが付いたリポジトリ
← 全リポジトリ
ComfyUI GitHub Dots-TTS-ComfyUI
このツールは、ComfyUI向けのカスタムノードコレクションであり、Dots TTSによる高品質なテキスト音声合成、音声クロ…
★ 34 ⑂ 4 Apache-2.0 2026-06-11
マルチモーダル GitHub Uni-ViGU
Uni-ViGUは、拡散モデルを基盤としたビデオジェネレータを通じて、ビデオの生成と理解を統一する革新的なフレームワ…
★ 33 ⑂ 1 Apache-2.0 2026-04-15
音声生成 / TTS GitHub xRIR_code
xRIRは、CVPR 2025で発表された論文「Hearing Anywhere in Any Environment」をPyTorchで実装したもので、部屋を跨ぐ…
★ 33 ⑂ 1 NOASSERTION 2025-09-18
動画生成 GitHub seedance-api
Seedance 2.0 APIは、ByteDanceが開発したAI動画生成エンジンへの非公式アクセスを提供するツールです。このAPIは、…
★ 33 ⑂ 5 2026-06-24
ComfyUI GitHub ComfyUI-Hunyuan-Image-3
ComfyUI上でTencentのHunyuan Image 3.0を使った基本的な画像生成を行うためのカスタムノードです。テキストプロンプ…
★ 33 ⑂ 6 MIT 2025-10-15
LLM GitHub Prism
PRISMは、マルチモーダル大規模言語モデル(特にLLaVA)の継続的学習設定における命令チューニングのためのPyTorchベ…
★ 33 ⑂ 6 MIT 2026-06-15
ASR / 音声認識 GitHub FastWord
FastWordは、macOSユーザー向けのプライベートでローカルなプッシュトゥトーク音声入力アプリケーションです。ホット…
★ 32 ⑂ 3 2026-05-23
ComfyUI GitHub ComfyUI-Win-Blackwell
「ComfyUI for GeForce RTX 50-Series (Blackwell)」は、NVIDIA GeForce RTX 50シリーズ(Blackwellアーキテクチャ)…
★ 31 ⑂ 2 MIT 2026-03-02
音声生成 / TTS GitHub wavlm-vocoder-french
本ツールは、WavLM表現から高品質なフランス語音声を再構築するニューラルボコーダーです。JEP 2026に採択された論文…
★ 31 MIT 2026-06-30
画像生成 GitHub mold
moldは、ローカルGPUを活用して画像や短いビデオクリップを生成する強力なCLIツールです。クラウドやPython環境を必…
★ 30 MIT 2026-07-12
音声生成 / TTS GitHub mlx-speech
mlx-speechは、Apple Silicon Mac(M1以降)向けに特化した、純粋なMLXベースの音声技術ツールキットです。クラウド…
★ 30 ⑂ 7 MIT 2026-06-24
3D / NeRF GitHub HairPort
HairPortは、画像内の顔に参照ヘアスタイルを転送する最先端の3D認識型フレームワークです。このツールは、大規模な…
★ 29 ⑂ 1 NOASSERTION 2026-06-12
3D / NeRF GitHub iMaC
このツールは、iMaC(Embodied World Models向けにアクションをモーションとコンタクトイメージに変換するモデル)と…
★ 29 2026-06-21
画像生成 GitHub ComfyUI-HiresFix-Ultra-AllInOne
ComfyUI Hires Fix Ultra - All in Oneは、ComfyUI向けの高性能なHires Fixソリューションです。潜在空間/モデルアッ…
★ 29 ⑂ 2 MIT 2026-04-06
画像生成 GitHub comfyui-ReferenceLatentPlus
このツールはComfyUIの標準`ReferenceLatent`ノードを強化したドロップイン代替品です。画像ごとに参照強度、タイム…
★ 29 ⑂ 4 2026-06-07
3D / NeRF GitHub QuestRoomScan
QuestRoomScanは、Meta Quest 3向けのリアルタイム3Dルーム再構築ツールです。GPU TSDFとSurface Netsメッシュ抽出を…
★ 29 ⑂ 3 NOASSERTION 2026-04-20
マルチモーダル GitHub weld-anomaly-classifier
WeldFusionNetは、センサー、オーディオ、ビデオデータといった多様な情報を統合するマルチモーダル深層学習モデルを…
★ 28 ⑂ 1 MIT 2026-03-06
3D / NeRF GitHub EAG-PT
EAG-PTは、SIGGRAPH 2026で発表された、屋内の拡散反射シーンの再構築と編集を行うための研究プロジェクトです。Emis…
★ 28 ⑂ 4 MIT 2026-07-01
マルチモーダル GitHub SSM
このリポジリは、顔の動作単位(AU)と顔の表情(FE)の双方向学習を可能にするStructured Semantic Mapping(SSM)…
★ 28 2026-04-17
ComfyUI GitHub fxai-toolkit
ComfyUI - 鳳希全能ノードパックは、ComfyUI専用のAI長尺動画制作ソリューションです。低スペックPCでも動作するよう…
★ 28 ⑂ 7 2026-07-26
ASR / 音声認識 GitHub watch
「/watch」は、YouTube、Instagram、X(旧Twitter)など多様なオンライン動画サイトやローカルファイルから、Claude…
★ 28 ⑂ 6 MIT 2026-05-29
マルチモーダル GitHub SR-3D
SR-3Dは、ICLR'26で発表された「3D Aware Region Prompted Vision Language Model」の実装です。単一視点と多視点入…
★ 27 Apache-2.0 2026-02-19
3D / NeRF GitHub UniVerse
UniVerseは、ICCV 2025で発表された「動画拡散モデルのシーン事前分布を活用したロバストなラディアンスフィールド再…
★ 27 2025-10-03
音声生成 / TTS GitHub silma-tts
SILMA Arabic TTS v1は、SILMA AIによって開発された軽量かつ高性能なバイリンガル(アラビア語と英語)テキスト音声…
★ 26 ⑂ 6 MIT 2026-05-07