3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

画像生成
GitHub
comfyui-ReferenceLatentPlus
このツールはComfyUIの標準`ReferenceLatent`ノードを強化したドロップイン代替品です。画像ごとに参照強度、タイム…
★ 29 ⑂ 4 2026-06-07
3D / NeRF
GitHub
HairPort
HairPortは、画像内の顔に参照ヘアスタイルを転送する最先端の3D認識型フレームワークです。このツールは、大規模な…
★ 29 ⑂ 1 NOASSERTION 2026-06-12
ASR / 音声認識
GitHub
watch
「/watch」は、YouTube、Instagram、X(旧Twitter)など多様なオンライン動画サイトやローカルファイルから、Claude…
★ 28 ⑂ 6 MIT 2026-05-29
3D / NeRF
GitHub
EAG-PT
EAG-PTは、SIGGRAPH 2026で発表された、屋内の拡散反射シーンの再構築と編集を行うための研究プロジェクトです。Emis…
★ 28 ⑂ 4 MIT 2026-07-01
ComfyUI
GitHub
fxai-toolkit
ComfyUI - 鳳希全能ノードパックは、ComfyUI専用のAI長尺動画制作ソリューションです。低スペックPCでも動作するよう…
★ 28 ⑂ 7 2026-07-26
3D / NeRF
GitHub
varsplat
VarSplatは、不確実性認識型の3D Gaussian Splattingを基盤とした堅牢なRGB-D SLAMシステムです。個々のスプラットの…
★ 25 MIT 2026-06-14
動画生成
GitHub
comfyui-wan-i2v-control
ComfyUI WAN I2V Controlは、WAN Image-to-Video生成において、開始画像の特定の部分を選択的に変換するためのComfyU…
★ 25 ⑂ 1 2026-06-07
ComfyUI
GitHub
ComfyUI-LongCat-Avatar
rookiestar28/ComfyUI-LongCat-Avatarは、ComfyUI用のカスタムノード集で、LongCat Video Avatar 1.5のオーディオ駆…
★ 25 ⑂ 3 MIT 2026-06-15
画像生成
GitHub
ChaosEngineAI
ChaosEngineAIは、本格的なAI開発者や愛好家向けのローカルAIワークステーションです。オープンウェイトモデルの発見…
★ 23 ⑂ 4 Apache-2.0 2026-07-03
音声生成 / TTS
GitHub
MaidWhisper
MaidWhisperは、GPT-SoVITSを搭載したキャラクターボイスで、Windows上の選択したテキストを読み上げるシステムレベ…
★ 23 ⑂ 1 GPL-3.0 2026-06-05
マルチモーダル
GitHub
ETCHR
ETCHR (Editing To Clarify and Harness Reasoning)は、質問条件に基づいて推論を意識した画像エディタです。マルチ…
★ 23 NOASSERTION 2026-05-25
3D / NeRF
GitHub
MVCHead
MVCHeadは、CVPR 2026で発表された、高忠実度かつマルチビュー一貫性のある3D Gaussianヘッドアバターを生成するAIモ…
★ 22 ⑂ 1 NOASSERTION 2026-06-01
動画生成
GitHub
Helios-Page
Heliosは、リアルタイムで長尺の動画を生成する革新的なモデルです。140億パラメータという大規模モデルでありながら…
★ 22 ⑂ 2 2026-05-30
3D / NeRF
GitHub
SLARM
SLARMは、動的なシーンの再構築、セマンティックな理解、リアルタイムストリーミング推論を統合するフィードフォワー…
★ 22 MIT 2026-06-09
音声生成 / TTS
GitHub
Timbre
Timbreは、複数の話者が混在する音声録音(ポッドキャスト、インタビュー、ストリームなど)から、短い参照クリップ…
★ 21 ⑂ 2 Apache-2.0 2026-06-14
マルチモーダル
GitHub
paddleocr-pdf-api
このツールは、PDFをOCR処理し、結果をMarkdown形式で返す自己ホスト型APIです。PaddleOCRとPaddleOCR-VLモデルを搭…
★ 20 ⑂ 6 2026-07-12
ComfyUI
GitHub
ComfyUI-TensorRT-Reforge
「ComfyUI-TensorRT-Reforge」は、ComfyUI向けに最適化された超高速TensorRTエンジンエクスポート・ロードツールです…
★ 20 ⑂ 2 MIT 2026-06-30
動画生成
GitHub
AVGen-Bench
AVGen-Benchは、Text-to-Audio-Video (T2AV) 生成の多段階評価を目的としたタスク駆動型ベンチマークツールです。既…
★ 20 MIT 2026-07-02
ComfyUI
GitHub
ComfyUI-vslinx-nodes
vslinx/ComfyUI-vslinx-nodesは、ComfyUIのワークフローを効率化・高速化するためのカスタムノード集です。複数画像…
★ 19 ⑂ 3 GPL-3.0 2026-06-30
画像生成
GitHub
PHOBOS
PHOBOSは、クラウドに依存せず、ユーザーのハードウェア上で完全に動作する自己主権型クリエイティブAIオペレーティ…
★ 19 ⑂ 1 NOASSERTION 2026-06-11
画像生成
GitHub
av-pedestrian-diffusion-mppi
このツールは、UIUC Polaris GEM e4向けの歩行者認識自律走行スタック「ADAPT」です。拡散ベースの歩行者軌道予測器…
★ 19 ⑂ 3 MIT 2026-06-09
LLM
GitHub
ChipMATE
ChipMATEは、RTLコード生成のためのマルチエージェント推論フレームワークです。Verilog生成エージェントとPython参…
★ 19 ⑂ 2 NOASSERTION 2026-05-29
LLM
GitHub
Video_Dariy
Video Diaryは、家庭用監視カメラの録画映像をAIで自動分析し、効率的な管理を可能にするシステムです。NASやディレ…
★ 19 ⑂ 1 Apache-2.0 2026-06-14
音声生成 / TTS
GitHub
ZastTranslate
ZastTranslateは、動画の翻訳とAI音声クローンによる吹き替えを100%ローカルで実行するツールです。APIキー不要で、…
★ 19 ⑂ 2 2026-06-08