3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#GPU必須 (827 repos)
「GPU必須」タグが付いたリポジトリ
← 全リポジトリ
画像生成 GitHub DisPOSE
この「DisPOSE」は、自己教師ありマルチビュー3D人体ポーズ推定のための実装です。離散的なクロスビュー人物割り当て…
★ 9 ⑂ 1 MIT 2026-07-03
動画生成 GitHub KIVI
KIVIは、テキストから動画を生成するAIモデルの評価に特化したツールです。従来の「動画の見栄え」ではなく、「動画…
★ 9 MIT 2026-06-05
3D / NeRF GitHub SEAR
SEARは、RGB画像と熱画像を組み合わせてカメラのポーズを推定する3D再構築プロジェクトです。Visual Geometric Trans…
★ 9 ⑂ 1 NOASSERTION 2026-06-30
画像生成 GitHub dbmsolver
DBMSolverは、高品質な画像間変換(Image-to-Image Translation)を実現するための、トレーニング不要な拡散ブリッジ…
★ 8 2026-06-30
音楽生成 GitHub aeon-music-maker
aeon-music-makerは、AEON Media Productionファミリーの一部であるスタンドアロンの音楽生成ツールです。ACE Step 1…
★ 8 ⑂ 3 MIT 2026-06-28
画像生成 GitHub CVQ
このリポジトリは、革新的な画像トークン化手法「Channel-wise Vector Quantization (CVQ)」とその応用である「Chann…
★ 8 MIT 2026-06-01
画像生成 GitHub Prox-E
Prox-Eは、SIGGRAPH 2026に採択された、3D形状の精密な編集を可能にするトレーニング不要なフレームワークです。プリ…
★ 8 ⑂ 2 MIT 2026-07-02
画像生成 GitHub ScribeNEO
ScribeNEOは、Stable Diffusion Forge Neo専用に開発されたプロンプトエンジニアリング拡張機能です。AIを活用し、ユ…
★ 8 MIT 2026-05-29
画像生成 GitHub ltx2-vidgen-skill
この「ltx2-vidgen-skill」は、AIビデオ生成パイプラインを自社で所有・運用できるClaude Codeスキルです。写真一枚…
★ 8 ⑂ 1 NOASSERTION 2026-06-11
画像生成 GitHub lora-block-weight-neo
このツールは、Stable Diffusion WebUI Forge - Neo向けの拡張機能であり、LoRAのブロックレベルでの重み付けを詳細…
★ 8 MIT 2026-05-22
LLM GitHub Plasmod
Plasmodは、マルチエージェントシステム向けに設計されたエージェントネイティブデータベースです。粘菌ネットワーク…
★ 8 MIT 2026-07-14
マルチモーダル GitHub CaptionEvalKit-for-VLMs
CaptionEvalKit-for-VLMsは、VLM(Visual Language Model)向け画像キャプション評価を再現性高く、オールインワンで…
★ 8 BSD-3-Clause-Clear 2026-06-22
画像生成 GitHub kimodo-houdini-bridge
このツールは、NVIDIA Kimodo(テキスト駆動の3D人体モーション生成AIモデル)をSideFX Houdiniに連携させるブリッジ…
★ 8 ⑂ 2 2026-06-10
画像生成 GitHub comfyui-lance-aio
ComfyUI Lance AIOは、ByteDance Lance-3BモデルをComfyUIで実行するためのカスタムノードを提供するリポジトリです…
★ 7 ⑂ 3 MIT 2026-06-08
画像生成 GitHub M2GenCO
M²GenCOは、拡散ベースのニューラル組み合わせ最適化のためのマルチタスクメタ学習フレームワークです。ICML 2026で…
★ 7 2026-07-02
LLM GitHub kimari-local-ai
Kimariは、NVIDIA製消費者向けGPU(特にGTX 1060/1080などの古いモデル)で強力な大規模言語モデル(LLM)をローカル…
★ 7 ⑂ 1 MIT 2026-05-26
ComfyUI GitHub WavTTS-ComfyUI
WavTTS-ComfyUIは、人気のある画像生成UI「ComfyUI」に統合されたWavTTSモデルのノードセットです。参照音声とテキス…
★ 7 ⑂ 1 MIT 2026-06-04
3D / NeRF GitHub 4dgs-human-avatar-comfyui-nodes-dataset
このリポジトリは、ComfyUI向けの究極の4DGS(4D Gaussian Splatting)モジュール「Shramko-Volumetric-Bridge」と、…
★ 7 Apache-2.0 2026-07-12
ComfyUI GitHub MisoTTS-ComfyUI
MisoTTS-ComfyUIは、ComfyUI向けのテキスト読み上げ(TTS)ノードです。Miso TTS 8BモデルとMimiオーディオトークン…
★ 7 ⑂ 3 MIT 2026-06-04
3D / NeRF GitHub splattie
Splattieは、1枚の静止画像からインタラクティブなリグ付き3D Gaussian Splattingアセット(頭部、全身、オブジェク…
★ 7 MIT 2026-08-17
音声生成 / TTS GitHub Leva-TTS
Leva-TTSは、リアルタイム会話エージェント向けに最適化された、プロダクション志向のレバント・アラビア語と英語の…
★ 7 ⑂ 1 Apache-2.0 2026-06-02
音声生成 / TTS GitHub the-muser
The Muserは、SunoやElevenLabs Musicのオープンソース代替として、自然言語による音楽作曲を可能にするツールです。…
★ 6 ⑂ 1 MIT 2026-05-27
音声生成 / TTS GitHub Supertonic_3_TTS_App
「Supertonic 3 TTS App」は、Supertone Supertonic 3エンジンを搭載した、Windows向けのオンデバイス・ニューラルテ…
★ 6 MIT 2026-05-31
画像生成 GitHub spade
SPADEは、オフラインブラックボックス最適化において、サポートされていない領域での予測の過信を防ぐためのツールで…
★ 6 MIT 2026-06-09