3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#GPU必須 (827 repos)

「GPU必須」タグが付いたリポジトリ

← 全リポジトリ

画像生成
GitHub
ReCo-Diff
ReCo-Diffは、スパースビューCT(低線量CT)における画像再構成のための、残差条件付き決定論的サンプリングに基づく…
★ 2 MIT 2026-06-15
画像生成
GitHub
rainfield-diffusion-models
本リポジトリは、ICML 2026で発表された「商用マイクロ波リンクと拡散モデル事前分布を用いたベイズ雨域再構築」に関…
★ 2 NOASSERTION 2026-05-21
LLM
GitHub
Auralis
Auralisは、約10億パラメータを持つハイブリッドLLM「Helix v2」(Mamba-2/GLA/Sparse-Attentionベース)を利用した…
★ 2 Apache-2.0 2026-07-11
画像生成
GitHub
sdxl_container
SDXL Containerは、SDXL (Stable Diffusion XL) のLoRAアダプターの訓練と推論を実行するためのDockerコンテナです。…
★ 2 Apache-2.0 2026-07-21
音楽生成
GitHub
anvil-audio-v2
Anvil Audioは、Stability AIの`stable-audio-tools`を拡張し、AIオーディオ生成のためのプラグイン可能なスタジオツ…
★ 2 MIT 2026-06-12
音楽生成
GitHub
ace-step-1.5-replicate
「Ace Step 1.5」は、高度な音楽生成モデル「ACE-Step-1.5」をクラウドプラットフォームReplicateで利用可能にするた…
★ 2 2026-03-05
ASR / 音声認識
GitHub
deckle
Deckleは、ローカルファーストのWindowsユーティリティで、ホットキーによる音声文字起こし、リアルタイム画面キャプ…
★ 2 MIT 2026-07-22
3D / NeRF
GitHub
maya-gaussian-splatting-viewport-plugin
本ツールは、Autodesk Maya Viewport 2.0内でリアルタイム3D Gaussian Splatting(.plyファイル)レンダリングを可能…
★ 2 MIT 2026-05-28
ComfyUI
GitHub
LoRA-Gallery-Loader—Custom-Node
「LoRA Gallery Node for ComfyUI」は、画像生成AIツールComfyUI用のカスタムノードです。このツールは、LoRA(Low-R…
★ 2 ⑂ 1 2026-04-18
ComfyUI
GitHub
gpus-python-example
このリポジトリは、Novita GPUs SDKを使用してPythonワーカーハンドラを実装する方法を示すための具体例を提供します…
★ 2 Apache-2.0 2026-05-28
画像生成
GitHub
DiffVMB-pub
本リポジトリは、拡散モデルを利用した浅層から深層への速度モデル構築に関する、学術論文の公式かつ再現可能な資料…
★ 2 ⑂ 1 2026-05-04
動画生成
GitHub
sanatation
NVIDIAのビデオワールドモデル「SANA-WM」をApple Silicon (MシリーズMac) で動作させるためのパッチとインタラクテ…
★ 2 Apache-2.0 2026-05-21
ASR / 音声認識
GitHub
YanXi-KCN
Hybrid RAGとWhisper ASRを組み合わせたスマート着信分類処理システムです。ユーザーが授業中など電話に出られない状…
★ 2 2026-05-29
音声生成 / TTS
GitHub
HiggsAudio-Studio-pinokio
本ツールは、Higgs Audio StudioのワンクリックPinokioランチャーです。100以上の言語に対応する表現力豊かな音声合…
★ 2 ⑂ 1 MIT 2026-07-07
マルチモーダル
GitHub
multimodal-music-genre-classifier
このツールは、GTZANデータセットを用いた音楽ジャンル分類のためのマルチモーダルCNNモデルを提供します。メルスペ…
★ 2 MIT 2026-05-13
マルチモーダル
GitHub
kmetbench-release
K-MetBenchは、気象学における専門家の推論、地域性、マルチモダリティを詳細に評価するための多次元ベンチマークで…
★ 2 MIT 2026-06-24
ComfyUI
GitHub
overtli-studio-suite
overtli-studio-suiteは、ComfyUIユーザー向けの強力な拡張機能で、画像、ビデオ、音声、テキスト生成といった多様な…
★ 2 MIT 2026-07-14
LLM
GitHub
SeedLM-405M
SeedLM-405Mは、限られたハードウェアを持つ個人開発者がどこまでLLM開発を達成できるかを示すための実験的な大規模…
★ 2 NOASSERTION 2026-03-05
ASR / 音声認識
GitHub
taiwan-asr-toolkit
Taiwan ASR Toolkitは、台湾華語(繁体字中国語)に特化した高精度な音声認識ツールです。Qwen3-ASRとMediaTek Breez…
★ 2 NOASSERTION 2026-05-07
マルチモーダル
GitHub
visualdocqa-kit
VisoRAGは、ローカルGPU環境で動作する、PDF、DOCX、画像ファイルの質問応答や情報抽出に特化したビジョンファースト…
★ 2 MIT 2026-08-10
ComfyUI
GitHub
ComfyUI-Selective-Sigma-Detailer
ComfyUI-Selective-Sigma-Detailerは、画像生成AI「ComfyUI」用のカスタムサンプラーです。サンプリングの途中で、画…
★ 1 ⑂ 3 MIT 2026-05-10
マルチモーダル
GitHub
vlm-from-scratch
このプロジェクトは、CLIP-ViTとQwen2.5をゼロから組み立てて開発されたミニLLaVAモデルの構築過程を記録したポート…
★ 1 MIT 2026-05-14
マルチモーダル
GitHub
obsidian-neural-central
OBSIDIAN Neuralは、音楽制作者向けのリアルタイムAI音楽生成サーバーで、OBSIDIAN Neural VSTプラグインと連携しま…
★ 1 AGPL-3.0 2026-07-14
音楽生成
GitHub
MAZ-MUSIC
MAZは、AI音楽生成のための自己ホスト型ウェブアプリケーションです。ACE-Step 1.5基盤モデルを核とし、クリーンなブ…
★ 1 ⑂ 1 MIT 2026-06-15