画像生成 HF Z-Image-Turbo
Z-Imageは、60億パラメータを持つ高効率な画像生成モデルファミリーです。特にZ-Image-Turboは、わずか8NFEsでサブ秒…
❤ 5.0k ↓ 994.3k apache-2.0 2026-01-30
画像生成 GitHub DragGAN
OpenGVLab/DragGANは、「Drag Your GAN」の非公式実装で、GAN(敵対的生成ネットワーク)で生成された画像をインタラ…
★ 5.0k ⑂ 475 2023-07-17
動画生成 GitHub echomimic_v2
EchoMimicV2は、Ant Groupが開発した、印象的で簡素化された半身の人間アニメーションを生成するための研究プロジェ…
★ 4.6k ⑂ 540 Apache-2.0 2026-02-23
3D / NeRF GitHub neuralangelo
「Neuralangelo」は、CVPR 2023で発表された高精度なニューラル表面再構成のための公式実装ツールです。既存の動画か…
★ 4.6k ⑂ 404 NOASSERTION 2024-04-14
動画生成 GitHub HunyuanVideo-1.5
HunyuanVideo-1.5は、わずか8.3Bのパラメーターでトップクラスの品質を提供する軽量な動画生成モデルです。コンシュ…
★ 4.5k ⑂ 233 NOASSERTION 2026-04-10
3D / NeRF GitHub tiny-cuda-nn
NVlabs/tiny-cuda-nnは、高速なC++/CUDAベースのニューラルネットワークフレームワークです。「完全に融合された」多…
★ 4.5k ⑂ 572 NOASSERTION 2026-04-21
ComfyUI GitHub SwarmUI
SwarmUIは、AI画像生成に特化したモジュール式のWebユーザーインターフェースで、Stable DiffusionなどのAI画像モデ…
★ 4.4k ⑂ 435 MIT 2026-07-25
マルチモーダル GitHub lmms-eval
lmms-evalは、テキスト、画像、ビデオ、オーディオといった様々なモダリティを横断する、オールインワンのマルチモー…
★ 4.4k ⑂ 641 NOASSERTION 2026-08-06
音楽生成 GitHub ace-step-ui
ACE-Step UIは、オープンソースのAI音楽生成モデル「ACE-Step 1.5」のためのプロフェッショナルなユーザーインターフ…
★ 4.3k ⑂ 662 2026-06-27
画像生成 GitHub deep-daze
Deep Dazeは、OpenAIのCLIPとSiren(Implicit neural representation network)を活用して、テキストプロンプトから…
★ 4.3k ⑂ 311 MIT 2022-03-13
動画生成 GitHub champ
Champは、3Dパラメトリックガイダンスを用いて、人間画像の制御可能かつ一貫したアニメーションを生成するツールです…
★ 4.3k ⑂ 484 MIT 2024-07-10
動画生成 GitHub Text2Video-Zero
Text2Video-Zeroは、既存のText-to-Image拡散モデルを活用し、テキストプロンプトから動画をゼロショット生成するツ…
★ 4.2k ⑂ 385 NOASSERTION 2023-05-06
動画生成 GitHub lingbot-world
LingBot-Worldは、ビデオ生成技術を基盤としたオープンソースの世界シミュレーター(ワールドモデル)です。リアルタ…
★ 4.2k ⑂ 386 Apache-2.0 2026-07-09
マルチモーダル GitHub DeepSeek-VL
DeepSeek-VLは、実世界の視覚と言語の理解を目指して開発されたオープンソースのVision-Language (VL) モデルです。…
★ 4.1k ⑂ 592 MIT 2024-04-24
画像生成 GitHub remove-ai-watermarks
「Remove-AI-Watermarks」は、Google Gemini、ChatGPT/DALL-E、Stable Diffusion、Adobe Firefly、Midjourneyなど、…
★ 4.1k ⑂ 377 Apache-2.0 2026-07-15
動画生成 GitHub ComfyUI-LTXVideo
ComfyUI-LTXVideoは、人気の画像生成Web UIであるComfyUIの機能を拡張し、LTX-2動画生成モデルを最大限に活用するた…
★ 4.0k ⑂ 462 NOASSERTION 2026-06-30
ComfyUI GitHub nunchaku
Nunchakuは、SVDQuant論文で紹介された4-bitニューラルネットワークに特化した高性能推論エンジンです。DeepCompress…
★ 3.9k ⑂ 267 Apache-2.0 2026-03-07
動画生成 GitHub VACE
VACEは、ICCV 2025で発表された論文の公式実装で、ビデオの作成と編集を目的としたオールインワンのAIモデルです。参…
★ 3.9k ⑂ 266 Apache-2.0 2025-10-17
3D / NeRF GitHub 4DGaussians
このツールは、リアルタイム動的シーンレンダリングのための「4D Gaussian Splatting」手法を実装しています。CVPR 2…
★ 3.8k ⑂ 384 Apache-2.0 2024-10-27
ComfyUI GitHub ComfyUI-3D-Pack
ComfyUI-3D-Packは、ComfyUI内で3Dアセット生成を効率的かつ便利に行うための広範なノードスイートです。このツール…
★ 3.8k ⑂ 370 MIT 2025-12-29
動画生成 GitHub FastVideo
FastVideoは、ビデオ生成を高速化するための統合された推論および後処理フレームワークです。最先端のビデオ生成モデ…
★ 3.8k ⑂ 379 Apache-2.0 2026-07-12
動画生成 GitHub MAGI-1
MAGI-1は、大規模な自己回帰型動画生成を実現する革新的なツールです。Sand AIによって開発され、学術論文(arXiv)…
★ 3.7k ⑂ 238 Apache-2.0 2026-06-17
音声生成 / TTS HF XTTS-v2
XTTS-v2は、Coquiが開発した高度な音声生成モデルです。わずか6秒の短い音声クリップを用いることで、既存の声を17種…
❤ 3.7k ↓ 10.0M other 2023-12-11
画像生成 GitHub TurboDiffusion
TurboDiffusionは、ビデオ拡散モデルによる動画生成を100〜200倍に高速化するフレームワークです。単一のRTX 5090な…
★ 3.6k ⑂ 267 Apache-2.0 2026-06-17