ComfyUI GitHub ComfyUI-DynamiCrafterWrapper
このリポジトリは、ComfyUIで画像から動画を生成する「DynamiCrafter」および「ToonCrafter」モデルを利用するための…
★ 681 ⑂ 34 NOASSERTION 2025-06-02
画像生成 GitHub nano-world-model
「Nano World Model」は、拡散強制(diffusion-forcing)に基づくビデオワールドモデルのトレーニングに特化した、シ…
★ 676 ⑂ 38 MIT 2026-06-15
音声生成 / TTS GitHub Confucius4-TTS
Confucius4-TTSは、LLMと音声エンコーダをベースにした、多言語・異言語対応のゼロショット音声合成エンジンです。「…
★ 668 ⑂ 66 NOASSERTION 2026-07-09
動画生成 HF text-to-video-ms-1.7b
本モデルは、テキストの記述に基づいて動画を生成するマルチステージのテキストから動画生成拡散モデルです。約17億…
❤ 666 ↓ 111.2k cc-by-nc-4.0 2023-12-01
マルチモーダル HF BiRefNet
BiRefNetは、高解像度画像向けの二値画像セグメンテーションモデルの公式実装です。背景除去やマスク生成を主用途と…
❤ 605 ↓ 829.6k mit 2026-02-04
ComfyUI GitHub ComfyUI-IDM-VTON
ComfyUI-IDM-VTONは、IDM-VTONのComfyUI向け適応版で、画像を用いたバーチャル試着を実現するツールです。ComfyUI環…
★ 589 ⑂ 68 GPL-3.0 2024-08-20
ComfyUI GitHub ComfyUI-VibeVoice
ComfyUI-VibeVoiceは、MicrosoftのVibeVoiceをComfyUIに統合するカスタムノードです。表現力豊かで長尺なマルチスピ…
★ 588 ⑂ 108 MIT 2025-09-25
ComfyUI GitHub ComfyUI-Kolors-MZ
ComfyUI上でKwai-Kolorsモデルを利用可能にするためのカスタムノードとワークフローを提供するツールです。ComfyUIの…
★ 582 ⑂ 37 GPL-3.0 2025-03-31
ComfyUI GitHub ComfyUI-Marigold
ComfyUI-Marigoldは、画像から深度マップを推定するMarigoldモデルのComfyUI向けラッパーノードです。このツールは、…
★ 572 ⑂ 25 GPL-3.0 2025-05-16
画像生成 GitHub Local-AI-Image-Generator
「Local AI Image Generator」は、Windowsユーザー向けに設計された、セットアップ不要のAI画像生成デスクトップツー…
★ 561 ⑂ 150 MIT 2026-07-03
ComfyUI GitHub ComfyUI-AnimateAnyone-Evolved
本ツールは、AnimateAnyoneの実装を改良し、ポーズ画像シーケンスと参照画像を基にスタイライズされた動画を生成しま…
★ 561 ⑂ 50 MIT 2024-06-14
LLM GitHub tessera
Tesseraは、大規模なLLM(教師モデル)を小型のLLM(生徒モデル)に蒸留し、その生徒モデルを効率的に提供することを…
★ 548 ⑂ 5 NOASSERTION 2026-06-05
画像生成 GitHub verl-omni
VeRL-Omniは、拡散モデルやオムニモダリティモデルといったマルチモーダル生成モデルに特化した強化学習(RL)トレー…
★ 533 ⑂ 75 Apache-2.0 2026-07-10
画像生成 GitHub Bonsai-Image-Demo
Bonsai Image Demoは、Apple Silicon (macOS) またはNVIDIA GPU (Linux/Windows) を利用して、ローカルで画像を生成…
★ 514 ⑂ 72 Apache-2.0 2026-06-14
マルチモーダル HF Voxtral-Small-24B-2507
Voxtral Small 1.0(24B)は、Mistral Small 3系をベースに音声入力機能を強化した大規模音声理解モデルです。音声の…
❤ 508 ↓ 198.5k apache-2.0 2025-12-20
3D / NeRF GitHub Scal3R
Scal3Rは、CVPR 2026のHighlight論文として発表された、大規模な3D再構築のためのスケーラブルなテスト時学習手法で…
★ 507 ⑂ 38 NOASSERTION 2026-05-11
ComfyUI GitHub ComfyUI-OmniVoice-TTS
ComfyUI-OmniVoice-TTSは、画像生成AIのComfyUI向けに開発された、ゼロショット多言語テキスト読み上げ(TTS)ノード…
★ 505 ⑂ 64 Apache-2.0 2026-06-11
動画生成 HF LTX-2.3-GGUF
unsloth/LTX-2.3-GGUFは、LightricksのLTX-2.3をGGUF量子化し、ComfyUI上でローカル実行しやすくした音声付き動画生…
❤ 504 ↓ 313.8k other 2026-04-20
動画生成 GitHub Google-Colab_Notebooks
このリポジトリは、様々なAIプロジェクトのためのGoogle Colabノートブック集です。特に、ビジュアルプログラミング…
★ 491 ⑂ 168 2026-06-20
動画生成 HF LTX2.3-10Eros
10 Erosは、LTX系のimage-to-video向けに調整されたモデル/チェックポイントで、ComfyUIワークフローや専用ノードと…
❤ 480 ↓ 301.5k 2026-07-08
画像生成 HF Z-Anime
Z-Animeは、AlibabaのZ-Image Baseを土台にしたアニメ画像生成向けのフルファインチューニングモデル群です。LoRAマ…
❤ 474 ↓ 3.6k apache-2.0 2026-04-27
画像生成 GitHub PixelSmile
PixelSmileは、顔の表情を連続的に制御しながら、微調整された編集を可能にするツールです。既存の顔の同一性を強く…
★ 474 ⑂ 22 Apache-2.0 2026-04-22
LLM GitHub orthrus
Orthrusは、大規模言語モデル(LLM)の推論を高速化するためのデュアルアーキテクチャフレームワークです。自己回帰…
★ 459 ⑂ 20 MIT 2026-05-18
動画生成 GitHub OmniShow
OmniShowは、ByteDanceが開発した人間とオブジェクトのインタラクションビデオ生成(HOIVG)のための統合モデルです…
★ 454 ⑂ 25 Apache-2.0 2026-05-19