LLM GitHub openlake
OpenLakeは、AIインフラ向けにGPUワークロードのデータ転送を高速化する、S3ワイヤー互換の分散オブジェクトストレー…
★ 2.0k ⑂ 412 Apache-2.0 2026-07-14
音声生成 / TTS HF chatterbox
Chatterboxは、Resemble AIが開発したオープンソースの高品質なテキスト読み上げ(TTS)モデルです。23言語に対応し…
❤ 1.7k ↓ 2.7M mit 2026-06-10
LLM GitHub tokenspeed
TokenSpeedは、agentic workloadsのために設計された「光速」LLM推論エンジンです。TensorRT-LLMと同等の高性能とvLL…
★ 1.6k ⑂ 190 MIT 2026-07-13
動画生成 HF LTX-2.3
LTX-2.3は、Lightricksが公開する音声と映像を同時生成できるDiTベースのオープンウェイト基盤モデルです。画像から…
❤ 1.6k ↓ 2.2M other 2026-07-09
AIエージェント GitHub NanoResearch
エンドツーエンドの自律型AI科学研究エンジン「NanoResearch」は、研究アイデアから完全な論文作成までを自動化しま…
★ 1.5k ⑂ 104 MIT 2026-05-26
動画生成 GitHub DepthFlow
DepthFlowは、静止画像を魅力的な3Dパララックス効果のある動画に変換する高度なツールです。高品質なアニメーション…
★ 1.5k ⑂ 115 AGPL-3.0 2026-07-07
画像生成 GitHub Lance
LanceはByteDanceが開発した30億パラメータのマルチモーダルAIモデルです。単一フレームワーク内で画像および動画の…
★ 1.3k ⑂ 89 Apache-2.0 2026-07-14
動画生成 GitHub Bernini
Berniniは、MLLMベースのセマンティックプランナーとDiTベースのレンダラーを組み合わせた、ビデオ生成および編集の…
★ 1.3k ⑂ 99 Apache-2.0 2026-08-13
ComfyUI GitHub comfyui-inpaint-nodes
ComfyUI向けに高品質なインペイント機能を提供するノード集です。Fooocusインペイントモデル(SDXL対応)、LaMa、MAT…
★ 1.2k ⑂ 74 GPL-3.0 2026-05-31
ComfyUI GitHub RES4LYF
RES4LYFは、ComfyUI向けの先進的な画像生成サンプラーとユーティリティのコレクションです。独自のノイズスケーリン…
★ 1.2k ⑂ 114 NOASSERTION 2026-06-15
音声生成 / TTS HF OmniVoice
OmniVoiceは、600以上の言語に対応する多言語ゼロショットテキスト音声合成(TTS)モデルです。独自の拡散言語モデル…
❤ 1.2k ↓ 968.3k apache-2.0 2026-07-03
ComfyUI GitHub ComfyUI_VNCCS
VNCCS(Visual Novel Character Creation Suite)は、視覚ノベル用のキャラクター画像を生成するための包括的なComfy…
★ 1.2k ⑂ 68 MIT 2026-07-11
画像生成 GitHub Irodori-TTS
Irodori-TTSは、Flow Matching技術を用いたテキスト音声合成モデルで、絵文字によるスタイル制御が可能です。参照音…
★ 1.0k ⑂ 120 MIT 2026-06-04
動画生成 GitHub Causal-Forcing
「Causal Forcing」およびその改良版「Causal Forcing++」は、因果ODEや因果Consistency Distillationを活用し、高品…
★ 881 ⑂ 53 Apache-2.0 2026-07-23
LLM GitHub OPD
このツールは、大規模言語モデル(LLM)のオンポリシー蒸留(OPD)のメカニズムとダイナミクスを系統的に調査する研…
★ 800 ⑂ 54 2026-06-29
LLM GitHub can-i-finetune-this
canifinetuneは、コンシューマー向けNVIDIA GPU(12-24GB)で大規模言語モデル(LLM)のファインチューニングを検討…
★ 793 ⑂ 107 MIT 2026-07-23
動画生成 GitHub SparkVSR
SparkVSRは、インタラクティブな動画超解像(VSR)フレームワークです。ユーザーが任意の画像超解像(ISR)モデルで…
★ 688 ⑂ 71 Apache-2.0 2026-06-23
画像生成 GitHub nano-world-model
「Nano World Model」は、拡散強制(diffusion-forcing)に基づくビデオワールドモデルのトレーニングに特化した、シ…
★ 676 ⑂ 38 MIT 2026-06-15
音声生成 / TTS GitHub Confucius4-TTS
Confucius4-TTSは、LLMと音声エンコーダをベースにした、多言語・異言語対応のゼロショット音声合成エンジンです。「…
★ 668 ⑂ 66 NOASSERTION 2026-07-09
画像生成 GitHub Local-AI-Image-Generator
「Local AI Image Generator」は、Windowsユーザー向けに設計された、セットアップ不要のAI画像生成デスクトップツー…
★ 561 ⑂ 150 MIT 2026-07-03
LLM GitHub tessera
Tesseraは、大規模なLLM(教師モデル)を小型のLLM(生徒モデル)に蒸留し、その生徒モデルを効率的に提供することを…
★ 548 ⑂ 5 NOASSERTION 2026-06-05
画像生成 GitHub verl-omni
VeRL-Omniは、拡散モデルやオムニモダリティモデルといったマルチモーダル生成モデルに特化した強化学習(RL)トレー…
★ 533 ⑂ 75 Apache-2.0 2026-07-10
画像生成 GitHub Bonsai-Image-Demo
Bonsai Image Demoは、Apple Silicon (macOS) またはNVIDIA GPU (Linux/Windows) を利用して、ローカルで画像を生成…
★ 514 ⑂ 72 Apache-2.0 2026-06-14
ComfyUI GitHub ComfyUI-OmniVoice-TTS
ComfyUI-OmniVoice-TTSは、画像生成AIのComfyUI向けに開発された、ゼロショット多言語テキスト読み上げ(TTS)ノード…
★ 505 ⑂ 64 Apache-2.0 2026-06-11