3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Hugging Face対応 (30 repos)
「Hugging Face対応」タグが付いたリポジトリ
← 全リポジトリ
LLM GitHub vllm
vLLMは、大規模言語モデル (LLM) の高速かつ効率的な推論とサービングを可能にするPythonライブラリです。最先端のス…
★ 86.2k ⑂ 19.4k Apache-2.0 2026-07-14
動画生成 GitHub MiniMax-MCP
MiniMax-AIの公式Model Context Protocol (MCP) サーバーであり、強力なテキスト読み上げ、画像生成、ビデオ生成のAP…
★ 1.6k ⑂ 273 MIT 2026-05-21
音楽生成 GitHub MidiTok
MidiTokは、MIDIやabcといった音楽ファイルをディープラーニングモデル(Transformerなど)が扱えるトークンシーケン…
★ 884 ⑂ 102 MIT 2026-07-20
音声生成 / TTS GitHub Confucius4-TTS
Confucius4-TTSは、LLMと音声エンコーダをベースにした、多言語・異言語対応のゼロショット音声合成エンジンです。「…
★ 668 ⑂ 66 NOASSERTION 2026-07-09
3D / NeRF GitHub vgg-ttt
VGG-T³は、大規模な画像コレクションからオフラインで高速な3D再構築を可能にするツールです。CVPR'26で発表された論…
★ 178 ⑂ 18 NOASSERTION 2026-05-25
動画生成 GitHub LiveWorld
LiveWorldは、生成型ビデオワールドモデルにおいて、視界外のダイナミクスをシミュレートする画期的なフレームワーク…
★ 127 ⑂ 3 Apache-2.0 2026-06-23
動画生成 GitHub Echo-Memory
Echo-Memoryは、Joy Future AcademyのEcho Teamが開発した、ビデオワールドモデルにおけるメモリの役割を研究するた…
★ 123 ⑂ 7 2026-07-11
LLM GitHub granite-switch
「Granite Switch」は、IBM Researchが開発したオープンソースプロジェクトで、複数のファインチューニングされたLoR…
★ 84 ⑂ 9 Apache-2.0 2026-07-09
マルチモーダル HF MOSS-Audio-8B-Thinking
MOSS-Audio-8B-Thinkingは、音声・環境音・音楽を横断的に理解できるオープンソースの音声理解モデルです。文字起こ…
❤ 78 ↓ 27.2k apache-2.0 2026-06-11
画像生成 GitHub W-Flow
W-Flowは、「Wasserstein Gradient Flowsを介したワンステップ生成モデリング」の公式PyTorchコードベースです。この…
★ 69 ⑂ 5 MIT 2026-06-09
3D / NeRF GitHub wanderland
Wanderlandは、オープンワールドの具現化されたAI向けに、幾何学的に根拠のあるシミュレーションを提供する包括的な…
★ 61 ⑂ 2 Apache-2.0 2026-07-13
画像生成 GitHub LeapAlign_Code
LeapAlignは、フローマッチングモデルを人間の好みに合わせて微調整するための学習後手法です。完全なサンプリング軌…
★ 54 ⑂ 1 Apache-2.0 2026-06-13
動画生成 GitHub Helios-Page
Heliosは、リアルタイムで長尺の動画を生成する革新的なモデルです。140億パラメータという大規模モデルでありながら…
★ 22 ⑂ 2 2026-05-30
音声生成 / TTS GitHub lora-cosyvoice123-chanting
このリポジトリは、中国語の古詩詞吟誦に特化したCosyVoice 1/2/3 LoRA微調整実験フレームワークです。CosyVoiceの三…
★ 8 2026-06-18
マルチモーダル GitHub CodeBind
CodeBindは、大規模言語モデルやロボット工学におけるマルチモーダル表現アライメントの課題を解決するために開発さ…
★ 7 ⑂ 1 MIT 2026-05-19