3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Hugging Face (79 repos)
「Hugging Face」タグが付いたリポジトリ
← 全リポジトリ
AIエージェント GitHub agents-course
Hugging Face Agents Courseは、AIエージェントの基礎から応用までを網羅した包括的な学習コースです。大規模言語モ…
★ 30.0k ⑂ 2.1k Apache-2.0 2026-06-30
マルチモーダル GitHub minimind-v
MiniMind-Vは、わずか3ドルと2時間で65MパラメータのビジョンマルチモーダルVLMをゼロから訓練できるプロジェクトで…
★ 8.3k ⑂ 916 Apache-2.0 2026-06-28
3D / NeRF GitHub map-anything
MapAnythingは、画像、キャリブレーション、ポーズ、深度などの多様な入力から、統一されたフィードフォワードのトラ…
★ 3.5k ⑂ 272 Apache-2.0 2026-06-03
動画生成 GitHub Causal-Forcing
「Causal Forcing」およびその改良版「Causal Forcing++」は、因果ODEや因果Consistency Distillationを活用し、高品…
★ 881 ⑂ 53 Apache-2.0 2026-07-23
LLM GitHub can-i-finetune-this
canifinetuneは、コンシューマー向けNVIDIA GPU(12-24GB)で大規模言語モデル(LLM)のファインチューニングを検討…
★ 793 ⑂ 107 MIT 2026-07-23
画像生成 GitHub nano-world-model
「Nano World Model」は、拡散強制(diffusion-forcing)に基づくビデオワールドモデルのトレーニングに特化した、シ…
★ 676 ⑂ 38 MIT 2026-06-15
3D / NeRF GitHub OmniVGGT-official
OmniVGGTは、空間認識のための最先端の基盤モデルです。本ツールは、深度、カメラ内部パラメータ、ポーズといった任…
★ 365 ⑂ 31 MIT 2026-05-21
マルチモーダル GitHub count-anything
Count Anythingは、テキストクエリに基づいて画像内のあらゆるオブジェクトを数えることができる汎用モデルです。自…
★ 233 ⑂ 16 Apache-2.0 2026-07-20
画像生成 GitHub WaDi
WaDiは、CVPR 2026で発表された、ワンステップ画像生成のための公式PyTorch実装です。Weight Direction-aware Distil…
★ 185 ⑂ 24 2026-05-26
LLM GitHub Thinking-with-Visual-Primitives-pytorch
このツールは、DeepSeekの「Thinking with Visual Primitives」を非公式にPyTorchで再現したものです。マルチモーダ…
★ 149 ⑂ 19 MIT 2026-06-25
音声生成 / TTS GitHub VTS
VTS(Voice To Sound)は、ユーザーの音声スケッチとテキストプロンプトを組み合わせて効果音を生成するツールです。…
★ 143 ⑂ 6 MIT 2026-06-18
AIエージェント GitHub AgentFigureGallery
AgentFigureGalleryは、Claude Code、Codex、Cursorなどのコーディングエージェント向けの科学プロットリファレンス…
★ 133 ⑂ 1 MIT 2026-05-29
LLM GitHub delegate52
DELEGATE-52は、大規模言語モデル(LLM)が様々な専門ドメインの文書編集タスクを長期にわたって委任された際の性能…
★ 115 ⑂ 9 MIT 2026-06-12
3D / NeRF GitHub NAS3R
NAS3Rは、新規ビュー合成を介して自己教師あり3D再構築を行うためのフィードフォワードフレームワークです。このツー…
★ 114 ⑂ 8 MIT 2026-06-30
3D / NeRF GitHub SpatialBench
SpatialBenchは、マルチモーダル大規模言語モデル(MLLM)のビデオ空間理解能力を評価するオープンソースベンチマー…
★ 113 2026-05-28
画像生成 GitHub ReactiveGWM
ReactiveGWMは、プレイヤー操作とNPCの自律性を分離することで、ゲーム内のNPCをより動的に制御する新しいゲーム世界…
★ 91 ⑂ 11 2026-06-16
音声生成 / TTS GitHub Higgs_v3-TTS-ComfyUI
このツールは、ComfyUI用のノード集であり、bosonai/higgs-audio-v3-tts-4bモデルを活用して、多言語(100言語対応)…
★ 61 ⑂ 11 MIT 2026-06-20
3D / NeRF GitHub EcoSplat
EcoSplatは、効率制御可能なフィードフォワード3D Gaussian Splatting技術を実装したツールです。マルチビュー画像か…
★ 56 ⑂ 2 MIT 2026-06-11
画像生成 GitHub gpic
GPIC(Giant Permissive Image Corpus)は、視覚生成モデリング研究のための巨大で許容性の高い画像コーパスです。約…
★ 50 ⑂ 2 MIT 2026-06-04
画像生成 GitHub RvR
RvR (Refinement via Regeneration) は、清華大学とTencent Hunyuanが開発した、画像リファインメントのための革新的…
★ 50 ⑂ 1 MIT 2026-05-26
マルチモーダル GitHub OmniAgent
OmniAgentは、動画コンテンツを効率的に理解するための革新的なオムニモーダルAIエージェントです。従来のモデルとは…
★ 43 ⑂ 5 Apache-2.0 2026-07-03
LLM GitHub TimeOmni-1
TimeOmni-1は、ICLR 2026に採択された研究に基づく、大規模言語モデルが時系列データを用いた複雑な推論を行うことを…
★ 36 ⑂ 3 Apache-2.0 2026-06-12
音声生成 / TTS GitHub wavlm-vocoder-french
本ツールは、WavLM表現から高品質なフランス語音声を再構築するニューラルボコーダーです。JEP 2026に採択された論文…
★ 31 MIT 2026-06-30
ComfyUI GitHub ComfyUI-TranslateGemma
このツールは、Googleのオープンソース翻訳モデル「TranslateGemma」をComfyUIに統合するノードです。Gemma 3をベー…
★ 29 ⑂ 3 MIT 2026-06-13