3D / NeRF GitHub scenetok
SceneTokは、3Dシーンデータを圧縮された、非構造化かつ拡散可能な1Dトークン表現へと変換するシーンオートエンコー…
★ 203 ⑂ 9 MIT 2026-06-15
動画生成 GitHub Pilipili-AutoVideo
Pilipili-AutoVideoは、一文の指示から字幕付きのAIビデオを全自動で生成する、ローカルデプロイ可能なツールです。…
★ 190 ⑂ 27 2026-03-25
3D / NeRF GitHub 3dgeer
3DGEERは、3D Gaussian Splatting (3DGS)における投射幾何学の不正確性という根本的な問題を解決するために開発され…
★ 189 ⑂ 26 AGPL-3.0 2026-07-02
ComfyUI GitHub ComfyUI-ADMotionDirector
ComfyUI-ADMotionDirectorは、ComfyUIのカスタムノードとして機能し、AnimateDiff-MotionDirectorを利用してモーショ…
★ 188 ⑂ 14 Apache-2.0 2024-11-07
マルチモーダル GitHub ScreenMind
ScreenMindは、PCの画面活動をAIでキャプチャ、分析し、検索可能なプライベートAIメモリを構築するツールです。Gemma…
★ 188 ⑂ 12 MIT 2026-07-13
音声生成 / TTS GitHub Artemis
「Shiki Natsume」は、四季夏目をキャラクターとする、完全オフライン動作のAIガールフレンドプロジェクトです。Open…
★ 188 ⑂ 11 NOASSERTION 2026-07-05
音楽生成 GitHub portable-hermes-agent
Portable Hermes Agentは、Windows向けのポータブルAIエージェントデスクトップアプリケーションです。インストール…
★ 187 ⑂ 37 MIT 2026-07-13
3D / NeRF GitHub WorldStereo
「WorldStereo」は、カメラ制御ビデオ生成と3Dシーン再構築を融合する革新的なフレームワークです。Global-Geometric…
★ 186 ⑂ 8 Apache-2.0 2026-04-24
ComfyUI GitHub ComfyUI-piFlow
ComfyUI-piFlowは、ComfyUI上でpi-Flow方式の少ないステップ数による高速画像生成を行うためのカスタムノード集です…
★ 186 ⑂ 10 Apache-2.0 2026-05-23
画像生成 GitHub WaDi
WaDiは、CVPR 2026で発表された、ワンステップ画像生成のための公式PyTorch実装です。Weight Direction-aware Distil…
★ 185 ⑂ 24 2026-05-26
ComfyUI GitHub Pixal3D-ComfyUI
Pixal3D-ComfyUIは、単一の画像から高品質な3Dモデルを生成するためのComfyUI用カスタムノードです。TencentARCのPix…
★ 180 ⑂ 20 MIT 2026-06-12
3D / NeRF GitHub vgg-ttt
VGG-T³は、大規模な画像コレクションからオフラインで高速な3D再構築を可能にするツールです。CVPR'26で発表された論…
★ 178 ⑂ 18 NOASSERTION 2026-05-25
ComfyUI GitHub ComfyUI-InstanceDiffusion
このツールは、画像生成AI「ComfyUI」向けにInstanceDiffusionを統合するノードセットです。複数のオブジェクトを詳…
★ 176 ⑂ 13 Apache-2.0 2024-08-30
3D / NeRF GitHub MotionCrafter
MotionCrafterは、単一のモノクロビデオ入力から密な4Dジオメトリとオブジェクトの動きを同時に再構築する、革新的な…
★ 173 ⑂ 10 NOASSERTION 2026-06-11
画像生成 HF Flux2-Klein-9B-True-V2
Flux2-Klein-9B-True-V2は、FLUX.2-Klein-9Bをベースにしたテキスト画像生成向けの追加学習モデルです。V1からさらに…
❤ 168 ↓ 264.3k other 2026-07-13
マルチモーダル GitHub Multimodal-Recommendation-Library
MRLibは、マルチモーダル推薦システムの研究開発に特化したオープンソースライブラリです。画像、テキスト、音声など…
★ 160 ⑂ 14 MIT 2026-05-08
3D / NeRF GitHub MAGICIAN
MAGICIANは、CVPR 2026で発表された、能動的なマッピングのための効率的な長期計画手法です。このツールは「Imagined…
★ 155 ⑂ 9 2026-05-27
ASR / 音声認識 GitHub livecaption
livecaptionは、macOS (Apple Silicon) 向けのリアルタイムオンデバイス音声転写および翻訳を行うCLIツールです。UI…
★ 153 ⑂ 20 2026-06-29
動画生成 GitHub HiAR
HiARは、階層的な自己回帰型のビデオ生成ツールで、従来のブロックファースト型からステップファースト型へと処理を…
★ 151 ⑂ 6 Apache-2.0 2026-06-19
LLM GitHub Thinking-with-Visual-Primitives-pytorch
このツールは、DeepSeekの「Thinking with Visual Primitives」を非公式にPyTorchで再現したものです。マルチモーダ…
★ 149 ⑂ 19 MIT 2026-06-25
動画生成 HF Wan2.2-TI2V-5B-Diffusers
Wan2.2は、テキストや画像から高品質な動画を生成する先進的な大規模動画生成モデルです。MoEアーキテクチャにより効…
❤ 148 ↓ 116.1k apache-2.0 2025-08-09
画像生成 GitHub CDM
本ツールは、「Continuous-Time Distribution Matching (CDM)」技術を用いた、少ステップ拡散蒸留のためのフレームワ…
★ 147 ⑂ 6 MIT 2026-05-11
動画生成 GitHub ID-LoRA-LTX2.3-ComfyUI
このツールは、ComfyUI用のカスタムノード「ID-LoRA-2.3」を提供し、参照音声と画像に基づいて、話者の声と視覚的な…
★ 147 ⑂ 24 2026-07-01
ComfyUI GitHub ComfyUI-FaceChain
ComfyUI-FaceChainは、既存のFaceChainプロジェクトをComfyUI向けに再構築し、プロセスの分解と改善を行った画像処理…
★ 147 ⑂ 15 Apache-2.0 2025-04-28