3,624 repos GH 3,509 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Python (2211 repos)
「Python」タグが付いたリポジトリ
← 全リポジトリ
ComfyUI GitHub ComfyUI-GoRi-Wireless-Engine
GoRi-Wireless Engineは、ComfyUIの複雑なワークフローにおけるノード間の配線を無線化し、整理するツールです。ワン…
★ 10 ⑂ 1 2026-05-29
AIエージェント GitHub web-speed-oss
Web Speedは、AIエージェント向けのWebページ解析ツールです。複雑なWebコンテンツ(HTML、レイアウト、JavaScript)…
★ 9 ⑂ 1 GPL-3.0 2026-05-10
ComfyUI GitHub ac-comfyui-queue-manager
ComfyUI Queue Managerは、ComfyUIのワークフロー実行キューを永続化して管理できる拡張ツールです。再起動後もキュ…
★ 9 ⑂ 2 2025-09-27
3D / NeRF GitHub map-creator
map-creatorは、DJIドローンを用いた3Dマッピングや写真測量ミッションを計画・視覚化するためのデスクトップアプリ…
★ 9 MIT 2026-05-09
ComfyUI GitHub ComfyUI-HeartMuLa
ComfyUI-HeartMuLaは、音楽生成と歌詞転写を目的としたComfyUIの拡張機能です。HeartMuLaモデルファミリーとheartlib…
★ 9 ⑂ 4 Apache-2.0 2026-02-14
音声生成 / TTS GitHub omnivoice-thai-api
nanofatdog/omnivoice-thai-apiは、追加学習不要のタイ語テキスト読み上げ(TTS)APIおよびWeb UIです。Voice Clonin…
★ 9 ⑂ 5 2026-05-22
画像生成 GitHub CVQ
このリポジトリは、革新的な画像トークン化手法「Channel-wise Vector Quantization (CVQ)」とその応用である「Chann…
★ 9 MIT 2026-06-01
ASR / 音声認識 GitHub afrispeech-selector
AfriSpeech Selectorは、142のアフリカ言語にわたる2200時間以上の音声データに簡単にアクセスできるCLIツールです。…
★ 9 ⑂ 5 2026-06-19
ComfyUI GitHub comfyui-save-file-extended
ComfyUI向けの拡張ノード集で、画像の保存・読み込みをローカル保存先だけでなく各種クラウドストレージにも直接対応…
★ 9 ⑂ 6 MIT 2025-11-27
ComfyUI GitHub ComfyUI-Subworkflow
ComfyUI-Subworkflowは、ComfyUIの既存ワークフローを再利用可能な「サブワークフロー」として活用するための拡張機…
★ 9 ⑂ 2 GPL-3.0 2026-04-28
マルチモーダル GitHub goodq4all
GoodQ4Allは、ローカルファーストのマルチモーダル記憶システムで、長期間のビデオ、オーディオ、テキストからの情報…
★ 9 MIT 2026-06-26
音声生成 / TTS GitHub voxlert
Voxlertは、Claude Code、Cursor、OpenAI Codex、pi、OpenClawなどのLLM生成AIコーディングエージェント向けに、ゲー…
★ 9 ⑂ 2 MIT 2026-06-28
AIエージェント GitHub hero-harness
HERO(Harness for Engineering and Run-time Orchestration)は、基盤モデルを活用した自律型ソフトウェアエンジニ…
★ 9 MIT 2026-06-10
マルチモーダル GitHub mlx-serve
mlx-serveは、Apple Silicon搭載Mac (M1+以降) 向けのローカル推論サーバーです。このツールは、AppleのネイティブML…
★ 9 ⑂ 1 MIT 2026-06-23
画像生成 GitHub codex-pet-generator
このツールは、Codexデスクトップペットを生成するための再利用可能なスキルです。大規模な画像生成に起因するクロッ…
★ 9 MIT 2026-05-05
LLM GitHub rag-forge
「rag-forge」は、Retrieval-Augmented Generation(RAG)タスクに特化してLLM(大規模言語モデル)を効率的にファイ…
★ 9 ⑂ 1 NOASSERTION 2026-05-01
マルチモーダル GitHub MM-FM
MM-FMは、CVPR 2026で発表された、マルチモーダル分布のためのフローマッチング技術です。このツールは、特に高解像…
★ 9 ⑂ 1 MIT 2026-06-12
ASR / 音声認識 GitHub Premiere-Pro-edit-bibl
Premiere Auto-Editは、話している動画(ロングフォーム・トーク・ライブ)のラフカットを、たった1つのコマンドで自…
★ 9 ⑂ 3 MIT 2026-06-15
画像生成 GitHub diffusion-tutorials-cn
本プロジェクトは、Tsuyoshi Matsuzaki氏による「diffusion-tutorials」の中国語翻訳・理論強化版です。拡散モデル(…
★ 9 MIT 2026-03-28
画像生成 GitHub mlx-taef
mlx-taefは、Apple Silicon向けに最適化された、拡散ラテントを高速にデコードするTiny AutoEncoderライブラリです。…
★ 9 ⑂ 2 MIT 2026-07-01
マルチモーダル GitHub cppo
CPPO(Contrastive Perception Policy Optimization)は、視覚言語モデル(VLM)エージェントのファインチューニング…
★ 9 2026-05-28
画像生成 GitHub ComfyUI-PlagueKind-Nodes
「ComfyUI-PlagueKind-Nodes」は、ComfyUIユーザー向けに画像とマスクのリサイズを統合し、LoRAの高度なスタッキング…
★ 9 ⑂ 2 MIT 2026-05-31
マルチモーダル GitHub Awesome-VLA-Safety
本リポジトリは、Vision-Language-Action(VLA)モデルの安全性に関する厳選された研究論文リストです。データ準備、…
★ 9 2026-05-20
画像生成 GitHub relay-imagegen
「Relay Imagegen」は、AIアシスタント「Codex」の中継ステーションを用いた画像生成において、解像度やアスペクト比…
★ 9 MIT 2026-06-02