3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Python (2196 repos)
「Python」タグが付いたリポジトリ
← 全リポジトリ
画像生成 GitHub ComfyUI-PlagueKind-Nodes
「ComfyUI-PlagueKind-Nodes」は、ComfyUIユーザー向けに画像とマスクのリサイズを統合し、LoRAの高度なスタッキング…
★ 10 ⑂ 2 MIT 2026-07-10
音楽生成 GitHub ACE-Step-Studio-pinokio
「ACE-Step Studio — Pinokio launcher」は、ローカルでAI音楽生成を可能にする「ACE-Step Studio」のワンクリックク…
★ 10 ⑂ 5 MIT 2026-07-13
マルチモーダル GitHub egobabyvlm
本リポジトリは、EgoBabyVLMチャレンジのインフラを提供します。これは、乳幼児の一人称視点ビデオデータ(BabyView …
★ 10 ⑂ 2 NOASSERTION 2026-06-23
ComfyUI GitHub ComfyUI-GoRi-Wireless-Engine
GoRi-Wireless Engineは、ComfyUIの複雑なワークフローにおけるノード間の配線を無線化し、整理するツールです。ワン…
★ 10 ⑂ 1 2026-05-29
LLM GitHub Auto-Read-Paper
Auto-Read-Paperは、arXivから最新論文を毎日自動で取得し、AIが読解・評価を行うパーソナル論文読解アシスタントで…
★ 10 ⑂ 9 AGPL-3.0 2026-06-03
LLM GitHub guia-de-programacion-con-ai
このガイドは、AIを活用したプログラミングとソフトウェア開発を学ぶためのスペイン語で書かれた最も包括的なリソー…
★ 10 MIT 2026-07-05
LLM GitHub CasualGraph
CausalGraph AIは、ESGレポートなどの長文企業報告書を分析し、検索可能なエビデンス、グラフコンテキスト、引用付き…
★ 10 ⑂ 2 2026-07-08
マルチモーダル GitHub Awesome-VLA-Safety
本リポジトリは、Vision-Language-Action(VLA)モデルの安全性に関する厳選された研究論文リストです。データ準備、…
★ 10 2026-05-20
動画生成 GitHub ComfyUI-Higgsfield-Direct
このツールは、人気の画像生成UIであるComfyUIにHiggsfield APIを直接統合するカスタムノードパックです。Soul 2.0や…
★ 10 ⑂ 1 MIT 2026-03-31
ComfyUI GitHub ComfyUI-Subworkflow
ComfyUI-Subworkflowは、ComfyUIの既存ワークフローを再利用可能な「サブワークフロー」として活用するための拡張機…
★ 10 ⑂ 2 GPL-3.0 2026-04-28
LLM GitHub vlm4ocr
vlm4ocrは、Vision Language Models (VLMs) を活用して高精度なOCR(光学文字認識)を可能にするPythonパッケージお…
★ 10 ⑂ 1 MIT 2026-05-05
ComfyUI GitHub video-to-prompt
「Video-to-Prompt WebUI」は、動画からAI画像生成プロンプトを抽出するためのGradioベースのウェブアプリケーション…
★ 10 ⑂ 1 NOASSERTION 2026-05-26
画像生成 GitHub Cross-Modality-Conditional-Diffusion-Model
このプロジェクトは、T1加重MRI画像とT2加重MRIスキャン間の医療画像モダリティ変換を行う、条件付き拡散モデルの実…
★ 10 MIT 2026-05-13
マルチモーダル GitHub cppo
CPPO(Contrastive Perception Policy Optimization)は、視覚言語モデル(VLM)エージェントのファインチューニング…
★ 10 2026-05-28
ComfyUI GitHub ComfyUI-KittenTTS
ComfyUI-KittenTTSは、超軽量なKittenTTSテキスト読み上げモデルをComfyUIワークフローに統合するためのカスタムノー…
★ 10 ⑂ 3 Apache-2.0 2026-03-04
画像生成 GitHub windinet
WinDiNetは、LTX-Videoビデオ拡散トランスフォーマーを都市の風の流れにおける計算流体力学(CFD)シミュレーション…
★ 10 ⑂ 3 Apache-2.0 2026-04-15
動画生成 GitHub Model-To-NPU
このリポジトリは、Qualcomm Snapdragonデバイス上で大規模な拡散モデルを実行するためのパイプラインを提供します。…
★ 10 ⑂ 3 NOASSERTION 2026-05-12
動画生成 GitHub ltx-video-mlx
ltx-video-mlxは、Apple Silicon(M1以降のMac)上でMLXを活用し、PyTorchなしでLTX-2.3モデル(22B)による高性能な…
★ 10 ⑂ 3 2026-04-11
画像生成 GitHub PiD-Image-Upscaler
PiD-Image-Upscalerは、NVIDIAのPiD(Pixel Diffusion Decoder)フレームワークを基盤とした、実験的な高機能超解像…
★ 10 ⑂ 4 Apache-2.0 2026-07-07
音声生成 / TTS GitHub omnivoice-thai-api
nanofatdog/omnivoice-thai-apiは、追加学習不要のタイ語テキスト読み上げ(TTS)APIおよびWeb UIです。Voice Clonin…
★ 9 ⑂ 5 2026-05-22
AIエージェント GitHub Hermes-Memory-OS
Hermes Memory-OSは、長時間稼働するHermesエージェント向けの「ファイルファースト」なメモリおよびガバナンスラン…
★ 9 MIT 2026-08-19
画像生成 GitHub DisPOSE
この「DisPOSE」は、自己教師ありマルチビュー3D人体ポーズ推定のための実装です。離散的なクロスビュー人物割り当て…
★ 9 ⑂ 1 MIT 2026-07-03
LLM GitHub agent-engineering-roadmap
このリポジトリは、プロンプトやRAGの段階を超え、本番環境で利用可能なAIエージェントの構築を目指す開発者向けの、…
★ 9 ⑂ 1 MIT 2026-06-29
画像生成 GitHub comfyui-lora-FindingLora
「Finding LoRA — for ComfyUI」は、ComfyUIのLoRAローダーの使い勝手を大幅に改善するカスタムノードです。ブックマ…
★ 9 ⑂ 2 2026-06-07