3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

全AIリポジトリ

登録されているAI関連OSSの一覧

ASR / 音声認識
GitHub
speech-android
soniqo/speech-androidは、Androidデバイス向けのオンデバイス音声SDKです。ONNX RuntimeとQualcomm NNAPIアクセラレ…
★ 74 ⑂ 5 Apache-2.0 2026-07-14
ComfyUI
GitHub
comfyui_sam3
ComfyUI向けのSAM3カスタムノード集で、自然言語のテキスト指示から画像内の対象物を高精度に切り抜き・マスク生成で…
★ 74 ⑂ 10 MIT 2026-01-01
ComfyUI
GitHub
A8R8_ComfyUI_nodes
A8R8 ComfyUI Nodesは、A8R8をComfyUIに統合するためのカスタムノード集です。ComfyUIの`custom_nodes`に配置するかC…
★ 74 ⑂ 10 2024-12-09
LLM
GitHub
opencode-chrome-annotation
このツールは、Chromeブラウザ上で任意のウェブページにアノテーションを付け、そのスクリーンショット、選択された…
★ 73 ⑂ 5 GPL-3.0 2026-04-30
ComfyUI
GitHub
ComfyUI-DiffusionLight
このツールは、拡散モデルベースの画像生成ツール「ComfyUI」において、DiffusionLightのライトプローブ作成手法を簡…
★ 73 ⑂ 5 GPL-3.0 2024-05-21
動画生成
GitHub
ReImagine
ReImagineは、画像優先合成という先進的な手法を用いて、高品質で制御可能な人間動画を生成するためのフレームワーク…
★ 73 ⑂ 12 Apache-2.0 2026-04-23
マルチモーダル
GitHub
shadow
ShadowはmacOS向けの高度なパーソナルAIエンジンです。画面、音声、キー入力、クリップボードなど、コンピューター上…
★ 73 ⑂ 5 MIT 2026-03-16
ASR / 音声認識
GitHub
vocamac
VocaMacは、macOS向けのオープンソースかつオフラインで動作する音声テキスト変換ツールです。ホットキーを押しなが…
★ 73 ⑂ 12 AGPL-3.0 2026-07-26
音声生成 / TTS
GitHub
omnivoice-server
omnivoice-serverは、OmniVoiceテキスト読み上げモデルのOpenAI互換HTTPサーバーです。OpenAIのTTSエンドポイントの…
★ 73 ⑂ 25 MIT 2026-06-26
画像生成
GitHub
Ultimate-AI-Media-Generator-Skill
Ultimate-AI-Media-Generator-Skillは、AIエージェントが自律的に画像や動画を生成できるようにするオープンソースの…
★ 72 ⑂ 8 MIT 2026-07-03
音楽生成
GitHub
tadpole-studio
Tadpole Studioは、AIによる音楽生成をローカル環境で完結できる多機能な音楽スタジオです。テキストからの音楽生成…
★ 72 ⑂ 10 MIT 2026-03-05
画像生成
GitHub
ai-image-prompt-cookbook
このツールは、AI画像生成および画像編集のための中国語のプロンプト集です。女性服、子供服、ECサイトのメイン画像…
★ 72 ⑂ 20 NOASSERTION 2026-07-08
ComfyUI
GitHub
ComfyUI-Doctor
ComfyUI-Doctorは、ComfyUI向けのリアルタイム診断およびデバッグ支援ツールです。ランタイムエラーを捕捉し、ノード…
★ 72 ⑂ 4 MIT 2026-07-20
動画生成
GitHub
MIND
MINDは、ワールドモデルの記憶一貫性と行動制御能力を評価するための、初のオープンエンドな閉ループ再訪問ベンチマ…
★ 72 ⑂ 2 MIT 2026-07-02
LLM
GitHub
akb
AKBは、AIエージェント向けの組織的記憶を目的としたナレッジベースです。Gitベースで、Model Context Protocol (MCP…
★ 72 ⑂ 6 NOASSERTION 2026-07-16
音声生成 / TTS
GitHub
ZeusHammer
ZeusHammerは、AIエージェントのコスト、速度、プライバシー、オフライン利用、記憶能力といった課題を解決するため…
★ 72 ⑂ 15 2026-04-25
AIエージェント
GitHub
agentcanvas
agentcanvasは、Pydantic AIエージェントのLogfireトレースを、インタラクティブなHTMLダイアグラムとして視覚化する…
★ 71 ⑂ 7 MIT 2026-06-17
動画生成
GitHub
EverAnimate
EverAnimateは、長時間の人間アニメーション動画生成において、視覚品質とキャラクターの一貫性を維持する効率的な後…
★ 71 ⑂ 2 MIT 2026-06-04
ASR / 音声認識
GitHub
docker-whisper
hwdsl2/docker-whisperは、Docker上で動作する自己ホスト型Whisper音声認識サーバーを提供します。高速なfaster-whis…
★ 71 ⑂ 12 NOASSERTION 2026-07-10
ComfyUI
GitHub
sd-lora-trainer
edenartlab/sd-lora-trainerは、Stable Diffusion v1.5およびSDXL用のLoRaモジュールを学習およびフルファインチュー…
★ 70 ⑂ 12 NOASSERTION 2025-08-04
ComfyUI
GitHub
ComfyUI_AnyDoor
ComfyUI_AnyDoorは、画像生成AIツールであるComfyUI上で動作するカスタムノードです。このツールを使用すると、キャ…
★ 70 ⑂ 8 MIT 2025-02-05
動画生成
GitHub
video-to-video
「Reshoot-Anything」は、単眼ビデオを新しいカメラ軌道で再撮影するための自己教師ありビデオ拡散モデルです。既存…
★ 70 ⑂ 7 Apache-2.0 2026-04-27
ASR / 音声認識
GitHub
Aria
AriaはWindows向けのAI音声入力ツールで、Qwen3-ASRを基盤とし、全ての音声処理をローカルで完結します。特徴として…
★ 70 ⑂ 12 Apache-2.0 2026-06-10
マルチモーダル
GitHub
CourtSI
CourtSIは、スポーツ分野における空間知能を評価するための大規模データセットとベンチマークです。100万以上の質問…
★ 70 Apache-2.0 2026-03-15