3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
全AIリポジトリ
登録されているAI関連OSSの一覧
LLM GitHub pull-request-summary
このGitHubアクションは、AI(LLM)を活用してプルリクエストの内容を自動的に要約し、開発者の負担を軽減します。主…
★ 1 MIT 2026-06-18
マルチモーダル GitHub blind-vision-mcp
blind-vision-mcpは、テキストベースのLLM(大規模言語モデル)に「視覚」を与えるMCPサーバーです。GPT-4 VisionやC…
★ 1 MIT 2026-06-15
ASR / 音声認識 GitHub voice-prompt-tool
「Voice Prompt Tool」は、Windows環境で動作する音声入力ツールです。ホットキーを押すだけで、任意のテキスト入力…
★ 1 2026-06-23
画像生成 GitHub DiffClean
DiffCleanは、拡散モデルとテキストガイドを用いて顔のメイクアップを効果的に除去し、正確な年齢推定を可能にするツ…
★ 1 2026-05-30
LLM GitHub opencode-research-mcp
このツールは、学術研究プロセスを効率化するために設計された軽量な研究用MCP(Modular Cognitive Processor)サー…
★ 1 MIT 2026-06-02
音声生成 / TTS GitHub md-tts
md-ttsは、技術的なMarkdownファイルを音声で読み上げ、コードブロック、テーブル、フラッシュカードで再生をインタ…
★ 1 MIT 2026-06-04
ComfyUI GitHub comfyui-touch-resize
comfyui-touch-resizeは、ComfyUIのノードやグループをタッチデバイスでピンチ操作によってリサイズ可能にするツール…
★ 1 ⑂ 1 MIT 2026-07-11
マルチモーダル GitHub mm-docqa
Jmiao11/mm-docqaは、図とテキストが混在するPDF(特に論文の図表を含む)の内容に対して質問し、引用元付きの回答を…
★ 1 MIT 2026-07-07
マルチモーダル GitHub easycomputewithgemma
このツールは、Apple Silicon搭載MacでGemma 4を完全にローカルで実行し、スマートフォン(iOS/Android)から自然言…
★ 1 2026-05-24
動画生成 GitHub libu-studio
libu-studioは、AIエージェントによって駆動されるオープンソースのコンテンツ生成ツールキットです。liblib.artを基…
★ 1 MIT 2026-06-17
ComfyUI GitHub ComfyUI-Orakul-SVP
ComfyUI-Orakul-SVPは、ComfyUIの出力画像を高品質なマスターファイルとしてエクスポートするためのカスタムノードで…
★ 1 MIT 2026-06-20
ASR / 音声認識 GitHub carefulWhisper
carefulWhisperは、FastAPIとfaster-whisperを基盤とした、ローカルで動作する高速な音声認識(Speech-to-Text)バッ…
★ 1 2026-07-05
マルチモーダル GitHub uitars-mcp
UI-TARS MCPは、AIエージェントがデスクトップとウェブブラウザを操作するための「目と手」を提供するサーバーツール…
★ 1 Apache-2.0 2026-07-01
画像生成 GitHub ComfyUI_SparkVSR_SM
ComfyUI_SparkVSR_SMは、ComfyUI内で動画の超解像処理を行うWindows向けツールです。キーフレームとフレーム伝播の技…
★ 1 Apache-2.0 2026-07-15
音声生成 / TTS GitHub s2s
S2Sは、Rustとsherpa-onnxフレームワークを活用した、高性能で軽量なローカルSTT(音声認識)およびTTS(音声合成)A…
★ 1 GPL-3.0 2026-06-10
マルチモーダル GitHub agents-connector
agents-connectorは、Claude Code、Codex、Gemini CLIといったAIエージェント間の連携を可能にするローカルメッセー…
★ 1 MIT 2026-07-16
ASR / 音声認識 GitHub ai-voice-assistant-nlp
このプロジェクトはPythonと自然言語処理(NLP)を活用したAI音声アシスタントです。音声コマンドを理解し、ウェブ検…
★ 1 2026-05-25
マルチモーダル GitHub PrismRAG
PrismRAGは、PDFドキュメント内のテキストだけでなく、図、チャート、テーブルといった視覚情報からも質問に答えるマ…
★ 1 MIT 2026-07-27
画像生成 GitHub comfyui-character-picker
「ComfyUI Character Picker」は、ComfyUIのカスタムノードとして機能し、9500以上の膨大なアニメ/ゲームキャラクタ…
★ 1 ⑂ 1 MIT 2026-06-04
AIエージェント GitHub agent-conductor
Agent Conductorは、AIエージェントのスキルを、ゲート付きの監視可能なワークフローに変換するツールです。各ステッ…
★ 1 MIT 2026-06-11
動画生成 GitHub veo-3.1-api
本リポジトリは、Google DeepMindの高度なビデオ生成モデル「Veo 3.1 API」をAPIDot経由で利用するための豊富なサン…
★ 1 MIT 2026-07-06
LLM GitHub prompt-template-hub
「一键 Prompt」は、日常のAIチャットで高品質なプロンプトテンプレートを素早く見つけ、生成し、入力できる軽量なCh…
★ 1 MIT 2026-06-10
ASR / 音声認識 GitHub voiceintake
「VoiceIntake」は、AIを活用して患者の音声問診を自動化するシステムです。患者が話すだけでAIが問診内容を瞬時に文…
★ 1 2026-06-16
音声生成 / TTS GitHub logica-voice
Logica Voiceは、オープンソースで音声ネイティブな会話型AIエンジンです。フルデュプレックス、マルチエージェント…
★ 1 ⑂ 1 MIT 2026-06-04