3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
全AIリポジトリ
登録されているAI関連OSSの一覧
AIエージェント GitHub traceforge
TraceForgeは、AIコーディングエージェントやシェルコマンドの実行をローカルで詳細に記録し、監査するためのブラッ…
★ 1 MIT 2026-05-28
3D / NeRF GitHub Gaussian-Splatting
本プロジェクトは、現実世界の画像データから3D Gaussian Splatting技術を用いてTH OWLキャンパスの建物を高精度に再…
★ 1 2026-05-27
画像生成 GitHub LoRA-Dataset-Coach
「LoRA-Dataset-Coach」は、SDXLやFlux、Wanなどの写真・動画モデル向けLoRAトレーニングデータセットの準備、検証、…
★ 1 NOASSERTION 2026-06-05
動画生成 GitHub Agentic-video-pipeline
このプロジェクトは、テキストプロンプトからプラットフォーム対応のビデオを自動生成する自律型マルチエージェントA…
★ 1 2026-06-13
音声生成 / TTS GitHub f5-tts-hotkey
このツールは、任意のアプリケーションで選択したテキストを、Alt+Xのホットキー操作でF5-TTSによる音声合成で読み上…
★ 1 2026-06-02
ASR / 音声認識 GitHub language-violence-intervention-system
本プロジェクトは、プライバシーを重視したエッジAIによる言語暴力検出および能動的介入システムです。Raspberry Pi …
★ 1 ⑂ 1 Apache-2.0 2026-06-25
LLM GitHub leaderboard
Swallow LLM Leaderboardは、大規模言語モデルSwallowの性能を評価し、その結果を可視化して公開するツールです。`py…
★ 1 ⑂ 2 MIT 2026-06-24
マルチモーダル GitHub blind-vision-mcp
blind-vision-mcpは、テキストベースのLLM(大規模言語モデル)に「視覚」を与えるMCPサーバーです。GPT-4 VisionやC…
★ 1 MIT 2026-06-15
ASR / 音声認識 GitHub voice-prompt-tool
「Voice Prompt Tool」は、Windows環境で動作する音声入力ツールです。ホットキーを押すだけで、任意のテキスト入力…
★ 1 2026-06-23
LLM GitHub yuri-os
Yuri OSは、自然言語で目標を指示するだけで、AIが自動的に複雑なマルチエージェントワークフロー(DAG)を設計し、…
★ 1 2026-06-04
LLM GitHub puma-community
PUMA Communityは、ICTプロジェクト管理タスクにおけるローカルLLMのベンチマーク結果をコミュニティから収集し、公…
★ 1 MIT 2026-06-06
マルチモーダル GitHub Prismer
Prismerは、OpenAI Prismのオープンソース代替として開発されたツールで、AIとのスムーズな連携と高度なコンテキスト…
★ 1 NOASSERTION 2026-07-27
ComfyUI GitHub awesome-ai-video
このリポジトリは、最新のAIテキスト・画像-to-ビデオモデル、ツール、リソースを厳選したリストです。2026年半ばに…
★ 1 ⑂ 5 CC0-1.0 2026-06-03
ASR / 音声認識 GitHub AI-Voice-Receptionist
AI Voice Receptionistは、Pythonで構築された完全なリアルタイム、フルデュプレックスのAI音声受付システムです。ロ…
★ 1 2026-06-04
マルチモーダル GitHub vision-bridge-skill
「vision-bridge-skill」は、多モーダル対応ではないAIモデルに対し、画像、PDF、スクリーンショット、図表などの視…
★ 1 2026-06-11
ComfyUI GitHub comfyui-Colab
このGitHubリポジトリは、Google Colab上でComfyUIとQwen-Image-Editモデルを簡単に展開・実行するためのインタラク…
★ 1 ⑂ 1 2026-06-06
ASR / 音声認識 GitHub funasr-whisper-api
このツールは、FunASRとParaformer-zhを基盤としたローカル音声転写APIを提供します。OpenAI Whisper APIと高い互換…
★ 1 MIT 2026-06-14
マルチモーダル GitHub -deepseek-skills
このツールは、Claude CodeやDeepSeekのようなテキストベースのAIモデルに、画像認識(OCR機能を含む)と音声認識(…
★ 1 2026-06-04
動画生成 GitHub libu-studio
libu-studioは、AIエージェントによって駆動されるオープンソースのコンテンツ生成ツールキットです。liblib.artを基…
★ 1 MIT 2026-06-17
ASR / 音声認識 GitHub meeting-auto-summary
Meeting Auto Summaryは、会議の音声や動画を構造化された成果物(話者分離された文字起こし、字幕、要約、レポート…
★ 0 2026-06-04
音声生成 / TTS GitHub agentic-podcast
このツールは、データ駆動型のポッドキャストを人間が介入することなく毎日自動で生成し、ナレーションを付け、Spoti…
★ 0 MIT 2026-06-10
動画生成 GitHub ai-youtube-video-maker
「AI YouTube Video Maker」は、AIスクリプト、HTMLシーン、TTSナレーションを活用し、指定されたトピックからYouTub…
★ 0 MIT 2026-06-06
LLM GitHub fish-ecology-assistant
Panta Rhei · Everything Flows(Fish Ecology Assistant)は、コーディングエージェントを動的な世界観とDeepSeekレ…
★ 0 MIT 2026-07-06
ASR / 音声認識 GitHub llama-3-2-2026
このツールは、Windowsユーザー向けにローカルでLLM(大規模言語モデル)を簡単に利用できるようにするものです。Dee…
★ 0 2026-06-14