3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
全AIリポジトリ
登録されているAI関連OSSの一覧
音声生成 / TTS GitHub crashout-buddy
Crashout Buddyは、Vision AgentsとStream Video上に構築された、リアルタイムで感情認識を行う音声AIエージェントの…
★ 3 MIT 2026-05-15
LLM GitHub Summer-inland-waterway-communication-dataset
LLIPSEは、内陸水路における船と陸間の通信のEnd-to-End遅延を予測するための軽量なLLM(大規模言語モデル)ベースの…
★ 3 ⑂ 2 MIT 2026-05-27
音声生成 / TTS GitHub ovos-tts-plugin-kokoro
ovos-tts-plugin-kokoroは、Open Voice OS (OVOS) 音声アシスタント向けに開発された、多言語テキスト読み上げ(TTS…
★ 3 NOASSERTION 2026-07-18
マルチモーダル GitHub mimo-code
MiMo-Codeは、MiMoモデルファミリー専用のネイティブデスクトップコーディングエージェントです。WindowsおよびmacOS…
★ 3 MIT 2026-06-28
音声生成 / TTS GitHub LetAITalk
LetAITalkは、AI音声アシスタントとしてユーザーに代わって電話に応答し、着信の意図を理解して安全な範囲で返答する…
★ 3 2026-05-14
3D / NeRF GitHub FoveaCore
FoveaEngineは、Godot 4.6+向けに開発された次世代VRレンダリングエンジンです。従来の3Dパイプラインを超越するため…
★ 3 MIT 2026-07-14
LLM GitHub flash-opd
FlashOPDは、わずか650行のコアコードでOn-Policy Distillation (OPD) を完全に実装した軽量なツールです。既存の複…
★ 3 2026-04-22
ASR / 音声認識 GitHub Sirious
Siriousは、macOS上でローカルの音声コマンドのトランスクリプトを分類し、ルーティングする早期開発段階のアプリケ…
★ 3 NOASSERTION 2026-06-28
マルチモーダル GitHub LangSlice
LangSliceは、Vision-Language Model (VLM) を活用し、組織学的脳切片をBrainGlobeアトラスに自動で高精度に位置合わ…
★ 3 BSD-3-Clause 2026-06-03
LLM GitHub Learn-RAG-from-scratch
本プロジェクトは、Retrieval-Augmented Generation (RAG) システムをゼロから手動で構築し、学習することに特化して…
★ 3 2026-06-14
マルチモーダル GitHub browserground
browsergroundは、ハイブリッドAIエージェント向けのローカルUIグラウンディングツールです。スクリーンショットとテ…
★ 3 2026-05-21
LLM GitHub Neura-Learn-Personal-AI-Study-Assistant
NeuraLearnは、AIを活用して学生の学習をサポートするWebアプリケーションです。主要な機能として、指定したトピック…
★ 3 2026-05-10
音声生成 / TTS GitHub godot_volcengine_tts
Godot 4.4+向けの火山エンジン豆包TTS音声大モデルのサードパーティSDKです。ゲームやインタラクティブプロジェクト…
★ 3 ⑂ 1 MIT 2026-05-20
動画生成 GitHub AI-E-Commerce-Media-Studio
このAI Eコマースメディアスタジオは、AIを活用してEコマース向けの商用利用可能な商品画像やシネマティックビデオを…
★ 3 ⑂ 1 2026-06-15
動画生成 GitHub Luma
Lumaは、AIを活用した動画コンテンツ自動制作プラットフォームです。スクリプトから音声生成、トーキングアバター動…
★ 3 2026-03-04
音楽生成 GitHub onpu
Onpuは、AIを用いて音楽を生成するSaaSプラットフォームです。シンプルなテキスト記述、カスタム歌詞、またはスタイ…
★ 3 AGPL-3.0 2026-06-15
音声生成 / TTS GitHub Supertonic-Voice
Supertonic Voiceは、PySide6とローカルONNX AI音声モデルで構築された、オフラインのデスクトップ音声合成(TTS)ア…
★ 3 MIT 2026-06-16
画像生成 GitHub gugu-gaga-penguin
このリポジトリは、大流行したAIミーム「Gugugaga Penguin(咕咕嘎嘎企鹅)」に関する参照ページを提供します。Arkni…
★ 3 2026-05-27
ComfyUI GitHub Xianxia_Studio
Xianxia Studioは、YouTube向け動画を100%オフラインで制作できるローカルAI映画制作スタジオです。テーマを入力する…
★ 3 Apache-2.0 2026-06-01
3D / NeRF GitHub Medical-Imaging-Analysis
「Medical Imaging Analysis」は、MATLABで開発された医療画像解析のポートフォリオプロジェクトで、多次元レジスト…
★ 3 2026-04-22
ASR / 音声認識 GitHub Vox
Voxは、Windowsユーザー向けのオフライン音声テキスト変換ツールです。右Ctrlキーを押して話すだけで、チャット、ブ…
★ 3 ⑂ 3 MIT 2026-05-24
ASR / 音声認識 GitHub Chaty
Chatyは、ローカル環境でGGUF形式のAIモデルとプライベートなチャットを実現するデスクトップアプリケーションです。…
★ 3 ⑂ 1 MIT 2026-07-11
ASR / 音声認識 GitHub OmniVid
OmniVidは、YouTube、Bilibili、抖音、TikTokを含む1800以上の動画プラットフォームに対応した万能動画ダウンロード…
★ 3 2026-06-16
マルチモーダル GitHub kaggle-llm-server
このツールはKaggleのGPU上で動作するマルチモーダルLLMサーバーで、テキストと画像の処理が可能です。無料のKaggle …
★ 3 ⑂ 4 2026-05-24