3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#AI/ML (73 repos)
「AI/ML」タグが付いたリポジトリ
← 全リポジトリ
音声生成 / TTS GitHub erm
このツールは、英語音声の録音から「um」「uh」といった言い淀みを自動で除去するローカルCLIツールです。`faster-wh…
★ 110 ⑂ 3 MIT 2026-06-14
ComfyUI GitHub ComfyUI-Forbidden-Vision
「ComfyUI Forbidden Vision」は、ComfyUIユーザー向けの革新的な顔検出、セグメンテーション、画像エンハンスメント…
★ 96 ⑂ 6 AGPL-3.0 2026-06-14
3D / NeRF GitHub guidance-for-open-source-3d-reconstruction-toolbox-for-gaussian-splats-on-aws
AWS向けオープンソース3D再構築ツールボックスは、画像や動画入力から3Dシーンやオブジェクトを再構築するためのエン…
★ 85 ⑂ 5 MIT-0 2026-07-09
マルチモーダル GitHub braviadev
このリポジトリは、修士号を持つコンピュータサイエンスの専門家であり、フルスタックエンジニア、そして博士課程の…
★ 84 ⑂ 1 2026-07-14
ComfyUI GitHub ComfyUI-FlexTools
「ostris/ComfyUI-FlexTools」は、画像生成AIのFlex.1-alphaおよびFlex.2-previewモデルをComfyUI上でより効率的に利…
★ 80 ⑂ 3 MIT 2025-08-05
LLM GitHub llm-flashcards
「LLM Flashcards」は、大規模言語モデル(LLM)の概念とアーキテクチャを視覚的に解説する300枚以上のフラッシュカ…
★ 77 ⑂ 7 NOASSERTION 2026-07-05
AIエージェント GitHub uv-scripts-for-ai
このツールは、OCR、画像処理、音声処理など、データおよび機械学習タスク向けの自己完結型UVスクリプト集です。各ス…
★ 76 ⑂ 5 Apache-2.0 2026-07-09
ASR / 音声認識 GitHub docker-whisper
hwdsl2/docker-whisperは、Docker上で動作する自己ホスト型Whisper音声認識サーバーを提供します。高速なfaster-whis…
★ 71 ⑂ 12 NOASSERTION 2026-07-10
3D / NeRF GitHub wanderland
Wanderlandは、オープンワールドの具現化されたAI向けに、幾何学的に根拠のあるシミュレーションを提供する包括的な…
★ 63 ⑂ 3 Apache-2.0 2026-07-13
マルチモーダル GitHub GEditBench_v2
GEditBench v2は、汎用画像編集モデルの性能を人間が調整した基準で評価するための包括的なベンチマークです。1,200…
★ 59 ⑂ 1 2026-06-18
LLM GitHub ATM-Bench
ATM-Benchは、画像、動画、メールなどのマルチモーダルデータに対し、約4年間にわたる長期的なパーソナライズされた…
★ 55 ⑂ 3 MIT 2026-06-28
ComfyUI GitHub Comfyui-anima-sampler
ComfyUI Anima Flow Corrective Samplerは、ComfyUI用のカスタムサンプラーノードで、AnimaおよびCosmosスタイルの画…
★ 44 ⑂ 2 MIT 2026-06-10
ASR / 音声認識 GitHub arkiv
arkivは、AIセマンティック検索機能を備えたオープンソースのローカルファーストメディアアセットマネージャーです。…
★ 41 ⑂ 4 MIT 2026-07-12
音声生成 / TTS GitHub supertonic3-voice-clone
Supertone/supertonic-3モデル向けに、音声スタイル(.jsonファイル)を学習させるためのツールです。低GPU使用量(…
★ 40 ⑂ 10 MIT 2026-07-08
ComfyUI GitHub comfyui-floodgate
ComfyUI Floodgateは、ComfyUIのワークフローにおけるロジックフローを簡単に制御できるカスタムノードです。処理時…
★ 36 ⑂ 10 MIT 2025-08-12
動画生成 GitHub MaxVideoAi
MaxVideoAIは、Sora、Veo、Kling、Seedance、LTXといった複数のAIビデオモデルを比較・生成できるマルチエンジンAIビ…
★ 35 ⑂ 14 NOASSERTION 2026-08-18
画像生成 GitHub comfyui-ReferenceLatentPlus
このツールはComfyUIの標準`ReferenceLatent`ノードを強化したドロップイン代替品です。画像ごとに参照強度、タイム…
★ 29 ⑂ 4 2026-06-07
ComfyUI GitHub comfyui-refocus
EricRollei/comfyui-refocusは、ComfyUI用のカスタムノード集で、生成型リフォーカシングパイプラインを実装していま…
★ 19 ⑂ 1 Apache-2.0 2026-05-04
音楽生成 GitHub midi-drums
このツールは、Pythonで開発された、プロ品質のMIDIドラムトラック生成システムです。モジュール式プラグインアーキ…
★ 16 ⑂ 3 MIT 2026-08-14
マルチモーダル GitHub GalamseyWatch
このツールは、Sentinel-2衛星画像から違法な小規模金採掘(ガラッセイ)を検出するエージェント型地球観測システム…
★ 15 ⑂ 6 MIT 2026-05-05
画像生成 GitHub pytorch-memory-fix
このツールは、PyTorch/Python環境で大規模な機械学習モデル(LLM、Diffusionモデルなど)を繰り返しロード・アンロ…
★ 13 ⑂ 2 MIT 2026-07-10
画像生成 GitHub windinet
WinDiNetは、LTX-Videoビデオ拡散トランスフォーマーを都市の風の流れにおける計算流体力学(CFD)シミュレーション…
★ 10 ⑂ 3 Apache-2.0 2026-04-15
動画生成 GitHub wan2.2-i2v-fast
wan2.2-i2v-fastは、14BパラメータのWan-AI/Wan2.2-I2V-A14B-Diffusersモデルを活用した、実験的かつ高度に最適化さ…
★ 6 ⑂ 1 Apache-2.0 2026-07-07
LLM GitHub SocialSim
本リポジトリは、AAAI 2025論文「SocialSim: Towards Socialized Simulation of Emotional Support Conversation」に…
★ 6 ⑂ 1 NOASSERTION 2026-05-20