3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新

#Python (2196 repos)

「Python」タグが付いたリポジトリ

← 全リポジトリ

音声生成 / TTS
GitHub
Higgs_v3-TTS-ComfyUI
このツールは、ComfyUI用のノード集であり、bosonai/higgs-audio-v3-tts-4bモデルを活用して、多言語(100言語対応)…
★ 61 ⑂ 11 MIT 2026-06-20
ASR / 音声認識
GitHub
AmicoScript
AmicoScriptは、OpenAIのWhisperモデルをベースにした、プライバシー重視のローカルオーディオ転写ツールです。ユー…
★ 60 ⑂ 2 MIT 2026-06-21
画像生成
GitHub
Fizgig
Fizgigは、Flux 2 Klein 9B LoRAに特化した統合スタジオです。LoRAのトレーニング、プロファイリング、修復、抽出を…
★ 60 ⑂ 3 Apache-2.0 2026-07-11
マルチモーダル
GitHub
GEditBench_v2
GEditBench v2は、汎用画像編集モデルの性能を人間が調整した基準で評価するための包括的なベンチマークです。1,200…
★ 59 ⑂ 1 2026-06-18
ASR / 音声認識
GitHub
doubao-murmur
Doubao Murmurは、豆包(doubao.com)のWeb音声認識機能を活用したミニマルな音声入力ツールです。macOSとLinux/Stea…
★ 59 ⑂ 2 MIT 2026-06-13
ASR / 音声認識
GitHub
ArcSub
ArcSubは、クラウドサービスとローカルのOpenVINOモデルの両方を活用するエンドツーエンドの字幕翻訳ワークステーシ…
★ 58 ⑂ 12 MIT 2026-05-23
3D / NeRF
GitHub
EcoSplat
EcoSplatは、効率制御可能なフィードフォワード3D Gaussian Splatting技術を実装したツールです。マルチビュー画像か…
★ 56 ⑂ 2 MIT 2026-06-11
LLM
GitHub
deepcloak
DeepCloakは、Cloudflare、Datadome、Turnstile、reCAPTCHAなどのボットウォールによってブロックされるウェブページ…
★ 56 ⑂ 8 MIT 2026-06-05
マルチモーダル
GitHub
OmniVideo-100K
「OmniVideo-100K」は、音声・視覚推論能力の向上を目指す大規模データセットと、そのための自動データ合成エンジン…
★ 56 ⑂ 2 Apache-2.0 2026-07-08
LLM
GitHub
ATM-Bench
ATM-Benchは、画像、動画、メールなどのマルチモーダルデータに対し、約4年間にわたる長期的なパーソナライズされた…
★ 55 ⑂ 3 MIT 2026-06-28
3D / NeRF
GitHub
metaquest-3d-reconstruction
本ツールは、Meta Questデバイスでキャプチャされたパススルー画像と深度データを用いて3Dシーンを再構築するための…
★ 55 ⑂ 11 MIT 2026-06-23
動画生成
GitHub
Awesome-Gemini-Omni-API-Prompts
このリポジトリは、Google Gemini Omni APIのプロンプト集です。MuAPIを通じて独占的に提供されるGemini Omni APIの…
★ 54 ⑂ 6 MIT 2026-06-11
画像生成
GitHub
LeapAlign_Code
LeapAlignは、フローマッチングモデルを人間の好みに合わせて微調整するための学習後手法です。完全なサンプリング軌…
★ 54 ⑂ 1 Apache-2.0 2026-06-13
LLM
GitHub
memexa
Memexaは、AIエージェントと人間が中国語のデータを扱うための自己ホスト型記憶グラフツールです。WeChat、QQ、飛書…
★ 53 ⑂ 4 Apache-2.0 2026-07-01
音楽生成
GitHub
SynthBridge
SynthBridgeは、ユーザーが入力したコード進行やメロディをリアルタイムで生成し、即座に演奏できる音楽生成Webアプ…
★ 52 MIT 2026-05-27
LLM
GitHub
Arctic-Platform
ArcticPlatformは、大規模言語モデル(LLM)のポストトレーニングプロセスを簡素化・加速するために設計されたフレー…
★ 51 ⑂ 6 Apache-2.0 2026-07-10
音声生成 / TTS
GitHub
Audio-Oscar
Audio-Oscarは、複雑な音声シーン記述から長尺で制御可能な音声を生成するためのマルチエージェントフレームワークで…
★ 51 ⑂ 5 Apache-2.0 2026-06-08
マルチモーダル
GitHub
GameVerse
GameVerseは、動画ベースの反射学習を通じてVision-Language Models (VLMs) がゲームプレイを学習できるかを検証する…
★ 50 MIT 2026-07-13
画像生成
GitHub
gpic
GPIC(Giant Permissive Image Corpus)は、視覚生成モデリング研究のための巨大で許容性の高い画像コーパスです。約…
★ 50 ⑂ 2 MIT 2026-06-04
3D / NeRF
GitHub
ULF-Loc
ULF-Locは、CVPR 2026 Highlight論文として発表された、3D Gaussian Splattingを用いた堅牢な視覚ローカライゼーショ…
★ 50 ⑂ 6 2026-06-16
画像生成
GitHub
RvR
RvR (Refinement via Regeneration) は、清華大学とTencent Hunyuanが開発した、画像リファインメントのための革新的…
★ 50 ⑂ 1 MIT 2026-05-26
音声生成 / TTS
GitHub
Emoji-TTS
このプロジェクトは、Irodori-TTSをフォークし、echo-TTSのWeb UIとして機能する、Flow Matchingベースの高性能なテ…
★ 49 ⑂ 5 MIT 2026-05-29
3D / NeRF
GitHub
OpenSfM
OpenSfMは、PythonとC++で開発されたオープンソースのStructure from Motion(SfM)ライブラリです。順序付けされて…
★ 49 ⑂ 11 BSD-2-Clause 2026-07-12
音声生成 / TTS
GitHub
Irodori-TTS-Server
「Irodori OpenAI TTS Server」は、Aratako/Irodori-TTSの500M v3ベースモデル向けに開発された、OpenAI Text-to-Spe…
★ 49 ⑂ 17 MIT 2026-07-10