3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Python (2196 repos)
「Python」タグが付いたリポジトリ
← 全リポジトリ
3D / NeRF GitHub wanderland
Wanderlandは、オープンワールドの具現化されたAI向けに、幾何学的に根拠のあるシミュレーションを提供する包括的な…
★ 63 ⑂ 3 Apache-2.0 2026-07-13
ComfyUI GitHub ComfyUI-Flux-FaceIR
ComfyUI Flux FaceIRは、画像生成UI「ComfyUI」向けの拡張機能で、FLUX FaceIR技術を用いた高度な顔修復機能を提供し…
★ 62 ⑂ 10 Apache-2.0 2026-06-04
LLM GitHub law_rag_system
このプロジェクトは、企業法務向けのRAG(Retrieval-Augmented Generation)Q&Aシステムです。Alibaba Cloudの埋め込…
★ 62 2026-06-28
画像生成 GitHub SesquiLSR
SesquiLSRは、SDXL、Flux、Flux2、Wan 2.1/Anima/Qwen Imageといった多様なモデル/VAEに対応し、1.0倍から2.0倍の範…
★ 62 ⑂ 3 MIT 2026-07-06
動画生成 GitHub EgoSim
EgoSimは、初期の3D状態とアクションシーケンスに基づき、実体化されたインタラクションを生成する自己中心的な世界…
★ 62 ⑂ 3 2026-06-26
音声生成 / TTS GitHub Higgs_v3-TTS-ComfyUI
このツールは、ComfyUI用のノード集であり、bosonai/higgs-audio-v3-tts-4bモデルを活用して、多言語(100言語対応)…
★ 61 ⑂ 11 MIT 2026-06-20
ASR / 音声認識 GitHub AmicoScript
AmicoScriptは、OpenAIのWhisperモデルをベースにした、プライバシー重視のローカルオーディオ転写ツールです。ユー…
★ 60 ⑂ 2 MIT 2026-06-21
画像生成 GitHub Fizgig
Fizgigは、Flux 2 Klein 9B LoRAに特化した統合スタジオです。LoRAのトレーニング、プロファイリング、修復、抽出を…
★ 60 ⑂ 3 Apache-2.0 2026-07-11
ASR / 音声認識 GitHub doubao-murmur
Doubao Murmurは、豆包(doubao.com)のWeb音声認識機能を活用したミニマルな音声入力ツールです。macOSとLinux/Stea…
★ 59 ⑂ 2 MIT 2026-06-13
マルチモーダル GitHub GEditBench_v2
GEditBench v2は、汎用画像編集モデルの性能を人間が調整した基準で評価するための包括的なベンチマークです。1,200…
★ 59 ⑂ 1 2026-06-18
ASR / 音声認識 GitHub ArcSub
ArcSubは、クラウドサービスとローカルのOpenVINOモデルの両方を活用するエンドツーエンドの字幕翻訳ワークステーシ…
★ 58 ⑂ 12 MIT 2026-05-23
LLM GitHub deepcloak
DeepCloakは、Cloudflare、Datadome、Turnstile、reCAPTCHAなどのボットウォールによってブロックされるウェブページ…
★ 56 ⑂ 8 MIT 2026-06-05
マルチモーダル GitHub OmniVideo-100K
「OmniVideo-100K」は、音声・視覚推論能力の向上を目指す大規模データセットと、そのための自動データ合成エンジン…
★ 56 ⑂ 2 Apache-2.0 2026-07-08
3D / NeRF GitHub EcoSplat
EcoSplatは、効率制御可能なフィードフォワード3D Gaussian Splatting技術を実装したツールです。マルチビュー画像か…
★ 56 ⑂ 2 MIT 2026-06-11
LLM GitHub ATM-Bench
ATM-Benchは、画像、動画、メールなどのマルチモーダルデータに対し、約4年間にわたる長期的なパーソナライズされた…
★ 55 ⑂ 3 MIT 2026-06-28
3D / NeRF GitHub metaquest-3d-reconstruction
本ツールは、Meta Questデバイスでキャプチャされたパススルー画像と深度データを用いて3Dシーンを再構築するための…
★ 55 ⑂ 11 MIT 2026-06-23
画像生成 GitHub LeapAlign_Code
LeapAlignは、フローマッチングモデルを人間の好みに合わせて微調整するための学習後手法です。完全なサンプリング軌…
★ 54 ⑂ 1 Apache-2.0 2026-06-13
動画生成 GitHub Awesome-Gemini-Omni-API-Prompts
このリポジトリは、Google Gemini Omni APIのプロンプト集です。MuAPIを通じて独占的に提供されるGemini Omni APIの…
★ 54 ⑂ 6 MIT 2026-06-11
LLM GitHub memexa
Memexaは、AIエージェントと人間が中国語のデータを扱うための自己ホスト型記憶グラフツールです。WeChat、QQ、飛書…
★ 53 ⑂ 4 Apache-2.0 2026-07-01
音楽生成 GitHub SynthBridge
SynthBridgeは、ユーザーが入力したコード進行やメロディをリアルタイムで生成し、即座に演奏できる音楽生成Webアプ…
★ 52 MIT 2026-05-27
音声生成 / TTS GitHub Audio-Oscar
Audio-Oscarは、複雑な音声シーン記述から長尺で制御可能な音声を生成するためのマルチエージェントフレームワークで…
★ 51 ⑂ 5 Apache-2.0 2026-06-08
LLM GitHub Arctic-Platform
ArcticPlatformは、大規模言語モデル(LLM)のポストトレーニングプロセスを簡素化・加速するために設計されたフレー…
★ 51 ⑂ 6 Apache-2.0 2026-07-10
画像生成 GitHub RvR
RvR (Refinement via Regeneration) は、清華大学とTencent Hunyuanが開発した、画像リファインメントのための革新的…
★ 50 ⑂ 1 MIT 2026-05-26
マルチモーダル GitHub GameVerse
GameVerseは、動画ベースの反射学習を通じてVision-Language Models (VLMs) がゲームプレイを学習できるかを検証する…
★ 50 MIT 2026-07-13