3,595 repos GH 3,480 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Python (2196 repos)
「Python」タグが付いたリポジトリ
← 全リポジトリ
音声生成 / TTS GitHub memorial-skill
「纪念.skill」は、逝去した大切な人との対話を可能にするAI記念アーカイブ作成ツールです。ユーザーは故人とのWeCha…
★ 7 ⑂ 1 MIT 2026-04-02
ASR / 音声認識 GitHub meet-transcription
このツールは、Google Meetの録画を自動的に文字起こしするためのパイプラインです。Google Driveの指定フォルダを監…
★ 7 MIT 2026-06-22
音声生成 / TTS GitHub ScriptSmith-Engine
ScriptSmith-Engineは、プレーンテキストのスクリプトを、ナレーション付きの完全に編集されたYouTube動画に自動的に…
★ 7 ⑂ 1 MIT 2026-06-29
LLM GitHub VORTEXRAG
VORTEXRAGは、Retrieval-Augmented Generation (RAG) システムにおけるセマンティックドリフトとコンテキスト汚染と…
★ 7 ⑂ 2 MIT 2026-06-24
ComfyUI GitHub WavTTS-ComfyUI
WavTTS-ComfyUIは、人気のある画像生成UI「ComfyUI」に統合されたWavTTSモデルのノードセットです。参照音声とテキス…
★ 7 ⑂ 1 MIT 2026-06-04
画像生成 GitHub chatgpt-web-gen
このツールは、ChatGPT Plus/Pro/Teamアカウントを持つユーザー向けに、APIキーなしでChatGPT Webの画像生成機能を利…
★ 6 ⑂ 1 MIT 2026-06-07
画像生成 GitHub CAM
このツールは、ICML 2026で発表された論文「Unsupervised Diffusion Solver for Combinatorial Optimization via Com…
★ 6 2026-06-01
ASR / 音声認識 GitHub Murmur
Murmurは、話すだけで文字入力ができる無料のオープンソースAI音声入力ツールです。Alibaba FunASR音声認識エンジン…
★ 6 ⑂ 2 NOASSERTION 2026-06-22
LLM GitHub SocialSim
本リポジトリは、AAAI 2025論文「SocialSim: Towards Socialized Simulation of Emotional Support Conversation」に…
★ 6 ⑂ 1 NOASSERTION 2026-05-20
画像生成 GitHub CUIG
CUIGは、テキストから画像を生成する拡散モデルにおける概念忘却の研究コードベースです。本リポジトリは、独立、シ…
★ 6 MIT 2026-07-13
音声生成 / TTS GitHub AutoShorts-Studio
AutoReelは、AIを活用してソーシャルメディア向けの魅力的な短尺動画コンテンツを自動生成する、先進的なコンテナ化…
★ 6 ⑂ 2 2026-08-18
音声生成 / TTS GitHub chorus
Chorusは、YouTubeの長い動画コンテンツを効率的に消費するための画期的なツールです。YouTubeのURLまたは思想家の名…
★ 6 2026-04-25
LLM GitHub consulting-tools
Consulting Toolsは、コンサルタント向けに特化したAIツールスイートです。Claude 3.5やGeminiなどのAIを活用し、商…
★ 6 MIT 2026-03-22
画像生成 GitHub nanoDLM
「nanoDLM」は、最もシンプルで、実際に学習・デバッグ・学習が可能なマスク拡散言語モデル(MDM)の実装です。約110…
★ 6 ⑂ 1 2026-05-16
ComfyUI GitHub comfyui-cyberdelia-z-engineer
ComfyUIの「Z-Image Turbo」ワークフロー向けに設計された、LLMを活用した高度なプロンプトエンジニアリングノードで…
★ 6 ⑂ 1 MIT 2026-07-13
ASR / 音声認識 GitHub Clippos
Clipposは、長い動画からキャプション付きのバイラル向けソーシャルクリップを生成するAIエージェントスキルです。He…
★ 6 ⑂ 1 MIT 2026-04-26
音声生成 / TTS GitHub doubao-speech
doubao-speechは、Volcengine Doubaoのseed-tts-2.0とbigmodel音声APIに対応したPythonクライアントおよびCLIツール…
★ 6 ⑂ 1 MIT 2026-06-07
ASR / 音声認識 GitHub ai_interview
このツールは、リアルタイム音声対話、多段階面接、ライブ採点、詳細レポート生成機能を備えたAI駆動型模擬面接プラ…
★ 6 2026-06-15
動画生成 GitHub wan2.2-i2v-fast
wan2.2-i2v-fastは、14BパラメータのWan-AI/Wan2.2-I2V-A14B-Diffusersモデルを活用した、実験的かつ高度に最適化さ…
★ 6 ⑂ 1 Apache-2.0 2026-07-07
マルチモーダル GitHub opencode-vision
opencode-visionは、マルチモーダルに対応していないOpenCodeモデルに画像認識機能を追加するツールです。ユーザーが…
★ 6 ⑂ 1 MIT 2026-07-13
3D / NeRF GitHub SLAM-X
SLAM-Xは、NeRF-SLAMおよびGaussian Splatting SLAMシステムの動的なシーンにおけるロバスト性を向上させるためのプ…
★ 6 ⑂ 1 GPL-3.0 2025-12-09
音声生成 / TTS GitHub HiggsAudiov2TokenizerUnofficial
本ツールは、HuBERTのセマンティック特徴量を用いたHiggs Audio V2 Tokenizerの非公式PyTorch実装です。960倍ダウン…
★ 6 ⑂ 2 2025-10-08
音声生成 / TTS GitHub nano-codec
nano-codecは、最小限のニューラルオーディオコーデックであり、16kHzモノラルの音声を128倍に圧縮し、10.2kbpsの低…
★ 6 2026-03-31
3D / NeRF GitHub higs
HiGSは、SIGGRAPH Asia 2025で発表された「Inverse Radiative Transport for Infrared Scenes with Gaussian Primiti…
★ 6 ⑂ 1 2026-06-09