3,629 repos GH 3,514 / HF 115 · 11 categories · GitHub上のAI関連OSSを日本語で早見 · 毎日自動更新
#Python (2214 repos)
「Python」タグが付いたリポジトリ
← 全リポジトリ
マルチモーダル GitHub mm-docqa
Jmiao11/mm-docqaは、図とテキストが混在するPDF(特に論文の図表を含む)の内容に対して質問し、引用元付きの回答を…
★ 1 MIT 2026-06-23
3D / NeRF GitHub telemetry-frame-mapper
本ツールは、DJIドローンで撮影された動画をGPS情報付きの3Dガウシアンスプラットへ変換する完全なパイプラインを提…
★ 1 MIT 2026-06-26
音声生成 / TTS GitHub Easy-TTS-Toolkit
Easy TTS Toolkitは、音声合成(TTS)機能をPythonプロジェクトに手軽に組み込むためのツールキットです。開発者は、…
★ 1 MIT 2026-06-26
画像生成 GitHub Stream_Mirror
StreamMirrorは、Webカメラの映像をリアルタイムでアニメ、水墨画、ファンタジー風といった様々なスタイルに変換する…
★ 1 MIT 2026-05-13
ASR / 音声認識 GitHub ai-subtitle-generator
本ツールは、YouTube Shorts、TikTok、Reelsなどの短尺動画コンテンツ向けに、AIを活用しワードレベルで高精度なSRT…
★ 1 2026-05-16
マルチモーダル GitHub corpus-mill
「corpus-mill」は、ローカルGPUのみで動作するマルチモーダル動画アノテーションパイプラインです。長尺動画(人物…
★ 1 Apache-2.0 2026-05-06
LLM GitHub visually-guided-subtitle-translation
このリポジトリは、EAMT 2026の論文「Towards Visually-Guided Movie Subtitle Translation for Indic Languages」で…
★ 1 Apache-2.0 2026-05-20
音声生成 / TTS GitHub narrateflow
NarrateFlowは、PPTやドキュメントを音声クローン、タイムライン調整、リタイムド動画合成機能を備えたナレーション…
★ 1 ⑂ 1 Apache-2.0 2026-06-14
ComfyUI GitHub ai-without-fear
「AIWF Research Atlas」は、AI Without Fearプロジェクト向けに設計された、GitHub対応の研究および検索コーパスで…
★ 1 NOASSERTION 2026-06-27
画像生成 GitHub DiffClean
DiffCleanは、拡散モデルとテキストガイドを用いて顔のメイクアップを効果的に除去し、正確な年齢推定を可能にするツ…
★ 1 2026-05-30
マルチモーダル GitHub mllm-persona-evaluation
本ツールは、「都市センチメント認識のためのLLMエージェントにおけるペルソナの妥当性」に関する研究の公式実装です…
★ 1 CC-BY-4.0 2026-05-26
LLM GitHub ontorag
ontoragは、RDF/OWLオントロジーを真の情報源として活用する、オントロジー対応RAG(Retrieval-Augmented Generation…
★ 1 ⑂ 1 MIT 2026-06-16
画像生成 GitHub sd-webui-forge-neo-samg
このツールは、SD WebUI Forge Neo向けのSpatial Adaptive Multi Guidance (SAMG)拡張機能です。生成画像の品質向上…
★ 1 2026-05-11
動画生成 GitHub Agentic-video-pipeline
このプロジェクトは、テキストプロンプトからプラットフォーム対応のビデオを自動生成する自律型マルチエージェントA…
★ 1 2026-06-13
ComfyUI GitHub ComfyUI-Flux2KontextConditioner
ComfyUI-Flux2KontextConditionerは、ComfyUIのFlux2 Kontext - Klein画像編集ワークフローを強化する高度なコンディ…
★ 1 ⑂ 1 MIT 2026-06-01
画像生成 GitHub hermes-lemonade-llm-image-support
このプラグインは、Hermesエージェント向けにLemonade Serverを介した高速なローカル画像生成とLLM利用を可能にしま…
★ 1 MIT 2026-06-03
音楽生成 GitHub kithairon
Kithaironは、モノフォニックなメロディから演奏可能で説明可能なカノンのバリアントを生成するシンボリック音楽コン…
★ 1 Apache-2.0 2026-05-21
動画生成 GitHub obsidian-engine
Obsidian Engineは、一つのトピックから研究、脚本作成、ナレーション、映像制作、YouTubeへのアップロードまでを自…
★ 1 ⑂ 1 MIT 2026-06-26
3D / NeRF GitHub perceptpick
PerceptPickは、ICRA 2026で発表された、ロボットの物体把持の成功に6Dポーズ推定と3D再構成のエラーがどのように影…
★ 1 MIT 2026-05-09
音声生成 / TTS GitHub Podcast-this-tech-stuff
このツール「podcast-this-tech-stuff」は、あらゆる技術文書(PDF、スライド、プレーンテキスト、Googleドキュメン…
★ 1 MIT 2026-05-19
LLM GitHub AI-Arena-History
「Arena AI Model Elo History」は、主要AIラボ(OpenAI、Anthropic、Googleなど)のフラッグシップAIモデルの公開El…
★ 1 MIT 2026-06-27
AIエージェント GitHub mq-agent
mq-agentは、mqエコシステム向けに設計された、ターミナルネイティブなAIエージェントオーケストレーターです。計画…
★ 1 MIT 2026-06-23
音声生成 / TTS GitHub minimax-hub
このツールは、MiniMaxのAI生成機能をCodex CLIに統合するためのスキルです。画像生成、動画生成、音声合成(多言語…
★ 1 MIT 2026-05-29
ASR / 音声認識 GitHub spoken-digits-asr
本プロジェクトは、Free Spoken Digit Datasetを用いてゼロから訓練された小型のCTC音声認識器です。1秒間の数字音声…
★ 1 MIT 2026-06-24