LLM HF Qwen2.5-7B-Instruct
Qwen2.5-7B-Instructは、Qwen大規模言語モデルの最新シリーズであり、特に命令チューニングされた7Bモデルです。コー…
❤ 1.4k ↓ 12.6M apache-2.0 2025-01-12
音声生成 / TTS GitHub Chatterbox-TTS-Server
Chatterbox TTS Serverは、オープンソースのChatterbox TTSモデル(オリジナル、多言語、高速なTurbo版)をセルフホ…
★ 1.4k ⑂ 344 MIT 2026-05-26
LLM HF Qwen3-0.6B
Qwen3は、推論、指示追従、エージェント機能、多言語サポートに優れた次世代の大規模言語モデルです。複雑な論理的推…
❤ 1.4k ↓ 27.8M apache-2.0 2025-07-26
LLM GitHub future-agi
Future AGIは、LLMやAIエージェントアプリケーションの評価、監視、改善をエンドツーエンドで実現するオープンソース…
★ 1.4k ⑂ 376 Apache-2.0 2026-07-13
LLM GitHub llm-architecture-gallery
このツールは、GitHub上のAI関連オープンソースプロジェクトを自動的に発見し、LLM(大規模言語モデル)による要約と…
★ 1.4k ⑂ 118 Apache-2.0 2026-06-28
音楽生成 GitHub FunMusic
InspireMusicは、音楽、歌、オーディオ生成に特化した統合ツールキットです。このツールは、高いオーディオ品質で長…
★ 1.4k ⑂ 137 Apache-2.0 2025-05-20
ComfyUI GitHub ACE_plus
ACE++は、指示文と参照画像を使って画像生成・ローカル編集・被写体や人物の一貫性維持をまとめて扱う画像生成フレー…
★ 1.4k ⑂ 94 2025-04-21
LLM GitHub llmwiki
LLM Wikiは、KarpathyのLLM Wikiをオープンソースで実装した情報整理ツールです。ユーザーが持つ研究資料(PDF、ノー…
★ 1.4k ⑂ 208 Apache-2.0 2026-07-15
マルチモーダル GitHub mlx-tune
mlx-tuneは、Apple Silicon搭載Mac上でLLM、Vision、Audio、OCRモデルのファインチューニングをネイティブに実行する…
★ 1.4k ⑂ 88 Apache-2.0 2026-06-23
LLM GitHub fim-one
FIM Oneは、グローバル企業が運用する世界中のSaaSサービスと中国独自のシステム(Feishu、WeComなど)を、単一のAI…
★ 1.3k ⑂ 150 NOASSERTION 2026-07-13
AIエージェント GitHub evo
evoは、コードベースの自動研究オーケストレーターです。既存のコードを解析し、最適化目標を特定してベンチマークを…
★ 1.3k ⑂ 99 Apache-2.0 2026-07-01
画像生成 GitHub FireRed-Image-Edit
FireRed-Image-Editは、高精度な指示追従、高忠実度な画像生成、優れたアイデンティティの一貫性、シームレスな多要…
★ 1.3k ⑂ 76 Apache-2.0 2026-04-03
画像生成 GitHub Lance
LanceはByteDanceが開発した30億パラメータのマルチモーダルAIモデルです。単一フレームワーク内で画像および動画の…
★ 1.3k ⑂ 89 Apache-2.0 2026-07-14
AIエージェント GitHub auto-deep-researcher-24×7
「Deep Researcher Agent」は、深層学習の実験を24時間365日自律的に実行するAIエージェントです。ゼロコスト監視、…
★ 1.3k ⑂ 109 Apache-2.0 2026-06-03
動画生成 GitHub Bernini
Berniniは、MLLMベースのセマンティックプランナーとDiTベースのレンダラーを組み合わせた、ビデオ生成および編集の…
★ 1.3k ⑂ 99 Apache-2.0 2026-08-13
マルチモーダル HF gemma-4-26B-A4B-it
Gemma 4 26B A4B itは、Google DeepMindのオープンウェイトなマルチモーダル指示調整モデルです。テキストと画像を入…
❤ 1.3k ↓ 14.2M apache-2.0 2026-07-10
LLM GitHub memory-os
Memory OSは、Hermes Agentに永続的な長期記憶機能を提供する7層構造のメモリオペレーティングシステムです。エージ…
★ 1.3k ⑂ 119 MIT 2026-06-10
音声生成 / TTS GitHub tango
Tangoは、LLM(Flan-T5)によってガイドされる潜在拡散モデル(LDM)を用いた、テキストからオーディオを生成するツ…
★ 1.2k ⑂ 105 NOASSERTION 2025-07-29
音声生成 / TTS GitHub BigVGAN
BigVGANは、NVIDIAが開発したユニバーサルなニューラルボコーダーであり、ICLR 2023で発表されました。大規模なデー…
★ 1.2k ⑂ 146 MIT 2024-09-05
動画生成 GitHub HunyuanCustom
HunyuanCustomは、画像、音声、ビデオ、テキストといった多様な入力モダリティを活用し、特定の被写体が登場するカス…
★ 1.2k ⑂ 110 NOASSERTION 2025-10-15
AIエージェント GitHub cq
cqは、AIエージェントが同じ過ちを繰り返すことを防ぐためのオープンな知識共有標準です。エージェントは学習した知…
★ 1.2k ⑂ 64 Apache-2.0 2026-07-15
ComfyUI GitHub comfyui-inpaint-nodes
ComfyUI向けに高品質なインペイント機能を提供するノード集です。Fooocusインペイントモデル(SDXL対応)、LaMa、MAT…
★ 1.2k ⑂ 74 GPL-3.0 2026-05-31
ComfyUI GitHub RES4LYF
RES4LYFは、ComfyUI向けの先進的な画像生成サンプラーとユーティリティのコレクションです。独自のノイズスケーリン…
★ 1.2k ⑂ 114 NOASSERTION 2026-06-15
画像生成 HF stable-diffusion-v1-5
Stable Diffusion v1-5は、テキスト入力に基づいて写実的な画像を生成できる強力な潜在テキスト-画像拡散モデルです…
❤ 1.2k ↓ 1.7M creativeml-openrail-m 2024-09-07