local-llm
local-llm がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
local-llm と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、local-llm がタグ付けされたリポジトリ。
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1,185 - #2
単一のデバイスで完全な Kimi K3 を実行します。また、ローカルチャットおよびコーディングエージェント用の OpenAI 互換 API サーバーも提供します。
★ 799 - #3
Apple Silicon で最大 4 倍高速なロスレス LLM デコード。DeepSeek の DSpark および z-lab の DFlash スペキュラティブデコードのネイティブ MLX ポート — Gemma-4、Qwen3.8、Muse-Glimmer、Nemotron、Ornith-1.0、三値 Bonsai-27B。
★ 640 - #4
Open-source AI companions, desktop pets, long-term memory & proactive chat. 人机恋开源项目大全。让你的家机能够脱离官端自主存在,拥有记忆和主动性。
★ 633 - #5
Swiftletは、ストレージから専門家ウェイトをストリーミングすることで、Apple製デバイス上で大規模なQwen Mixture-of-Expertsモデルをローカル実行するSwiftおよびMetalランタイムです。iPhoneを含む低RAM環境でも35Bおよび80Bモデルの実行を可能にします。
★ 624
- #1
WebUI、ツール、メモリ、MCP、マルチエージェントワークフロー、自動化、チャットアプリを備えた、超軽量のオープンソース自己ホスト型PythonパーソナルAIエージェントフレームワーク。
★ 47,662+140直近 7 日のスター増減 - #2★ 25,859+113直近 7 日のスター増減
- #3
SimpleQAで約95%を達成 (例: 3090上のQwen3.6-27B)。すべてのローカルおよびクラウドLLM (llama.cpp, Ollama, Google, ...) をサポート。10以上の検索エンジン - arXiv、PubMed、プライベートドキュメント。すべてローカル&暗号化。
★ 9,023+18直近 7 日のスター増減 - #4
動的ワークフローを備えたTypeScript AIエージェントオーケストレーションフレームワーク。グラフではなく目標を記述するだけでよい:コーディネーターが実行時にタスクDAGを計画し、任意のLLM(Claude、ChatGPT、Gemini、DeepSeek、またはローカルモデル)上で実行します。
★ 6,860+20直近 7 日のスター増減 - #5
オープンソースの音声AIプラットフォーム。VapiやRetellのセルフホスト型代替品。Speech to SpeechまたはLLM/STT/TTSに対応したオンプレミス、BYOK環境。ビジュアルワークフロービルダー、MCPネイティブ、テレフォニーサポート付き。
★ 5,568+45直近 7 日のスター増減 - #6
ローカルファーストのヘルスケアAI:臨床NERおよびHIPAA PIIの非識別化を100%オンデバイスで実行。2,200以上の医療モデル、21言語、Apple MLX + Python対応。クラウド不要、患者データはネットワーク外に出ない。Apache-2.0
★ 5,199+20直近 7 日のスター増減 - #7★ 4,929+1,365直近 7 日のスター増減
- #8★ 4,102+1直近 7 日のスター増減
- #9
Apple Silicon 向けの最速ローカル AI エンジン。Ollama の 4.2 倍高速、キャッシュ時 TTFT 0.08 秒、ツール呼び出し 100% 対応。17 個のツールパーサー、プロンプトキャッシュ、推論分離、クラウドローティングを搭載。OpenAI のドロップイン代替。Claude Code、Cursor、Aider と連携可能。
★ 3,647+81直近 7 日のスター増減 - #10★ 3,554+10直近 7 日のスター増減
- #11
Apple Silicon 上のローカル AI により、Claude Code を 100% デバイス上で実行します。MLX ネイティブの Anthropic API サーバー。Muse-Glimmer 30B(マルチモーダル対応、画像読み取り可能)、Gemma 4 31B、Qwen 3.5 122B(65 tok/s)、DeepSeek V4 Flash(100万コンテキスト)など6つのモデルを搭載。プライベート、オフライン、エアギャップ環境に対応。NDA、法務、医療ワークフロー向けに構築されています。
★ 3,255+12直近 7 日のスター増減 - #12
Lua、Teal、Markdown、HTTP/2、QUIC、Redis、TypeScript、npm 不要の React 19、SQLite、PostgreSQL などをサポートする、小規模で自己完結型の純粋な Go 製ウェブサーバー ++
★ 3,028+1直近 7 日のスター増減 - #13
ローカルでのLLM実行に役立つ、厳選された素晴らしいプラットフォーム、ツール、プラクティス、リソースのリスト
★ 2,823+23直近 7 日のスター増減 - #14
小型LLM向けに最適化されたハーネス
★ 2,528+16直近 7 日のスター増減 - #15
ローカルファーストの AI エージェント。ローカル AI モデルに最適化。長文コンテキストウィンドウに対応。適切なツール呼び出しが可能。デバイス上でプライベートに動作。
★ 2,452+0直近 7 日のスター増減 - #16
Ollama、OpenAI(互換)、Gemini、Mistral、Poe、OpenRouter を使用して、書籍や文書全体を翻訳します。フォーマットを維持し、中断したところから再開可能です。ファイルサイズの制限はありません。
★ 2,368+31直近 7 日のスター増減 - #17
OpenAI、Azure、ElevenLabs の代替となる、無料かつ高品質なテキスト読み上げ(TTS)API エンドポイント
★ 2,075+5直近 7 日のスター増減 - #18★ 2,048+7直近 7 日のスター増減
- #19
Apple Silicon 向けの高性能な OpenAI および Anthropic 互換 LLM 推論サーバー。ネイティブ MLX、連続バッチ処理、マルチモーダルモデル、MCP ツール呼び出し、Claude Code をサポート。
★ 1,557+6直近 7 日のスター増減 - #20
Row - Bot - パーソナル AI ソブリンティ。統合ツール、パーソナル知識グラフ、音声、ビジョン、シェル、ブラウザ自動化、定期実行タスク、健康管理、メッセージングチャネルを備えた、ローカルファーストの AI アシスタント。Ollama を使用してローカルで実行するか、オプトインでクラウドモデルを追加可能。データは手元のマシンに保持されます。
★ 1,480+11直近 7 日のスター増減 - #21
エージェント向けのローカル AI アプリおよび推論エンジン。オープンウェイトの LLM をコンピュータ上でローカルに実行可能 — プライベート、100% オフライン。Discord への参加はこちら: https://discord.com/invite/8wGSsvmg4V
★ 1,413+20直近 7 日のスター増減 - #22
Apple Silicon 搭載 Mac で LLM をファインチューニング。MLX 上でネイティブ動作する SFT、DPO、GRPO、Vision、TTS、STT、Embedding、OCR のファインチューニング対応。Unsloth 互換 API。
★ 1,398+8直近 7 日のスター増減 - #23
プラグアンドプレイ対応のローカルAIスタジオ:無検閲チャット、画像・動画生成、コーディングエージェント。abliteratedされたLLMとComfyUIを100%オフラインで実行。インストーラー1つ、Docker不要、クラウド不要。
★ 1,351+185直近 7 日のスター増減 - #24
お気に入りのキャラクターに魂を宿す。Soul of Waifuは、Live2D/VRMアバター、音声チャット、ローカルLLMを備えたデスクトップ向けロールプレイ&AIコンパニオンアプリです。没入感のあるチャット、RPGアドベンチャー、デスクトップを通じて共に成長します。
★ 1,281+15直近 7 日のスター増減 - #25★ 1,254+18直近 7 日のスター増減
- #26
WUPHF を使用すると、共有コンテキストを介して協調動作する AI チームメイトのパーソナルオフィスを立ち上げることができます。Claude Code、Codex、OpenClaw、OpenCode、ローカル LLM をサポートしています。
★ 1,253+6直近 7 日のスター増減 - #27
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1,185+285直近 7 日のスター増減 - #28
ローカル LLM で使用するための、シンプルでローカルホスト型の Web 検索 MCP サーバー
★ 1,122+8直近 7 日のスター増減 - #29
Synthadoc: 生ドキュメントを構造化されたローカルファーストのWikiに変換するオープンソースのLLM知識コンパイルエンジン。ツールを使用せずに自己管理および自己改善が可能な、従来のRAGに代わる透明性が高く人間が読める代替手段。
★ 1,116+2直近 7 日のスター増減 - #30
Apple Silicon向けのネイティブLLM推論サーバー。OpenAIおよびAnthropic API互換。Python不要。チャット、エージェントモード、ツール呼び出し機能を備えたMLX Core macOSアプリを同梱。
★ 1,115+245直近 7 日のスター増減