vllm
vllm がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
Prometheus と GPT4 を使用して LLM の応答を評価する 💯
★ 1,111+4直近 7 日のスター増減 - #32★ 1,094+15直近 7 日のスター増減
- #33★ 968+64直近 7 日のスター増減
- #34★ 936+17直近 7 日のスター増減
- #35★ 890+1直近 7 日のスター増減
- #36
LLM 推論サービングと最適化のための、1日30分・10週間のロードマップ。vLLM、SGLang、量子化、予測デコード、ベンチマーク。
★ 882+77直近 7 日のスター増減 - #37
DeepSeek-OCR-2 AIを使用し、画像やPDFファイルを処理できるローカル、オフライン(初期設定後)、ポータブルなOCRソフトウェア(マシン上で直接実行)。
★ 874+3直近 7 日のスター増減 - #38
Debian上で完全プライベートなローカルLLMサーバーを構築するためのエンドツーエンドのドキュメント。チャット、ウェブ検索、RAG、モデル管理、MCPサーバー、画像生成、TTS機能を搭載。
★ 834-2直近 7 日のスター増減 - #39★ 830+4直近 7 日のスター増減
- #40★ 787+1直近 7 日のスター増減
- #41
[EMNLP 2024 & AAAI 2026] LLM、VLM、動画生成モデルなどの大規模モデルを圧縮するための強力なツールキット
★ 747+4直近 7 日のスター増減 - #42★ 676+18直近 7 日のスター増減
- #43★ 673+5直近 7 日のスター増減
- #44
EfficientSAM3 は、プログレッシブ知識蒸留により SAM3 を軽量でエッジ向けのモデルに圧縮し、高速なプロンプト駆動型コンセプトのセグメンテーションとトラッキングを実現します。
★ 667+9直近 7 日のスター増減 - #45★ 613+1直近 7 日のスター増減
- #46★ 564+0直近 7 日のスター増減
- #47★ 554+1直近 7 日のスター増減
- #48
vLLM サーバー(www.github.com/vllm-project/vllm)を管理・操作するためのモダンな Web インターフェース。GPU と CPU の両モードをサポートし、macOS Apple Silicon 向けの特別最適化や OpenShift/Kubernetes でのエんタープライズデプロイに対応しています。
★ 530+8直近 7 日のスター増減 - #49
Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).
★ 519+14直近 7 日のスター増減 - #50
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 512—直近 7 日のスター増減 - #51
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—直近 7 日のスター増減 - #52★ 505-1直近 7 日のスター増減