メインコンテンツへスキップ
buildradar
Sign in
トピック · vllm

vllm

vllm がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

52 件のリポジトリ
  • prometheus-eval@prometheus-eval

    Prometheus と GPT4 を使用して LLM の応答を評価する 💯

    1,111+4直近 7 日のスター増減
  • tiny-vllm@jmaczan

    C++とCUDAで高性能なLLM推論エンジンを構築する - vLLMの軽量版

    1,094+15直近 7 日のスター増減
  • verl-omni@verl-project

    拡散モデルおよびオムニモデル向けのマルチモーダル RL トレーニングフレームワーク

    968+64直近 7 日のスター増減
  • UniRL@Tencent-Hunyuan

    UniRL は、統合マルチモーダルモデルの強化学習用フレームワークです

    936+17直近 7 日のスター増減
  • llm_note@harleyszhang

    LLM に関するノート。モデル推論、Transformer モデルの構造、LLM フレームワークのコード解析ノートを含む。

    890+1直近 7 日のスター増減
  • LLM 推論サービングと最適化のための、1日30分・10週間のロードマップ。vLLM、SGLang、量子化、予測デコード、ベンチマーク。

    882+77直近 7 日のスター増減
  • local_ai_ocr@th1nhhdk

    DeepSeek-OCR-2 AIを使用し、画像やPDFファイルを処理できるローカル、オフライン(初期設定後)、ポータブルなOCRソフトウェア(マシン上で直接実行)。

    874+3直近 7 日のスター増減
  • llm-server-docs@varunvasudeva1

    Debian上で完全プライベートなローカルLLMサーバーを構築するためのエンドツーエンドのドキュメント。チャット、ウェブ検索、RAG、モデル管理、MCPサーバー、画像生成、TTS機能を搭載。

    834-2直近 7 日のスター増減
  • llmcord@jakobdylanc

    DiscordをLLMのフロントエンドにする - OpenAI互換API(OpenRouter、Ollamaなど)をサポート

    830+4直近 7 日のスター増減
  • BambooAI@pgalko

    LLM(大規模言語モデル)を活用した、対話形式のデータ探索・分析用Pythonライブラリ。

    787+1直近 7 日のスター増減
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] LLM、VLM、動画生成モデルなどの大規模モデルを圧縮するための強力なツールキット

    747+4直近 7 日のスター増減
  • pegainfer@pegainfer-project

    純粋なRust + CUDAによるLLM推論エンジン — PyTorchなし、OpenAI互換、Qwen3からKimi-K2まで提供

    676+18直近 7 日のスター増減
  • vidur@microsoft

    LLM推論システム向けの正確、大規模、拡張可能なシミュレーター

    673+5直近 7 日のスター増減
  • efficientsam3@SimonZeng7108

    EfficientSAM3 は、プログレッシブ知識蒸留により SAM3 を軽量でエッジ向けのモデルに圧縮し、高速なプロンプト駆動型コンセプトのセグメンテーションとトラッキングを実現します。

    667+9直近 7 日のスター増減
  • FlashTTS@HuiResearch

    SparkTTS や OrpheusTTS などのモデルに基づき、高品質な中国語音声合成と音声クローンサービスを提供します。

    613+1直近 7 日のスター増減
  • RoboBrain@FlagOpen

    [CVPR 2025] RoboBrain: 抽象から具体までのロボット操作に向けた統合脳モデル。公式リポジトリ。

    564+0直近 7 日のスター増減
  • crater@raids-lab

    Crater は、クラウドネイティブな AI トレーニングおよび推論プラットフォームです。

    554+1直近 7 日のスター増減
  • vllm-playground@micytao

    vLLM サーバー(www.github.com/vllm-project/vllm)を管理・操作するためのモダンな Web インターフェース。GPU と CPU の両モードをサポートし、macOS Apple Silicon 向けの特別最適化や OpenShift/Kubernetes でのエんタープライズデプロイに対応しています。

    530+8直近 7 日のスター増減
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    519+14直近 7 日のスター増減
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    512直近 7 日のスター増減
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507直近 7 日のスター増減
  • vllm-cli@Chen-zexi

    vLLM を使用して LLM を提供するためのコマンドラインインターフェイスツール。

    505-1直近 7 日のスター増減
← トピック一覧に戻る