跳到主要內容
buildradar
Sign in
主題 · model-serving

model-serving

標記 model-serving 主題、收錄中的開源專案,依星數排序。

專案數
30
總星數
165,504
平均星數
5,517
佔比
0.01%

常跟 model-serving 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 model-serving 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • vllm@vllm-project

    高吞吐量且記憶體效率高的 LLM 推理與服務引擎

    90,817+402近 7 天星數變化
  • BentoML@bentoml

    最簡便的 AI 應用與模型服務方式 ─ 建立模型推論 API、工作佇列、LLM 應用、多模型流水線等

    8,817+4近 7 天星數變化
  • vllm-omni@vllm-project

    高效模型推理框架,支援全模態模型

    6,593+136近 7 天星數變化
  • kserve@kserve

    標準化的分散式生成式與預測式 AI 推論平台,支援在 Kubernetes 上以多框架擴展部署

    5,853+13近 7 天星數變化
  • Olares@beclab

    開源個人雲端作業系統,為始終在線代理設計

    5,246+3近 7 天星數變化
  • 本倉庫將分享有關將深度學習模型部署到生產環境的實用筆記與參考資料。

    4,376+0近 7 天星數變化
  • 🚀 Awesome System for Machine Learning ⚡️ AI System Papers and Industry Practice. ⚡️ System for Machine Learning, LLM (Large Language Model), GenAI (Generative AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys, etc. 🗃️ Llama3, Mistral, etc. 🧑‍💻 Video Tutorials.

    4,330+12近 7 天星數變化
  • LightLLM@ModelTC

    LightLLM 是一個基於 Python 的 LLM(大型語言模型)推理與服務框架,以輕量化設計、易於擴展與高速性能著稱

    4,260+9近 7 天星數變化
  • FedML@FedML-AI

    FEDML - 用於大規模分散式訓練、模型部署與聯邦學習的統一且具擴充性的機器學習函式庫。跨雲排程器 FEDML Launch 進一步支援在任何 GPU 雲端或地端叢集上執行任何 AI 任務。基於此函式庫建構的 TensorOpera AI (https://TensorOpera.ai) 是您的大規模生成式 AI 平台。

    4,062+1近 7 天星數變化
  • lorax@predibase

    可擴展至數千個微調LLM的Multi-LoRA推理伺服器

    3,827+1近 7 天星數變化
  • chitu@thu-pacman

    專注於高效、靈活與可用性的高性能大型語言模型推論框架。

    2,997-1近 7 天星數變化
  • vllm-ascend@vllm-project

    社群維護的 vLLM on Ascend 硬體外掛程式

    2,749+19近 7 天星數變化
  • openlake@openlake-project

    OpenLake 是一個高效能儲存引擎,用於實現高效的 LLM 推論與 GPU 訓練

    2,399+64近 7 天星數變化
  • envd@tensorchord

    🏕️ 適用於人類與 agents 的可重現開發環境

    2,227-1近 7 天星數變化
  • aici@microsoft

    AICI:將提示詞作為 (Wasm) 程式

    2,076+0近 7 天星數變化
  • mlrun@mlrun

    MLRun 是一個開源 MLOps 平台,用於在整個生命週期中快速構建與管理持續 ML 應用程式。MLRun 可整合至您的開發與 CI/CD 環境中,並自動化交付生產資料、ML 管道與線上應用程式。

    1,694+1近 7 天星數變化
  • kitops@kitops-ml

    來自 CNCF 的開源 DevOps 工具,用於將 AI/ML 模型、資料集、程式碼和組態打包並進行版本控制成 OCI Artifact。

    1,409+0近 7 天星數變化
  • rtp-llm@alibaba

    RTP-LLM:阿里巴巴針對多元應用打造的高效能 LLM 推論引擎。

    1,325+6近 7 天星數變化
  • hopsworks@logicalclocks

    Hopsworks - 具備特徵儲存庫的資料密集型 AI 平台

    1,304+1近 7 天星數變化
  • truss@basetenlabs

    在生產環境中提供 AI/ML 模型服務的最簡單方式

    1,199+3近 7 天星數變化
  • sglang-omni@sgl-project

    SGLang-Omni 為 TTS、ASR、語音與全能模型提供高效能服務。

    1,118+130近 7 天星數變化
  • Nanoflow@efeslab

    一個針對 LLM 打造、以高吞吐量為導向的高效能服務框架

    975+1近 7 天星數變化
  • model_server@openvinotoolkit

    為使用 OpenVINO™ 優化之模型所設計的可擴充推論伺服器

    925+5近 7 天星數變化
  • ZhiLight@zhihu

    針對 Llama 及其變體的高度最佳化 LLM 推論加速引擎。

    908+0近 7 天星數變化
  • mosec@mosecorg

    高效能的 ML 模型服務框架,提供動態批次處理與 CPU/GPU 管線,充分發效能。

    902+0近 7 天星數變化
  • ServerlessLLM@ServerlessLLM

    人人皆可使用的無伺服器 LLM 推論服務

    713+0近 7 天星數變化
  • timber@kossisoroyce

    針對傳統 ML 模型的 Ollama。能將 XGBoost、LightGBM、scikit-learn、CatBoost 與 ONNX 模型轉為原生 C99 推論程式碼的 AOT 編譯器。只需一個指令載入、一個指令提供服務。比 Python 推論快 336 倍。

    687+0近 7 天星數變化
  • pegainfer@pegainfer-project

    純 Rust + CUDA LLM 推論引擎 — 無需 PyTorch,相容 OpenAI,支援 Qwen3 至 Kimi-K2 服務

    677+14近 7 天星數變化
  • fastapi-ml-skeleton@eightBEC

    用於部署生產級機器學習模型的 FastAPI 骨架應用程式。

    603+0近 7 天星數變化
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506近 7 天星數變化
← 返回主題列表