跳到主要內容
buildradar
Sign in
主題 · llm-serving

llm-serving

標記 llm-serving 主題、收錄中的開源專案,依星數排序。

專案數
25
總星數
244,794
平均星數
9,792
佔比
0.01%

常跟 llm-serving 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 llm-serving 主題的專案。

  • kaggle-tpu-lab@ARahim3

    Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.

    146
  • vllm@vllm-project

    高吞吐量且記憶體效率高的 LLM 推理與服務引擎

    90,817+402近 7 天星數變化
  • ray@ray-project

    Ray 是一個 AI 計算引擎,包含核心分散式執行環境與加速機器學習工作負載的 AI 函式庫套件

    43,688+41近 7 天星數變化
  • llm-action@liguodongiot

    本項目旨在分享大模型相關技術原理以及實戰經驗(大模型工程化、大模型應用落地)

    24,995+21近 7 天星數變化
  • TensorRT-LLM@NVIDIA

    TensorRT LLM 為使用者提供易於使用的 Python API 來定義大型語言模型(LLM),並支援最先進的最佳化,以在 NVIDIA GPU 上高效執行推論。TensorRT LLM 亦包含建立 Python 與 C++ 執行環境的元件,以高效方式協調推論執行。

    14,536+38近 7 天星數變化
  • OpenLLM@bentoml

    在雲端將任何開源 LLM(如 DeepSeek、Llama)作為兼容 OpenAI 的 API 端點運行。

    12,524+1近 7 天星數變化
  • skypilot@skypilot-org

    前沿團隊的 AI 計算平台。SkyPilot 將分散的 AI 計算整合為一台 AI 超級電腦,讓前沿 AI 團隊更快構建自訂智慧

    10,550+16近 7 天星數變化
  • BentoML@bentoml

    最簡便的 AI 應用與模型服務方式 ─ 建立模型推論 API、工作佇列、LLM 應用、多模型流水線等

    8,817+4近 7 天星數變化
  • gpustack@gpustack

    一個 GPU 叢集管理器,用於高效能 AI 模型服務(vLLM、SGLang)以及按需可 SSH 存取的 GPU 實例。

    5,593+21近 7 天星數變化
  • superduper@superduper-io

    Superduper:端到端框架,用於構建自訂 AI 應用與代理

    5,318+1近 7 天星數變化
  • lorax@predibase

    可擴展至數千個微調LLM的Multi-LoRA推理伺服器

    3,827+1近 7 天星數變化
  • FastDeploy@PaddlePaddle

    基於 PaddlePaddle 的高效 LLM 與 VLM 推理與部署工具包

    3,714+3近 7 天星數變化
  • chitu@thu-pacman

    專注於高效、靈活與可用性的高性能大型語言模型推論框架。

    2,997-1近 7 天星數變化
  • vllm-ascend@vllm-project

    社群維護的 vLLM on Ascend 硬體外掛程式

    2,749+19近 7 天星數變化
  • MoBA@MoonshotAI

    MoBA:長文本 LLM 的區塊注意力混合模型

    2,174+1近 7 天星數變化
  • aici@microsoft

    AICI:將提示詞作為 (Wasm) 程式

    2,076+0近 7 天星數變化
  • InferenceX@SemiAnalysisAI

    開源持續推論基準研究平台 — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & 即將推出™ TPUv6e/v7/Trainium2/3

    1,613+33近 7 天星數變化
  • parallax@GradientHQ

    Parallax 是一個分散式模型服務框架,讓您隨處建構自己的 AI 叢集

    1,372+4近 7 天星數變化
  • rtp-llm@alibaba

    RTP-LLM:阿里巴巴針對多元應用打造的高效能 LLM 推論引擎。

    1,325+6近 7 天星數變化
  • kvcached@ovg-project

    用於動態 GPU 共用及更高應用的虛擬化彈性 KV 快取

    1,275+130近 7 天星數變化
  • Nanoflow@efeslab

    一個針對 LLM 打造、以高吞吐量為導向的高效能服務框架

    975+1近 7 天星數變化
  • ZhiLight@zhihu

    針對 Llama 及其變體的高度最佳化 LLM 推論加速引擎。

    908+0近 7 天星數變化
  • mosec@mosecorg

    高效能的 ML 模型服務框架,提供動態批次處理與 CPU/GPU 管線,充分發效能。

    902+0近 7 天星數變化
  • helix@helixml

    具備規格編碼的私有代理艦隊。每個代理皆擁有專屬的 GPU 加速桌面,可在完整的私有 AI 堆疊上執行 Claude、Codex、Gemini 及開放模型

    805+2近 7 天星數變化
  • pegainfer@pegainfer-project

    純 Rust + CUDA LLM 推論引擎 — 無需 PyTorch,相容 OpenAI,支援 Qwen3 至 Kimi-K2 服務

    676+18近 7 天星數變化
  • LLM-FineTuning-Large-Language-Models@rohan-paul

    LLM (大型語言模型) 微調

    579+1近 7 天星數變化
← 返回主題列表