Zum Hauptinhalt springen
buildradar
Sign in
Thema · model-serving

model-serving

Erfasste Open-Source-Repos mit dem Tag model-serving, sortiert nach Sternen.

Repos
30
Sterne gesamt
164.226
Sterne im Schnitt
5.474
Anteil
0,01%

Themen, die häufig gemeinsam mit model-serving am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit model-serving getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • vllm@vllm-project

    Ein hocheffizientes und speichereffizientes Inferenz- und Serving-Engine für LLMs

    90.415+745Sterne-Änderung der letzten 7 Tage
  • BentoML@bentoml

    Der einfachste Weg, KI-Apps und -Modelle bereitzustellen – Erstellen Sie Modell-Inferenz-APIs, Job-artige Warteschlangen, LLM-Apps, Multi-Modell-Pipelines und mehr!

    8.813+18Sterne-Änderung der letzten 7 Tage
  • vllm-omni@vllm-project

    Ein Framework für effiziente Modellinferenz mit Omnimodalitätsmodellen

    6.457+229Sterne-Änderung der letzten 7 Tage
  • kserve@kserve

    Standardisierte, verteilte generative und prädiktive KI-Inferenzplattform für skalierbare Bereitstellungen mit mehreren Frameworks auf Kubernetes

    5.840+25Sterne-Änderung der letzten 7 Tage
  • Olares@beclab

    Open-Source-Personal-Cloud-OS für Always-On-Agenten

    5.243+10Sterne-Änderung der letzten 7 Tage
  • In diesem Repository teile ich nützliche Notizen und Referenzen zur Bereitstellung von Modellen für Deep Learning in der Produktion.

    4.376+1Sterne-Änderung der letzten 7 Tage
  • 🚀 Awesome System for Machine Learning ⚡️ KI-System-Papers und Praxis in der Industrie. ⚡️ Systeme für Machine Learning, LLM (Large Language Model), GenAI (Generative AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys usw. 🗃️ Llama3, Mistral usw. 🧑‍💻 Video-Tutorials.

    4.318+27Sterne-Änderung der letzten 7 Tage
  • LightLLM@ModelTC

    LightLLM ist ein Python-basiertes LLM-Inferenz- und Bereitstellungsframework, das sich durch ein leichtgewichtigenes Design, einfache Skalierbarkeit und hohe Leistung auszeichnet.

    4.251+21Sterne-Änderung der letzten 7 Tage
  • FedML@FedML-AI

    FEDML - Die vereinheitlichte und skalierbare ML-Bibliothek für verteiltes Training im großen Maßstab, Modellbereitstellung und föderiertes Lernen. FEDML Launch, ein Cloud-übergreifender Scheduler, ermöglicht zudem die Ausführung beliebiger KI-Jobs auf jeder GPU-Cloud oder jedem On-Premise-Cluster. Basierend auf dieser Bibliothek ist TensorOpera AI (https://TensorOpera.ai) Ihre generative KI-Plattform im großen Maßstab.

    4.061-1Sterne-Änderung der letzten 7 Tage
  • lorax@predibase

    Multi-LoRA-Inferenzserver, der auf Tausende von feinabgestimmten LLMs skaliert

    3.826-2Sterne-Änderung der letzten 7 Tage
  • chitu@thu-pacman

    Hochleistungs-Inferenz-Framework für große Sprachmodelle, mit Fokus auf Effizienz, Flexibilität und Verfügbarkeit.

    2.998+5Sterne-Änderung der letzten 7 Tage
  • vllm-ascend@vllm-project

    Von der Community gepflegtes Hardware-Plugin für vLLM auf Ascend

    2.730+53Sterne-Änderung der letzten 7 Tage
  • openlake@openlake-project

    OpenLake ist eine hochleistungsfähige Speicherengine für effiziente LLM-Inferenz und GPU-Training

    2.346+9Sterne-Änderung der letzten 7 Tage
  • envd@tensorchord

    🏕️ Reproduzierbare Entwicklungsumgebung für Menschen und Agenten

    2.227+3Sterne-Änderung der letzten 7 Tage
  • aici@microsoft

    AICI: Prompts als (Wasm)-Programme

    2.076+0Sterne-Änderung der letzten 7 Tage
  • mlrun@mlrun

    MLRun ist eine Open-Source-MLOps-Plattform zum schnellen Erstellen und Verwalten kontinuierlicher ML-Anwendungen über ihren gesamten Lebenszyklus. MLRun lässt sich in Ihre Entwicklungs- und CI/CD-Umgebung integrieren und automatisiert die Bereitstellung von Produktionsdaten, ML-Pipelines und Online-Anwendungen.

    1.694+0Sterne-Änderung der letzten 7 Tage
  • kitops@kitops-ml

    Ein Open-Source-DevOps-Tool der CNCF zum Paketieren und Versionieren von KI/ML-Modellen, Datensätzen, Code und Konfigurationen in ein OCI-Artefakt.

    1.409+5Sterne-Änderung der letzten 7 Tage
  • rtp-llm@alibaba

    RTP-LLM: Alibabas leistungsstarke LLM-Inferenz-Engine für vielfältige Anwendungen.

    1.320+6Sterne-Änderung der letzten 7 Tage
  • hopsworks@logicalclocks

    Hopsworks – Datenintensive KI-Plattform mit einem Feature Store

    1.303+1Sterne-Änderung der letzten 7 Tage
  • truss@basetenlabs

    Der einfachste Weg, KI/ML-Modelle in der Produktion bereitzustellen.

    1.196+1Sterne-Änderung der letzten 7 Tage
  • sglang-omni@sgl-project

    SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.

    978+70Sterne-Änderung der letzten 7 Tage
  • Nanoflow@efeslab

    Ein durchsatzorientiertes Hochleistungs-Serving-Framework für LLMs

    974+0Sterne-Änderung der letzten 7 Tage
  • model_server@openvinotoolkit

    Skalierbarer Inferenz-Server für mit OpenVINO™ optimierte Modelle.

    921+3Sterne-Änderung der letzten 7 Tage
  • ZhiLight@zhihu

    Eine hochoptimierte LLM-Inferenz-Beschleunigungs-Engine für Llama und dessen Varianten.

    908+0Sterne-Änderung der letzten 7 Tage
  • mosec@mosecorg

    Ein Hochleistungs-Framework für die Bereitstellung von ML-Modellen mit dynamischem Batching und CPU/GPU-Pipelines zur vollständigen Ausnutzung Ihrer Rechenmaschine

    902+0Sterne-Änderung der letzten 7 Tage
  • ServerlessLLM@ServerlessLLM

    Serverloses LLM-Hosting für alle.

    711+6Sterne-Änderung der letzten 7 Tage
  • timber@kossisoroyce

    Ollama für klassische ML-Modelle. Ein AOT-Compiler, der XGBoost-, LightGBM-, scikit-learn-, CatBoost- und ONNX-Modelle in nativen C99-Inferenzcode umwandelt. Ein Befehl zum Laden, ein Befehl zum Bereitstellen. 336x schneller als Python-Inferenz.

    687-1Sterne-Änderung der letzten 7 Tage
  • pegainfer@pegainfer-project

    Reines Rust + CUDA LLM-Inferenz-Engine — kein PyTorch, OpenAI-kompatibel, bedient Qwen3 bis Kimi-K2

    660+4Sterne-Änderung der letzten 7 Tage
  • fastapi-ml-skeleton@eightBEC

    FastAPI-Grundgerüst für die produktionsreife Bereitstellung von Machine-Learning-Modellen.

    603-1Sterne-Änderung der letzten 7 Tage
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    502Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen