Saltar al contenido principal
buildradar
Sign in
Tema · model-serving

model-serving

Repositorios de código abierto monitorizados etiquetados con model-serving, ordenados por estrellas.

Repositorios
30
Estrellas totales
164.226
Estrellas de media
5474
Proporción
0,01%

Temas que aparecen con frecuencia junto a model-serving en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con model-serving.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • vllm@vllm-project

    Un motor de inferencia y servicio de alto rendimiento y eficiente en memoria para LLMs

    90.415+745Variación de estrellas de los últimos 7 días
  • BentoML@bentoml

    La forma más sencilla de servir aplicaciones y modelos de IA: ¡crea APIs de inferencia de modelos, colas de trabajos, aplicaciones LLM, pipelines de múltiples modelos y más!

    8813+18Variación de estrellas de los últimos 7 días
  • vllm-omni@vllm-project

    Un framework para la inferencia eficiente de modelos omnimodales.

    6457+229Variación de estrellas de los últimos 7 días
  • kserve@kserve

    Plataforma de inferencia de IA generativa y predictiva distribuida estandarizada para despliegue escalable y multi-framework en Kubernetes

    5840+25Variación de estrellas de los últimos 7 días
  • Olares@beclab

    Sistema operativo de nube personal de código abierto para agentes siempre activos

    5243+10Variación de estrellas de los últimos 7 días
  • En este repositorio compartiré algunas notas y referencias útiles sobre el despliegue de modelos basados en aprendizaje profundo en producción.

    4376+1Variación de estrellas de los últimos 7 días
  • Sistema integral para Machine Learning, artículos académicos y prácticas industriales sobre sistemas de IA, LLM y GenAI. Incluye recursos de conferencias como OSDI, NSDI, SIGCOMM, SoCC, MLSys, modelos como Llama3 y Mistral, y tutoriales en video.

    4318+27Variación de estrellas de los últimos 7 días
  • LightLLM@ModelTC

    LightLLM es un framework de inferencia y servicio de LLM (Large Language Model) basado en Python, destacado por su diseño ligero, fácil escalabilidad y rendimiento de alta velocidad.

    4251+21Variación de estrellas de los últimos 7 días
  • FedML@FedML-AI

    FEDML: la biblioteca de ML unificada y escalable para entrenamiento distribuido a gran escala, servicio de modelos y aprendizaje federado. FEDML Launch, un programador multinube, permite además ejecutar cualquier tarea de IA en cualquier nube de GPU o clúster local. Basada en esta biblioteca, TensorOpera AI (https://TensorOpera.ai) es tu plataforma de IA generativa a escala.

    4061-1Variación de estrellas de los últimos 7 días
  • lorax@predibase

    Servidor de inferencia multi-LoRA que se escala a miles de LLM ajustados

    3826-2Variación de estrellas de los últimos 7 días
  • chitu@thu-pacman

    Framework de inferencia de alto rendimiento para grandes modelos de lenguaje, enfocado en la eficiencia, flexibilidad y disponibilidad.

    2998+5Variación de estrellas de los últimos 7 días
  • vllm-ascend@vllm-project

    Plugin de hardware mantenido por la comunidad para vLLM en Ascend

    2730+53Variación de estrellas de los últimos 7 días
  • openlake@openlake-project

    OpenLake es un motor de almacenamiento de alto rendimiento para inferencia de LLM y entrenamiento de GPU eficientes

    2346+9Variación de estrellas de los últimos 7 días
  • envd@tensorchord

    🏕️ Entorno de desarrollo reproducible para humanos y agentes

    2227+3Variación de estrellas de los últimos 7 días
  • aici@microsoft

    AICI: Prompts como programas (Wasm)

    2076+0Variación de estrellas de los últimos 7 días
  • mlrun@mlrun

    MLRun es una plataforma MLOps de código abierto para construir y gestionar rápidamente aplicaciones de ML continuas a lo largo de su ciclo de vida. MLRun se integra en tu entorno de desarrollo y CI/CD, automatizando la entrega de datos de producción, pipelines de ML y aplicaciones en línea.

    1694+0Variación de estrellas de los últimos 7 días
  • kitops@kitops-ml

    Una herramienta DevOps de código abierto de la CNCF para empaquetar y versionar modelos de IA/ML, conjuntos de datos, código y configuraciones en un artefacto OCI.

    1409+5Variación de estrellas de los últimos 7 días
  • rtp-llm@alibaba

    RTP-LLM: motor de inferencia de LLM de alto rendimiento de Alibaba para diversas aplicaciones.

    1320+6Variación de estrellas de los últimos 7 días
  • hopsworks@logicalclocks

    Hopsworks: plataforma de IA intensiva en datos con un Feature Store

    1303+1Variación de estrellas de los últimos 7 días
  • truss@basetenlabs

    La forma más sencilla de servir modelos de IA/ML en producción.

    1196+1Variación de estrellas de los últimos 7 días
  • sglang-omni@sgl-project

    SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.

    978+70Variación de estrellas de los últimos 7 días
  • Nanoflow@efeslab

    Un framework de servicio de alto rendimiento orientado al rendimiento para LLMs.

    974+0Variación de estrellas de los últimos 7 días
  • model_server@openvinotoolkit

    Un servidor de inferencia escalable para modelos optimizados con OpenVINO™.

    921+3Variación de estrellas de los últimos 7 días
  • ZhiLight@zhihu

    Un motor de aceleración de inferencia LLM altamente optimizado para Llama y sus variantes.

    908+0Variación de estrellas de los últimos 7 días
  • mosec@mosecorg

    Un framework de alto rendimiento para servir modelos de ML, que ofrece procesamiento por lotes dinámico y pipelines de CPU/GPU para aprovechar al máximo su equipo de cómputo

    902+0Variación de estrellas de los últimos 7 días
  • ServerlessLLM@ServerlessLLM

    Servicio de LLM sin servidor para todos.

    711+6Variación de estrellas de los últimos 7 días
  • timber@kossisoroyce

    Ollama para modelos de ML clásico. Compilador AOT que convierte modelos de XGBoost, LightGBM, scikit-learn, CatBoost y ONNX en código de inferencia C99 nativo. Un comando para cargar, un comando para servir. 336 veces más rápido que la inferencia en Python.

    687-1Variación de estrellas de los últimos 7 días
  • pegainfer@pegainfer-project

    Motor de inferencia LLM en Rust puro + CUDA; sin PyTorch, compatible con OpenAI, sirve desde Qwen3 hasta Kimi-K2

    667+4Variación de estrellas de los últimos 7 días
  • fastapi-ml-skeleton@eightBEC

    Esqueleto de aplicación FastAPI para servir modelos de aprendizaje automático listos para producción.

    603-1Variación de estrellas de los últimos 7 días
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    502Variación de estrellas de los últimos 7 días
← Volver a temas