Saltar al contenido principal
buildradar
Sign in
Propietario · vllm-project

vllm-project

Repositorios de código abierto monitorizados de vllm-project, ordenados por estrellas.

11 repositorios
  • vllm@vllm-project

    Un motor de inferencia y servicio de alto rendimiento y eficiente en memoria para LLMs

    90.817+647Variación de estrellas de los últimos 7 días
  • vllm-omni@vllm-project

    Un framework para la inferencia eficiente de modelos omnimodales.

    6593+216Variación de estrellas de los últimos 7 días
  • semantic-router@vllm-project

    Un enrutador programable de mezcla de modelos (Mixture-of-Models) para inferencia de LLM heterogénea

    5506+182Variación de estrellas de los últimos 7 días
  • aibrix@vllm-project

    Componentes de infraestructura rentables y acoplables para la inferencia de GenAI

    5053+15Variación de estrellas de los últimos 7 días
  • llm-compressor@vllm-project

    Librería compatible con Transformers para aplicar varios algoritmos de compresión a LLMs para un despliegue optimizado con vLLM

    3753+26Variación de estrellas de los últimos 7 días
  • vllm-ascend@vllm-project

    Plugin de hardware mantenido por la comunidad para vLLM en Ascend

    2749+31Variación de estrellas de los últimos 7 días
  • production-stack@vllm-project

    El sistema de referencia de vLLM para despliegues a nivel de clúster nativos de K8S con optimización de rendimiento impulsada por la comunidad

    2550+24Variación de estrellas de los últimos 7 días
  • vllm-metal@vllm-project

    Complemento de hardware para vLLM en Apple Silicon mantenido por la comunidad.

    1679+31Variación de estrellas de los últimos 7 días
  • guidellm@vllm-project

    Evalúa y mejora tus despliegues de LLM para necesidades de inferencia en el mundo real.

    1573+24Variación de estrellas de los últimos 7 días
  • recipes@vllm-project

    Recetas comunes para ejecutar vLLM

    1008+12Variación de estrellas de los últimos 7 días
  • speculators@vllm-project

    Una biblioteca unificada para construir, evaluar y almacenar algoritmos de decodificación especulativa para la inferencia de LLM en vLLM.

    807+27Variación de estrellas de los últimos 7 días
← Volver al ranking de propietarios