serving
Repositorios de código abierto monitorizados etiquetados con serving, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a serving en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con serving.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Ray es un motor de cómputo para IA. Consta de un entorno de ejecución distribuido central y un conjunto de librerías de IA para acelerar las cargas de trabajo de ML.
★ 43.647+70Variación de estrellas de los últimos 7 días - #2
Un sistema de servicio flexible y de alto rendimiento para modelos de aprendizaje automático
★ 6360+0Variación de estrellas de los últimos 7 días - #3★ 5907+30Variación de estrellas de los últimos 7 días
- #4
Un framework MLOps para empaquetar, implementar, monitorear y gestionar miles de modelos de aprendizaje automático en producción
★ 4779+3Variación de estrellas de los últimos 7 días - #5
Aprende el sistema de inferencia de LLM en Apple Silicon para ingenieros de sistemas: construye un pequeño vLLM + Qwen
★ 4529+17Variación de estrellas de los últimos 7 días - #6
En este repositorio compartiré algunas notas y referencias útiles sobre el despliegue de modelos basados en aprendizaje profundo en producción.
★ 4376+1Variación de estrellas de los últimos 7 días - #7
Un framework minimalista de Python para crear servidores de inferencia de IA personalizados con control total sobre la lógica, el procesamiento por lotes y el escalado.
★ 3933+4Variación de estrellas de los últimos 7 días - #8
Toolkit de inferencia y despliegue de alto rendimiento para LLMs y VLMs basado en PaddlePaddle
★ 3711+2Variación de estrellas de los últimos 7 días - #9
Una guía completa para construir aplicaciones LLM basadas en RAG para producción.
★ 1856+0Variación de estrellas de los últimos 7 días - #10
Una base de datos vectorial multimodal que admite inserciones y consultas vectoriales mediante SQL unificado (compatible con MySQL) en datos estructurados y no estructurados, cumpliendo con los requisitos de alta concurrencia y latencia ultrabaja.
★ 1701+0Variación de estrellas de los últimos 7 días - #11
Un contenedor flexible y de alto rendimiento para modelos de aprendizaje automático (framework de despliegue de servicios PaddlePaddle)
★ 925+1Variación de estrellas de los últimos 7 días - #12
Un servidor de inferencia escalable para modelos optimizados con OpenVINO™.
★ 921+3Variación de estrellas de los últimos 7 días - #13
Servicio de despliegue genérico y fácil de usar para modelos de aprendizaje automático.
★ 757+0Variación de estrellas de los últimos 7 días - #14★ 548+1Variación de estrellas de los últimos 7 días