sglang
Repositorios de código abierto monitorizados etiquetados con sglang, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a sglang en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con sglang.
- #1
Una hoja de ruta de 10 semanas, 30 minutos al día, para la inferencia y optimización de LLM. Incluye vLLM, SGLang, cuantización, decodificación especulativa y benchmarking.
★ 880
- #1
Intercambia GPT por cualquier LLM cambiando una sola línea de código. Xinference te permite ejecutar modelos de código abierto, de voz y multimodales en la nube, localmente o en tu laptop, todo a través de una API de inferencia unificada y lista para producción.
★ 9537+9Variación de estrellas de los últimos 7 días - #2★ 7952+44Variación de estrellas de los últimos 7 días
- #3
Mooncake es la plataforma de servicio para Kimi, un servicio de LLM líder proporcionado por Moonshot AI.
★ 6470+40Variación de estrellas de los últimos 7 días - #4
OpenClaw-RL: Entrena cualquier agente simplemente hablando
★ 5665+7Variación de estrellas de los últimos 7 días - #5
Un administrador de clústeres de GPU para el servicio de modelos de IA de alto rendimiento (vLLM, SGLang) e instancias de GPU accesibles por SSH bajo demanda.
★ 5593+21Variación de estrellas de los últimos 7 días - #6
Panel de control para VLLM, Sglang, llama.cpp y exllamav3.
★ 1749+7Variación de estrellas de los últimos 7 días - #7
Plataforma de investigación de benchmarks de inferencia continua de código abierto — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 y próximamente™ TPUv6e/v7/Trainium2/3
★ 1613+33Variación de estrellas de los últimos 7 días - #8
Un algoritmo de cuantización SOTA para inferencia de LLM de bajo bit y alta precisión, optimizado para CPU/XPU/CUDA, con soporte para múltiples tipos de datos y compatibilidad total con vLLM, SGLang y Transformers.
★ 1599+8Variación de estrellas de los últimos 7 días - #9
MOSS-TTSD es un modelo de generación de diálogos hablados diseñado para la síntesis expresiva de múltiples hablantes. Cuenta con modelado de contexto largo, control flexible de hablantes y soporte multilingüe, al tiempo que permite la clonación de voz zero-shot a partir de referencias de audio cortas.
★ 1394+4Variación de estrellas de los últimos 7 días - #10★ 1275+130Variación de estrellas de los últimos 7 días
- #11
Kit de herramientas de cuantización (compresión) de modelos LLM con soporte de aceleración por hardware para GPU Nvidia, AMD, Intel y CPU Intel/AMD/Apple a través de HF, vLLM y SGLang.
★ 1248+0Variación de estrellas de los últimos 7 días - #12
Entrena modelos de decodificación especulativa sin esfuerzo y transpórtalos fácilmente al servicio SGLang.
★ 1144+14Variación de estrellas de los últimos 7 días - #13★ 1108+3Variación de estrellas de los últimos 7 días
- #14
SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.
★ 1105+130Variación de estrellas de los últimos 7 días - #15
UniRL es un framework para el aprendizaje por refuerzo de modelos multimodales unificados.
★ 933+15Variación de estrellas de los últimos 7 días - #16
Una hoja de ruta de 10 semanas, 30 minutos al día, para la inferencia y optimización de LLM. Incluye vLLM, SGLang, cuantización, decodificación especulativa y benchmarking.
★ 880+76Variación de estrellas de los últimos 7 días - #17
Servicio de síntesis de voz y clonación de voz en chino de alta calidad, basado en modelos como SparkTTS y OrpheusTTS.
★ 613+1Variación de estrellas de los últimos 7 días - #18
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 510—Variación de estrellas de los últimos 7 días - #19
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—Variación de estrellas de los últimos 7 días