Saltar al contenido principal
buildradar
Sign in
Tema · sglang

sglang

Repositorios de código abierto monitorizados etiquetados con sglang, ordenados por estrellas.

Repositorios
19
Estrellas totales
50.817
Estrellas de media
2675
Proporción
0,00%

Temas que aparecen con frecuencia junto a sglang en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con sglang.

  • Una hoja de ruta de 10 semanas, 30 minutos al día, para la inferencia y optimización de LLM. Incluye vLLM, SGLang, cuantización, decodificación especulativa y benchmarking.

    880
  • inference@xorbitsai

    Intercambia GPT por cualquier LLM cambiando una sola línea de código. Xinference te permite ejecutar modelos de código abierto, de voz y multimodales en la nube, localmente o en tu laptop, todo a través de una API de inferencia unificada y lista para producción.

    9537+9Variación de estrellas de los últimos 7 días
  • dynamo@ai-dynamo

    Un framework de servicio de inferencia distribuida a escala de centro de datos

    7952+44Variación de estrellas de los últimos 7 días
  • Mooncake@kvcache-ai

    Mooncake es la plataforma de servicio para Kimi, un servicio de LLM líder proporcionado por Moonshot AI.

    6470+40Variación de estrellas de los últimos 7 días
  • OpenClaw-RL@Gen-Verse

    OpenClaw-RL: Entrena cualquier agente simplemente hablando

    5665+7Variación de estrellas de los últimos 7 días
  • gpustack@gpustack

    Un administrador de clústeres de GPU para el servicio de modelos de IA de alto rendimiento (vLLM, SGLang) e instancias de GPU accesibles por SSH bajo demanda.

    5593+21Variación de estrellas de los últimos 7 días
  • local-studio@sybil-solutions

    Panel de control para VLLM, Sglang, llama.cpp y exllamav3.

    1749+7Variación de estrellas de los últimos 7 días
  • InferenceX@SemiAnalysisAI

    Plataforma de investigación de benchmarks de inferencia continua de código abierto — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 y próximamente™ TPUv6e/v7/Trainium2/3

    1613+33Variación de estrellas de los últimos 7 días
  • auto-round@intel

    Un algoritmo de cuantización SOTA para inferencia de LLM de bajo bit y alta precisión, optimizado para CPU/XPU/CUDA, con soporte para múltiples tipos de datos y compatibilidad total con vLLM, SGLang y Transformers.

    1599+8Variación de estrellas de los últimos 7 días
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD es un modelo de generación de diálogos hablados diseñado para la síntesis expresiva de múltiples hablantes. Cuenta con modelado de contexto largo, control flexible de hablantes y soporte multilingüe, al tiempo que permite la clonación de voz zero-shot a partir de referencias de audio cortas.

    1394+4Variación de estrellas de los últimos 7 días
  • kvcached@ovg-project

    Caché KV elástica virtualizada para el uso compartido dinámico de GPU y más.

    1275+130Variación de estrellas de los últimos 7 días
  • GPTQModel@ModelCloud

    Kit de herramientas de cuantización (compresión) de modelos LLM con soporte de aceleración por hardware para GPU Nvidia, AMD, Intel y CPU Intel/AMD/Apple a través de HF, vLLM y SGLang.

    1248+0Variación de estrellas de los últimos 7 días
  • SpecForge@sgl-project

    Entrena modelos de decodificación especulativa sin esfuerzo y transpórtalos fácilmente al servicio SGLang.

    1144+14Variación de estrellas de los últimos 7 días
  • MOVA@OpenMOSS

    MOVA: Hacia la generación de video y audio escalable y sincronizada

    1108+3Variación de estrellas de los últimos 7 días
  • sglang-omni@sgl-project

    SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.

    1105+130Variación de estrellas de los últimos 7 días
  • UniRL@Tencent-Hunyuan

    UniRL es un framework para el aprendizaje por refuerzo de modelos multimodales unificados.

    933+15Variación de estrellas de los últimos 7 días
  • Una hoja de ruta de 10 semanas, 30 minutos al día, para la inferencia y optimización de LLM. Incluye vLLM, SGLang, cuantización, decodificación especulativa y benchmarking.

    880+76Variación de estrellas de los últimos 7 días
  • FlashTTS@HuiResearch

    Servicio de síntesis de voz y clonación de voz en chino de alta calidad, basado en modelos como SparkTTS y OrpheusTTS.

    613+1Variación de estrellas de los últimos 7 días
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    510Variación de estrellas de los últimos 7 días
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506Variación de estrellas de los últimos 7 días
← Volver a temas