Aller au contenu principal
buildradar
Sign in
Sujet · sglang

sglang

Dépôts open source suivis étiquetés sglang, triés par étoiles.

Dépôts
19
Total d'étoiles
50 817
Étoiles en moyenne
2 675
Part
0,00%

Sujets qui apparaissent souvent aux côtés de sglang sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés sglang.

  • Feuille de route de 10 semaines, à raison de 30 minutes par jour, sur l'inférence et l'optimisation de LLM : vLLM, SGLang, quantification, décodage spéculatif et benchmarking.

    881
  • inference@xorbitsai

    Remplacez GPT par n'importe quel LLM en changeant une seule ligne de code. Xinference vous permet d'exécuter des modèles open source, vocaux et multimodaux sur le cloud, en local ou sur votre ordinateur portable, le tout via une API d'inférence unifiée et prête pour la production.

    9 537+9Évolution des étoiles sur les 7 derniers jours
  • dynamo@ai-dynamo

    Un framework de service d'inférence distribué à l'échelle du centre de données.

    7 952+44Évolution des étoiles sur les 7 derniers jours
  • Mooncake@kvcache-ai

    Mooncake est la plateforme de service pour Kimi, un service LLM de premier plan fourni par Moonshot AI.

    6 470+40Évolution des étoiles sur les 7 derniers jours
  • OpenClaw-RL@Gen-Verse

    OpenClaw-RL : Entraînez n'importe quel agent simplement par la parole.

    5 665+7Évolution des étoiles sur les 7 derniers jours
  • gpustack@gpustack

    Un gestionnaire de cluster GPU pour le service de modèles d'IA haute performance (vLLM, SGLang) et des instances GPU accessibles par SSH à la demande.

    5 593+21Évolution des étoiles sur les 7 derniers jours
  • local-studio@sybil-solutions

    Panneau de contrôle pour VLLM, Sglang, llama.cpp, exllamav3

    1 749+7Évolution des étoiles sur les 7 derniers jours
  • InferenceX@SemiAnalysisAI

    Plateforme de recherche de benchmark d'inférence continue open source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 et bientôt™ TPUv6e/v7/Trainium2/3

    1 613+33Évolution des étoiles sur les 7 derniers jours
  • auto-round@intel

    Un algorithme de quantification SOTA pour l'inférence LLM basse précision haute précision, optimisé pour CPU/XPU/CUDA, avec support multi-type et compatibilité totale avec vLLM, SGLang et Transformers.

    1 599+8Évolution des étoiles sur les 7 derniers jours
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD est un modèle de génération de dialogue parlé conçu pour la synthèse expressive multi-locuteur. Il propose une modélisation de contexte long, un contrôle flexible du locuteur et un support multilingue, tout en permettant le clonage vocal zero-shot à partir de courtes références audio.

    1 394+4Évolution des étoiles sur les 7 derniers jours
  • kvcached@ovg-project

    Cache KV élastique virtualisé pour le partage dynamique de GPU et au-delà

    1 275+130Évolution des étoiles sur les 7 derniers jours
  • GPTQModel@ModelCloud

    Boîte à outils de quantification (compression) de modèles LLM avec accélération matérielle pour GPU Nvidia, AMD, Intel et CPU Intel/AMD/Apple via HF, vLLM et SGLang.

    1 248+0Évolution des étoiles sur les 7 derniers jours
  • SpecForge@sgl-project

    Entraînez facilement des modèles de décodage spéculatif et portez-les en douceur vers le service SGLang.

    1 144+14Évolution des étoiles sur les 7 derniers jours
  • sglang-omni@sgl-project

    SGLang-Omni permet un service haute performance pour les modèles TTS, ASR, vocaux et omnimodaux.

    1 118+130Évolution des étoiles sur les 7 derniers jours
  • MOVA@OpenMOSS

    MOVA : Vers une génération vidéo-audio évolutive et synchronisée

    1 110+3Évolution des étoiles sur les 7 derniers jours
  • UniRL@Tencent-Hunyuan

    UniRL est un framework pour l'apprentissage par renforcement de modèles multimodaux unifiés.

    935+15Évolution des étoiles sur les 7 derniers jours
  • Feuille de route de 10 semaines, à raison de 30 minutes par jour, sur l'inférence et l'optimisation de LLM : vLLM, SGLang, quantification, décodage spéculatif et benchmarking.

    881+76Évolution des étoiles sur les 7 derniers jours
  • FlashTTS@HuiResearch

    Basé sur des modèles tels que SparkTTS et OrpheusTTS, ce service fournit une synthèse vocale en chinois de haute qualité et un clonage de voix.

    613+1Évolution des étoiles sur les 7 derniers jours
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    510Évolution des étoiles sur les 7 derniers jours
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets