sglang
Dépôts open source suivis étiquetés sglang, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de sglang sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés sglang.
- #1
Feuille de route de 10 semaines, à raison de 30 minutes par jour, sur l'inférence et l'optimisation de LLM : vLLM, SGLang, quantification, décodage spéculatif et benchmarking.
★ 881
- #1
Remplacez GPT par n'importe quel LLM en changeant une seule ligne de code. Xinference vous permet d'exécuter des modèles open source, vocaux et multimodaux sur le cloud, en local ou sur votre ordinateur portable, le tout via une API d'inférence unifiée et prête pour la production.
★ 9 537+9Évolution des étoiles sur les 7 derniers jours - #2★ 7 952+44Évolution des étoiles sur les 7 derniers jours
- #3
Mooncake est la plateforme de service pour Kimi, un service LLM de premier plan fourni par Moonshot AI.
★ 6 470+40Évolution des étoiles sur les 7 derniers jours - #4
OpenClaw-RL : Entraînez n'importe quel agent simplement par la parole.
★ 5 665+7Évolution des étoiles sur les 7 derniers jours - #5
Un gestionnaire de cluster GPU pour le service de modèles d'IA haute performance (vLLM, SGLang) et des instances GPU accessibles par SSH à la demande.
★ 5 593+21Évolution des étoiles sur les 7 derniers jours - #6
Panneau de contrôle pour VLLM, Sglang, llama.cpp, exllamav3
★ 1 749+7Évolution des étoiles sur les 7 derniers jours - #7
Plateforme de recherche de benchmark d'inférence continue open source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 et bientôt™ TPUv6e/v7/Trainium2/3
★ 1 613+33Évolution des étoiles sur les 7 derniers jours - #8
Un algorithme de quantification SOTA pour l'inférence LLM basse précision haute précision, optimisé pour CPU/XPU/CUDA, avec support multi-type et compatibilité totale avec vLLM, SGLang et Transformers.
★ 1 599+8Évolution des étoiles sur les 7 derniers jours - #9
MOSS-TTSD est un modèle de génération de dialogue parlé conçu pour la synthèse expressive multi-locuteur. Il propose une modélisation de contexte long, un contrôle flexible du locuteur et un support multilingue, tout en permettant le clonage vocal zero-shot à partir de courtes références audio.
★ 1 394+4Évolution des étoiles sur les 7 derniers jours - #10★ 1 275+130Évolution des étoiles sur les 7 derniers jours
- #11
Boîte à outils de quantification (compression) de modèles LLM avec accélération matérielle pour GPU Nvidia, AMD, Intel et CPU Intel/AMD/Apple via HF, vLLM et SGLang.
★ 1 248+0Évolution des étoiles sur les 7 derniers jours - #12
Entraînez facilement des modèles de décodage spéculatif et portez-les en douceur vers le service SGLang.
★ 1 144+14Évolution des étoiles sur les 7 derniers jours - #13
SGLang-Omni permet un service haute performance pour les modèles TTS, ASR, vocaux et omnimodaux.
★ 1 118+130Évolution des étoiles sur les 7 derniers jours - #14★ 1 110+3Évolution des étoiles sur les 7 derniers jours
- #15
UniRL est un framework pour l'apprentissage par renforcement de modèles multimodaux unifiés.
★ 935+15Évolution des étoiles sur les 7 derniers jours - #16
Feuille de route de 10 semaines, à raison de 30 minutes par jour, sur l'inférence et l'optimisation de LLM : vLLM, SGLang, quantification, décodage spéculatif et benchmarking.
★ 881+76Évolution des étoiles sur les 7 derniers jours - #17
Basé sur des modèles tels que SparkTTS et OrpheusTTS, ce service fournit une synthèse vocale en chinois de haute qualité et un clonage de voix.
★ 613+1Évolution des étoiles sur les 7 derniers jours - #18
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 510—Évolution des étoiles sur les 7 derniers jours - #19
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—Évolution des étoiles sur les 7 derniers jours