मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · sglang

sglang

sglang टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
19
कुल स्टार
50,817
औसत स्टार
2,675
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर sglang के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और sglang टैग वाली रिपॉजिटरी।

  • LLM इन्फरेंस सर्विंग और ऑप्टिमाइज़ेशन के लिए 10-सप्ताह, 30-मिनट-प्रति-दिन का रोडमैप। vLLM, SGLang, क्वांटाइज़ेशन, स्पेक्युलेटिव डिकोडिंग, बेंचमार्किंग।

    880
  • inference@xorbitsai

    कोड की एक ही लाइन बदलकर किसी भी LLM के लिए GPT को स्वैप करें। Xinference आपको क्लाउड, ऑन-प्रिमाइस या अपने लैपटॉप पर ओपन-सोर्स, स्पीच और मल्टीमॉडल मॉडल चलाने की अनुमति देता है — यह सब एक एकीकृत, प्रोडक्शन-रेडी इन्फेरेंस API के माध्यम से।

    9,537+9पिछले 7 दिनों में स्टार का बदलाव
  • dynamo@ai-dynamo

    एक डेटासेंटर स्केल डिस्ट्रिब्यूटेड इन्फेरेंस सर्विंग फ़्रेमवर्क

    7,952+44पिछले 7 दिनों में स्टार का बदलाव
  • Mooncake@kvcache-ai

    Mooncake, Kimi के लिए सर्विंग प्लेटफ़ॉर्म है, जो Moonshot AI द्वारा प्रदान की जाने वाली एक अग्रणी LLM सेवा है।

    6,470+40पिछले 7 दिनों में स्टार का बदलाव
  • OpenClaw-RL@Gen-Verse

    OpenClaw-RL: बस बात करके किसी भी एजेंट को प्रशिक्षित करें

    5,665+7पिछले 7 दिनों में स्टार का बदलाव
  • gpustack@gpustack

    हाई-परफॉरमेंस AI मॉडल सर्विंग (vLLM, SGLang) और ऑन-डिमांड SSH-एक्सेसिबल GPU इंस्टेंस के लिए एक GPU क्लस्टर मैनेजर।

    5,593+21पिछले 7 दिनों में स्टार का बदलाव
  • local-studio@sybil-solutions

    VLLM, Sglang, llama.cpp, exllamav3 के लिए कंट्रोल पैनल

    1,749+7पिछले 7 दिनों में स्टार का बदलाव
  • InferenceX@SemiAnalysisAI

    ओपन सोर्स निरंतर अनुमान बेंचमार्क अनुसंधान प्लेटफ़ॉर्म — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 और जल्द ही™ TPUv6e/v7/Trainium2/3

    1,613+33पिछले 7 दिनों में स्टार का बदलाव
  • auto-round@intel

    उच्च-सटीकता वाले लो-बिट LLM अनुमान के लिए एक SOTA परिमाणीकरण एल्गोरिदम, जिसे CPU/XPU/CUDA के लिए सहज रूप से अनुकूलित किया गया है, मल्टी-डेटाटाइप समर्थन और vLLM, SGLang, और Transformers के साथ पूर्ण संगतता के साथ।

    1,599+8पिछले 7 दिनों में स्टार का बदलाव
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD एक स्पोकन डायलॉग जनरेशन मॉडल है जिसे expressive multi-speaker synthesis के लिए डिज़ाइन किया गया है। इसमें long-context modeling, flexible speaker control और multilingual support शामिल है, साथ ही यह छोटे ऑडियो संदर्भों से zero-shot voice cloning को सक्षम बनाता है।

    1,394+4पिछले 7 दिनों में स्टार का बदलाव
  • kvcached@ovg-project

    डायनेमिक GPU शेयरिंग और उससे आगे के लिए वर्चुअलाइज्ड इलास्टिक KV कैश

    1,275+130पिछले 7 दिनों में स्टार का बदलाव
  • GPTQModel@ModelCloud

    Nvidia, AMD, Intel GPU और Intel/AMD/Apple CPU के लिए HF, vLLM और SGLang के माध्यम से HW एक्सीलरेशन समर्थन के साथ LLM मॉडल क्वांटाइजेशन (कंप्रेशन) टूलकिट।

    1,248+0पिछले 7 दिनों में स्टार का बदलाव
  • SpecForge@sgl-project

    Speculative decoding मॉडल को आसानी से ट्रेन करें और उन्हें SGLang सर्विंग में सुचारू रूप से पोर्ट करें।

    1,144+14पिछले 7 दिनों में स्टार का बदलाव
  • MOVA@OpenMOSS

    MOVA: स्केलेबल और सिंक्रोनाइज़्ड वीडियो-ऑडियो जनरेशन की दिशा में

    1,108+3पिछले 7 दिनों में स्टार का बदलाव
  • sglang-omni@sgl-project

    SGLang-Omni, TTS, ASR, स्पीच और ओम्नी मॉडल के लिए उच्च-प्रदर्शन सर्विंग को सक्षम बनाता है।

    1,105+130पिछले 7 दिनों में स्टार का बदलाव
  • UniRL@Tencent-Hunyuan

    UniRL यूनिफाइड मल्टीमॉडल मॉडल रीइन्फोर्समेंट लर्निंग के लिए एक फ्रेमवर्क है

    933+15पिछले 7 दिनों में स्टार का बदलाव
  • LLM इन्फरेंस सर्विंग और ऑप्टिमाइज़ेशन के लिए 10-सप्ताह, 30-मिनट-प्रति-दिन का रोडमैप। vLLM, SGLang, क्वांटाइज़ेशन, स्पेक्युलेटिव डिकोडिंग, बेंचमार्किंग।

    880+76पिछले 7 दिनों में स्टार का बदलाव
  • FlashTTS@HuiResearch

    SparkTTS, OrpheusTTS आदि मॉडल के आधार पर, उच्च गुणवत्ता वाली चीनी वाक् संश्लेषण और ध्वनि क्लोनिंग सेवाएँ प्रदान करता है।

    613+1पिछले 7 दिनों में स्टार का बदलाव
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    510पिछले 7 दिनों में स्टार का बदलाव
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस