मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · llm-serving

llm-serving

llm-serving टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
25
कुल स्टार
2,44,794
औसत स्टार
9,792
हिस्सा
0.01%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर llm-serving के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और llm-serving टैग वाली रिपॉजिटरी।

  • kaggle-tpu-lab@ARahim3

    Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.

    142
  • vllm@vllm-project

    LLM के लिए एक हाई-थ्रूपुट और मेमोरी-कुशल इन्फेरेंस और सर्विंग इंजन

    90,817+402पिछले 7 दिनों में स्टार का बदलाव
  • ray@ray-project

    Ray एक AI कंप्यूट इंजन है। Ray में ML वर्कलोड को तेज करने के लिए एक कोर डिस्ट्रिब्यूटेड रनटाइम और AI लाइब्रेरी का एक सेट शामिल है।

    43,688+41पिछले 7 दिनों में स्टार का बदलाव
  • llm-action@liguodongiot

    यह प्रोजेक्ट बड़े मॉडल से संबंधित तकनीकी सिद्धांतों और व्यावहारिक अनुभवों (बड़े मॉडल इंजीनियरिंग, बड़े मॉडल एप्लिकेशन लैंडिंग) को साझा करने के लिए है।

    24,995+21पिछले 7 दिनों में स्टार का बदलाव
  • TensorRT-LLM@NVIDIA

    TensorRT LLM उपयोगकर्ताओं को लार्ज लैंग्वेज मॉडल्स (LLMs) को परिभाषित करने के लिए एक उपयोग में आसान Python API प्रदान करता है और NVIDIA GPUs पर कुशलतापूर्वक इन्फरेंस करने के लिए अत्याधुनिक ऑप्टिमाइज़ेशन का समर्थन करता है। TensorRT LLM में Python और C++ रनटाइम बनाने के लिए घटक भी शामिल हैं जो इन्फरेंस निष्पादन को बेहतर तरीके से ऑर्केस्ट्रेट करते हैं।

    14,536+38पिछले 7 दिनों में स्टार का बदलाव
  • OpenLLM@bentoml

    क्लाउड में किसी भी ओपन-सोर्स LLM, जैसे DeepSeek और Llama, को OpenAI-संगत API एंडपॉइंट के रूप में चलाएं।

    12,524+1पिछले 7 दिनों में स्टार का बदलाव
  • skypilot@skypilot-org

    फ्रंटियर टीमों के लिए AI कंप्यूट प्लेटफॉर्म। SkyPilot बिखरे हुए AI कंप्यूट को एक AI सुपरकंप्यूटर में बदल देता है, जिससे फ्रंटियर AI टीमें तेजी से कस्टम इंटेलिजेंस बना सकती हैं।

    10,550+16पिछले 7 दिनों में स्टार का बदलाव
  • BentoML@bentoml

    AI ऐप्स और मॉडल सर्व करने का सबसे आसान तरीका - मॉडल इन्फेरेंस API, जॉब कतारें, LLM ऐप्स, मल्टी-मॉडल पाइपलाइन और बहुत कुछ बनाएँ!

    8,817+4पिछले 7 दिनों में स्टार का बदलाव
  • gpustack@gpustack

    हाई-परफॉरमेंस AI मॉडल सर्विंग (vLLM, SGLang) और ऑन-डिमांड SSH-एक्सेसिबल GPU इंस्टेंस के लिए एक GPU क्लस्टर मैनेजर।

    5,593+21पिछले 7 दिनों में स्टार का बदलाव
  • superduper@superduper-io

    Superduper: कस्टम AI एप्लिकेशन और एजेंटों के निर्माण के लिए एंड-टू-एंड फ्रेमवर्क।

    5,318+1पिछले 7 दिनों में स्टार का बदलाव
  • lorax@predibase

    मल्टी-LoRA इन्फेरेंस सर्वर जो हजारों फाइन-ट्यून्ड LLM तक स्केल करता है।

    3,827+1पिछले 7 दिनों में स्टार का बदलाव
  • FastDeploy@PaddlePaddle

    PaddlePaddle पर आधारित LLM और VLM के लिए उच्च-प्रदर्शन अनुमान और तैनाती टूलकिट

    3,714+3पिछले 7 दिनों में स्टार का बदलाव
  • chitu@thu-pacman

    बड़े भाषा मॉडल के लिए उच्च-प्रदर्शन अनुमान फ्रेमवर्क, जो दक्षता, लचीलेपन और उपलब्धता पर केंद्रित है।

    2,997-1पिछले 7 दिनों में स्टार का बदलाव
  • vllm-ascend@vllm-project

    Ascend पर vLLM के लिए सामुदायिक-रखरखाव वाला हार्डवेयर प्लगइन

    2,749+19पिछले 7 दिनों में स्टार का बदलाव
  • MoBA@MoonshotAI

    MoBA: लॉन्ग-कंटेक्स्ट LLMs के लिए मिक्सचर ऑफ ब्लॉक अटेंशन

    2,174+1पिछले 7 दिनों में स्टार का बदलाव
  • aici@microsoft

    AICI: (Wasm) प्रोग्राम्स के रूप में प्रॉम्प्ट्स

    2,076+0पिछले 7 दिनों में स्टार का बदलाव
  • InferenceX@SemiAnalysisAI

    ओपन सोर्स निरंतर अनुमान बेंचमार्क अनुसंधान प्लेटफ़ॉर्म — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 और जल्द ही™ TPUv6e/v7/Trainium2/3

    1,613+33पिछले 7 दिनों में स्टार का बदलाव
  • parallax@GradientHQ

    Parallax एक distributed model serving framework है जो आपको कहीं भी अपना स्वयं का AI cluster बनाने की अनुमति देता है

    1,372+4पिछले 7 दिनों में स्टार का बदलाव
  • rtp-llm@alibaba

    RTP-LLM: विभिन्न अनुप्रयोगों के लिए Alibaba का उच्च-प्रदर्शन LLM इन्फेरेंस इंजन।

    1,325+6पिछले 7 दिनों में स्टार का बदलाव
  • kvcached@ovg-project

    डायनेमिक GPU शेयरिंग और उससे आगे के लिए वर्चुअलाइज्ड इलास्टिक KV कैश

    1,275+130पिछले 7 दिनों में स्टार का बदलाव
  • Nanoflow@efeslab

    LLMs के लिए थ्रूपुट-उन्मुख उच्च-प्रदर्शन सर्विंग फ्रेमवर्क

    975+1पिछले 7 दिनों में स्टार का बदलाव
  • ZhiLight@zhihu

    Llama और उसके वेरिएंट्स के लिए एक अत्यधिक अनुकूलित LLM अनुमान त्वरण इंजन।

    908+0पिछले 7 दिनों में स्टार का बदलाव
  • mosec@mosecorg

    एक उच्च-प्रदर्शन ML मॉडल सर्विंग फ्रेमवर्क, जो आपके कंप्यूटिंग संसाधन का पूरी तरह से उपयोग करने के लिए गतिशील बैचिंग और CPU/GPU पाइपलाइन प्रदान करता है

    902+0पिछले 7 दिनों में स्टार का बदलाव
  • helix@helixml

    ♾️ स्पेक कोडिंग के साथ प्राइवेट एजेंट फ्लीट। प्रत्येक एजेंट को अपना GPU-त्वरित डेस्कटॉप मिलता है। पूर्ण प्राइवेट AI स्टैक पर Claude, Codex, Gemini और ओपन मॉडल चलाएं ♾️

    805+1पिछले 7 दिनों में स्टार का बदलाव
  • pegainfer@pegainfer-project

    Pure Rust + CUDA LLM इन्फरेंस इंजन — कोई PyTorch नहीं, OpenAI-compatible, Qwen3 से Kimi-K2 तक सर्व करता है

    677+14पिछले 7 दिनों में स्टार का बदलाव
  • LLM-FineTuning-Large-Language-Models@rohan-paul

    LLM (लार्ज लैंग्वेज मॉडल) फाइन-ट्यूनिंग

    579+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस