model-serving
model-serving टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर model-serving के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और model-serving टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1★ 90,817+402पिछले 7 दिनों में स्टार का बदलाव
- #2
AI ऐप्स और मॉडल सर्व करने का सबसे आसान तरीका - मॉडल इन्फेरेंस API, जॉब कतारें, LLM ऐप्स, मल्टी-मॉडल पाइपलाइन और बहुत कुछ बनाएँ!
★ 8,817+4पिछले 7 दिनों में स्टार का बदलाव - #3★ 6,593+136पिछले 7 दिनों में स्टार का बदलाव
- #4
Kubernetes पर स्केलेबल, मल्टी-फ़्रेमवर्क तैनाती के लिए मानकीकृत वितरित जनरेटिव और प्रेडिक्टिव AI इन्फेरेंस प्लेटफ़ॉर्म
★ 5,853+13पिछले 7 दिनों में स्टार का बदलाव - #5★ 5,246+3पिछले 7 दिनों में स्टार का बदलाव
- #6
इस रिपॉजिटरी में, मैं प्रोडक्शन में डीप लर्निंग-आधारित मॉडल को तैनात करने के बारे में कुछ उपयोगी नोट्स और संदर्भ साझा कर रहा हूँ।
★ 4,376+0पिछले 7 दिनों में स्टार का बदलाव - #7
🚀 मशीन लर्निंग के लिए शानदार सिस्टम ⚡️ AI सिस्टम पेपर्स और इंडस्ट्री प्रैक्टिस। ⚡️ मशीन लर्निंग, LLM (लार्ज लैंग्वेज मॉडल), GenAI (जेनरेटिव AI) के लिए सिस्टम। 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys, आदि। 🗃️ Llama3, Mistral, आदि। 🧑💻 वीडियो ट्यूटोरियल।
★ 4,330+12पिछले 7 दिनों में स्टार का बदलाव - #8
LightLLM एक Python-आधारित LLM (लार्ज लैंग्वेज मॉडल) अनुमान और सर्विंग फ्रेमवर्क है, जो अपने हल्के डिजाइन, आसान स्केलेबिलिटी और उच्च गति प्रदर्शन के लिए जाना जाता है।
★ 4,260+9पिछले 7 दिनों में स्टार का बदलाव - #9
FEDML - बड़े पैमाने पर वितरित प्रशिक्षण, मॉडल सर्विंग और फ़ेडरेटेड लर्निंग के लिए एकीकृत और स्केलेबल ML लाइब्रेरी। FEDML Launch, एक क्रॉस-क्लाउड शेड्यूलर, किसी भी GPU क्लाउड या ऑन-प्रिमाइसेस क्लस्टर पर किसी भी AI जॉब को चलाने में सक्षम बनाता है। इस लाइब्रेरी पर निर्मित, TensorOpera AI (https://TensorOpera.ai) बड़े पैमाने पर आपका जनरेटिव AI प्लेटफ़ॉर्म है।
★ 4,062+1पिछले 7 दिनों में स्टार का बदलाव - #10★ 3,827+1पिछले 7 दिनों में स्टार का बदलाव
- #11
बड़े भाषा मॉडल के लिए उच्च-प्रदर्शन अनुमान फ्रेमवर्क, जो दक्षता, लचीलेपन और उपलब्धता पर केंद्रित है।
★ 2,997-1पिछले 7 दिनों में स्टार का बदलाव - #12
Ascend पर vLLM के लिए सामुदायिक-रखरखाव वाला हार्डवेयर प्लगइन
★ 2,749+19पिछले 7 दिनों में स्टार का बदलाव - #13
OpenLake कुशल LLM इन्फेरेंस और GPU ट्रेनिंग के लिए एक उच्च-प्रदर्शन स्टोरेज इंजन है
★ 2,399+64पिछले 7 दिनों में स्टार का बदलाव - #14★ 2,227-1पिछले 7 दिनों में स्टार का बदलाव
- #15★ 2,076+0पिछले 7 दिनों में स्टार का बदलाव
- #16
MLRun एक ओपन सोर्स MLOps प्लेटफ़ॉर्म है जो अपने जीवनचक्र में निरंतर ML अनुप्रयोगों को तेज़ी से बनाने और प्रबंधित करने के लिए है। MLRun आपके विकास और CI/CD वातावरण में एकीकृत होता है और उत्पादन डेटा, ML पाइपलाइन और ऑनलाइन अनुप्रयोगों की डिलीवरी को स्वचालित करता है।
★ 1,694+1पिछले 7 दिनों में स्टार का बदलाव - #17
AI/ML मॉडल, डेटासेट, कोड और कॉन्फ़िगरेशन को OCI आर्टिफैक्ट में पैक और वर्शन करने के लिए CNCF का एक ओपन सोर्स DevOps टूल।
★ 1,409+0पिछले 7 दिनों में स्टार का बदलाव - #18★ 1,325+6पिछले 7 दिनों में स्टार का बदलाव
- #19★ 1,304+1पिछले 7 दिनों में स्टार का बदलाव
- #20★ 1,199+3पिछले 7 दिनों में स्टार का बदलाव
- #21
SGLang-Omni, TTS, ASR, स्पीच और ओम्नी मॉडल के लिए उच्च-प्रदर्शन सर्विंग को सक्षम बनाता है।
★ 1,118+130पिछले 7 दिनों में स्टार का बदलाव - #22★ 975+1पिछले 7 दिनों में स्टार का बदलाव
- #23
OpenVINO™ के साथ अनुकूलित मॉडल के लिए एक स्केलेबल इन्फेरेंस सर्वर
★ 925+5पिछले 7 दिनों में स्टार का बदलाव - #24★ 908+0पिछले 7 दिनों में स्टार का बदलाव
- #25
एक उच्च-प्रदर्शन ML मॉडल सर्विंग फ्रेमवर्क, जो आपके कंप्यूटिंग संसाधन का पूरी तरह से उपयोग करने के लिए गतिशील बैचिंग और CPU/GPU पाइपलाइन प्रदान करता है
★ 902+0पिछले 7 दिनों में स्टार का बदलाव - #26
सभी के लिए सर्वरलेस LLM सर्विंग।
★ 713+0पिछले 7 दिनों में स्टार का बदलाव - #27
क्लासिकल ML मॉडल के लिए Ollama। एक AOT कंपाइलर जो XGBoost, LightGBM, scikit-learn, CatBoost और ONNX मॉडल को नेटिव C99 इन्फरेंस कोड में बदलता है। लोड करने के लिए एक कमांड, सर्व करने के लिए एक कमांड। Python इन्फरेंस से 336 गुना तेज़।
★ 687+0पिछले 7 दिनों में स्टार का बदलाव - #28
Pure Rust + CUDA LLM इन्फरेंस इंजन — कोई PyTorch नहीं, OpenAI-compatible, Qwen3 से Kimi-K2 तक सर्व करता है
★ 677+14पिछले 7 दिनों में स्टार का बदलाव - #29
प्रोडक्शन-रेडी मशीन लर्निंग मॉडल की सेवा के लिए FastAPI स्केलेटन ऐप।
★ 603+0पिछले 7 दिनों में स्टार का बदलाव - #30
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—पिछले 7 दिनों में स्टार का बदलाव