moe
moe टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर moe के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और moe टैग वाली रिपॉजिटरी।
- #1
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 11,884 - #2
8.24 GB रैम में एक सिंगल CPU पर इन्फेरेंस चलाने वाला 2.78-खरब-पैरामीटर Kimi K3। पोर्टेबल C99: कोई BLAS नहीं, कोई फ्रेमवर्क नहीं, कोई GPU नहीं।
★ 7,161 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543
- #1★ 90,817+402पिछले 7 दिनों में स्टार का बदलाव
- #2
100+ LLMs और VLMs की यूनिफाइड एफिशिएंट फाइन-ट्यूनिंग (ACL 2024)
★ 74,532+89पिछले 7 दिनों में स्टार का बदलाव - #3
SGLang बड़े भाषा मॉडल और मल्टीमॉडल मॉडल के लिए एक उच्च-प्रदर्शन सर्विंग फ्रेमवर्क है।
★ 33,538+791पिछले 7 दिनों में स्टार का बदलाव - #4
600+ LLM (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) और 300+ MLLM (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) के लिए PEFT या Full-parameter का उपयोग करके CPT/SFT/DPO/GRPO करें (AAAI 2025)।
★ 15,488+88पिछले 7 दिनों में स्टार का बदलाव - #5
TensorRT LLM उपयोगकर्ताओं को लार्ज लैंग्वेज मॉडल्स (LLMs) को परिभाषित करने के लिए एक उपयोग में आसान Python API प्रदान करता है और NVIDIA GPUs पर कुशलतापूर्वक इन्फरेंस करने के लिए अत्याधुनिक ऑप्टिमाइज़ेशन का समर्थन करता है। TensorRT LLM में Python और C++ रनटाइम बनाने के लिए घटक भी शामिल हैं जो इन्फरेंस निष्पादन को बेहतर तरीके से ऑर्केस्ट्रेट करते हैं।
★ 14,536+38पिछले 7 दिनों में स्टार का बदलाव - #6
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 11,884+2,287पिछले 7 दिनों में स्टार का बदलाव - #7
8.24 GB रैम में एक सिंगल CPU पर इन्फेरेंस चलाने वाला 2.78-खरब-पैरामीटर Kimi K3। पोर्टेबल C99: कोई BLAS नहीं, कोई फ्रेमवर्क नहीं, कोई GPU नहीं।
★ 7,161+442पिछले 7 दिनों में स्टार का बदलाव - #8
FlashInfer: LLM सर्विंग के लिए कर्नेल लाइब्रेरी
★ 6,321+38पिछले 7 दिनों में स्टार का बदलाव - #9
:electron: React Native के साथ निर्मित Android और iOS के लिए एक अनौपचारिक https://bgm.tv UI फर्स्ट ऐप क्लाइंट।
★ 5,900+6पिछले 7 दिनों में स्टार का बदलाव - #10★ 4,422+1पिछले 7 दिनों में स्टार का बदलाव
- #11★ 2,322+0पिछले 7 दिनों में स्टार का बदलाव
- #12★ 2,174+1पिछले 7 दिनों में स्टार का बदलाव
- #13
UCCL GPU के लिए एक कुशल संचार लाइब्रेरी है, जिसमें कलेक्टिव्स, P2P (जैसे, KV कैश ट्रांसफर, RL वेट ट्रांसफर), और EP (जैसे, GPU-संचालित) शामिल हैं।
★ 1,502+3पिछले 7 दिनों में स्टार का बदलाव - #14
Noam Shazeer आदि द्वारा "The Sparsely-Gated Mixture-of-Experts Layer" का PyTorch पुनः-कार्यान्वयन। https://arxiv.org/abs/1701.06538
★ 1,253+0पिछले 7 दिनों में स्टार का बदलाव - #15
Tutel MoE: ऑप्टिमाइज़्ड मिक्सचर-ऑफ-एक्सपर्ट्स लाइब्रेरी, जो FP8/NVFP4/MXFP4 का उपयोग करके GptOss/DeepSeek/Kimi-K2/Qwen3 को सपोर्ट करती है।
★ 1,017+3पिछले 7 दिनों में स्टार का बदलाव - #16
LLaMA-MoE: निरंतर प्री-ट्रेनिंग के साथ LLaMA से Mixture-of-Experts का निर्माण (EMNLP 2024)
★ 1,003+2पिछले 7 दिनों में स्टार का बदलाव - #17
cuDNN Frontend, cuDNN लाइब्रेरी के लिए NVIDIA का आधुनिक, ओपन-सोर्स एंट्री पॉइंट है और उच्च-प्रदर्शन वाले ओपन-सोर्स कर्नेल का एक बढ़ता हुआ संग्रह है।
★ 929+11पिछले 7 दिनों में स्टार का बदलाव - #18
Adan: डीप मॉडल्स को तेज़ी से ऑप्टिमाइज़ करने के लिए एडेप्टिव नेस्टरोव मोमेंटम एल्गोरिदम।
★ 822+0पिछले 7 दिनों में स्टार का बदलाव - #19
DeepSeek-V3/R1 671B के पूर्ण पैरामीटर फाइन-ट्यूनिंग के लिए एक ओपन-सोर्स समाधान, जिसमें प्रशिक्षण से लेकर इन्फेरेंस तक के पूरे कोड और स्क्रिप्ट, साथ ही कुछ व्यावहारिक अनुभव और निष्कर्ष शामिल हैं।
★ 812+0पिछले 7 दिनों में स्टार का बदलाव - #20
Apple Silicon के लिए नेटिव MLX Swift LLM इन्फरेंस सर्वर। OpenAI-संगत API, 100B+ MoE मॉडल के लिए SSD स्ट्रीमिंग, TurboQuant KV कैश कंप्रेशन, और MACOS + iOS iPhone ऐप।
★ 758+6पिछले 7 दिनों में स्टार का बदलाव - #21
[CVPR2026] "YOLO-Master: MOE-Accelerated with Specialized Transformers for Enhanced Real-time Detection" शोध पत्र के लिए आधिकारिक कोड
★ 707+12पिछले 7 दिनों में स्टार का बदलाव - #22
Pure Rust + CUDA LLM इन्फरेंस इंजन — कोई PyTorch नहीं, OpenAI-compatible, Qwen3 से Kimi-K2 तक सर्व करता है
★ 673+14पिछले 7 दिनों में स्टार का बदलाव - #23
चीनी Mixtral मिक्स-ऑफ-एक्सपर्ट्स (MoE) LLM
★ 612+0पिछले 7 दिनों में स्टार का बदलाव - #24
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—पिछले 7 दिनों में स्टार का बदलाव