मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · moe

moe

moe टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
24
कुल स्टार
2,78,965
औसत स्टार
11,624
हिस्सा
0.01%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर moe के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और moe टैग वाली रिपॉजिटरी।

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    11,884
  • kimi-k3-in-c@FareedKhan-dev

    8.24 GB रैम में एक सिंगल CPU पर इन्फेरेंस चलाने वाला 2.78-खरब-पैरामीटर Kimi K3। पोर्टेबल C99: कोई BLAS नहीं, कोई फ्रेमवर्क नहीं, कोई GPU नहीं।

    7,161
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543
  • vllm@vllm-project

    LLM के लिए एक हाई-थ्रूपुट और मेमोरी-कुशल इन्फेरेंस और सर्विंग इंजन

    90,817+402पिछले 7 दिनों में स्टार का बदलाव
  • LlamaFactory@hiyouga

    100+ LLMs और VLMs की यूनिफाइड एफिशिएंट फाइन-ट्यूनिंग (ACL 2024)

    74,532+89पिछले 7 दिनों में स्टार का बदलाव
  • sglang@sgl-project

    SGLang बड़े भाषा मॉडल और मल्टीमॉडल मॉडल के लिए एक उच्च-प्रदर्शन सर्विंग फ्रेमवर्क है।

    33,538+791पिछले 7 दिनों में स्टार का बदलाव
  • ms-swift@modelscope

    600+ LLM (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) और 300+ MLLM (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) के लिए PEFT या Full-parameter का उपयोग करके CPT/SFT/DPO/GRPO करें (AAAI 2025)।

    15,488+88पिछले 7 दिनों में स्टार का बदलाव
  • TensorRT-LLM@NVIDIA

    TensorRT LLM उपयोगकर्ताओं को लार्ज लैंग्वेज मॉडल्स (LLMs) को परिभाषित करने के लिए एक उपयोग में आसान Python API प्रदान करता है और NVIDIA GPUs पर कुशलतापूर्वक इन्फरेंस करने के लिए अत्याधुनिक ऑप्टिमाइज़ेशन का समर्थन करता है। TensorRT LLM में Python और C++ रनटाइम बनाने के लिए घटक भी शामिल हैं जो इन्फरेंस निष्पादन को बेहतर तरीके से ऑर्केस्ट्रेट करते हैं।

    14,536+38पिछले 7 दिनों में स्टार का बदलाव
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    11,884+2,287पिछले 7 दिनों में स्टार का बदलाव
  • kimi-k3-in-c@FareedKhan-dev

    8.24 GB रैम में एक सिंगल CPU पर इन्फेरेंस चलाने वाला 2.78-खरब-पैरामीटर Kimi K3। पोर्टेबल C99: कोई BLAS नहीं, कोई फ्रेमवर्क नहीं, कोई GPU नहीं।

    7,161+442पिछले 7 दिनों में स्टार का बदलाव
  • flashinfer@flashinfer-ai

    FlashInfer: LLM सर्विंग के लिए कर्नेल लाइब्रेरी

    6,321+38पिछले 7 दिनों में स्टार का बदलाव
  • Bangumi@czy0729

    :electron: React Native के साथ निर्मित Android और iOS के लिए एक अनौपचारिक https://bgm.tv UI फर्स्ट ऐप क्लाइंट।

    5,900+6पिछले 7 दिनों में स्टार का बदलाव
  • GLM-4.5@zai-org

    GLM-4.5: एजेंटिक, रीजनिंग और कोडिंग (ARC) फाउंडेशन मॉडल

    4,422+1पिछले 7 दिनों में स्टार का बदलाव
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】 Large Vision-Language Models के लिए Mixture-of-Experts

    2,322+0पिछले 7 दिनों में स्टार का बदलाव
  • MoBA@MoonshotAI

    MoBA: लॉन्ग-कंटेक्स्ट LLMs के लिए मिक्सचर ऑफ ब्लॉक अटेंशन

    2,174+1पिछले 7 दिनों में स्टार का बदलाव
  • uccl@uccl-project

    UCCL GPU के लिए एक कुशल संचार लाइब्रेरी है, जिसमें कलेक्टिव्स, P2P (जैसे, KV कैश ट्रांसफर, RL वेट ट्रांसफर), और EP (जैसे, GPU-संचालित) शामिल हैं।

    1,502+3पिछले 7 दिनों में स्टार का बदलाव
  • mixture-of-experts@davidmrau

    Noam Shazeer आदि द्वारा "The Sparsely-Gated Mixture-of-Experts Layer" का PyTorch पुनः-कार्यान्वयन। https://arxiv.org/abs/1701.06538

    1,253+0पिछले 7 दिनों में स्टार का बदलाव
  • Tutel@microsoft

    Tutel MoE: ऑप्टिमाइज़्ड मिक्सचर-ऑफ-एक्सपर्ट्स लाइब्रेरी, जो FP8/NVFP4/MXFP4 का उपयोग करके GptOss/DeepSeek/Kimi-K2/Qwen3 को सपोर्ट करती है।

    1,017+3पिछले 7 दिनों में स्टार का बदलाव
  • llama-moe@pjlab-sys4nlp

    LLaMA-MoE: निरंतर प्री-ट्रेनिंग के साथ LLaMA से Mixture-of-Experts का निर्माण (EMNLP 2024)

    1,003+2पिछले 7 दिनों में स्टार का बदलाव
  • cudnn-frontend@NVIDIA

    cuDNN Frontend, cuDNN लाइब्रेरी के लिए NVIDIA का आधुनिक, ओपन-सोर्स एंट्री पॉइंट है और उच्च-प्रदर्शन वाले ओपन-सोर्स कर्नेल का एक बढ़ता हुआ संग्रह है।

    929+11पिछले 7 दिनों में स्टार का बदलाव
  • Adan@sail-sg

    Adan: डीप मॉडल्स को तेज़ी से ऑप्टिमाइज़ करने के लिए एडेप्टिव नेस्टरोव मोमेंटम एल्गोरिदम।

    822+0पिछले 7 दिनों में स्टार का बदलाव
  • DeepSeek-671B-SFT-Guide@ScienceOne-AI

    DeepSeek-V3/R1 671B के पूर्ण पैरामीटर फाइन-ट्यूनिंग के लिए एक ओपन-सोर्स समाधान, जिसमें प्रशिक्षण से लेकर इन्फेरेंस तक के पूरे कोड और स्क्रिप्ट, साथ ही कुछ व्यावहारिक अनुभव और निष्कर्ष शामिल हैं।

    812+0पिछले 7 दिनों में स्टार का बदलाव
  • SwiftLM@SharpAI

    Apple Silicon के लिए नेटिव MLX Swift LLM इन्फरेंस सर्वर। OpenAI-संगत API, 100B+ MoE मॉडल के लिए SSD स्ट्रीमिंग, TurboQuant KV कैश कंप्रेशन, और MACOS + iOS iPhone ऐप।

    758+6पिछले 7 दिनों में स्टार का बदलाव
  • YOLO-Master@Tencent

    [CVPR2026] "YOLO-Master: MOE-Accelerated with Specialized Transformers for Enhanced Real-time Detection" शोध पत्र के लिए आधिकारिक कोड

    707+12पिछले 7 दिनों में स्टार का बदलाव
  • pegainfer@pegainfer-project

    Pure Rust + CUDA LLM इन्फरेंस इंजन — कोई PyTorch नहीं, OpenAI-compatible, Qwen3 से Kimi-K2 तक सर्व करता है

    673+14पिछले 7 दिनों में स्टार का बदलाव
  • Chinese-Mixtral@ymcui

    चीनी Mixtral मिक्स-ऑफ-एक्सपर्ट्स (MoE) LLM

    612+0पिछले 7 दिनों में स्टार का बदलाव
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस