跳到主要内容
buildradar
Sign in
主题 · moe

moe

标记 moe 主题、收录中的开源项目,按星标数排序。

项目数
24
总星标数
278,965
平均星标数
11,624
占比
0.01%

常跟 moe 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 moe 主题的项目。

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    12,196
  • kimi-k3-in-c@FareedKhan-dev

    Kimi K3 2.78 兆参数模型,单 CPU 推理 8.24 GB RAM,C99 可携式:无 BLAS、无框架、无 GPU

    7,224
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    549
  • vllm@vllm-project

    高吞吐量且内存效率高的 LLM 推理与服务引擎

    90,817+402近 7 天星标变化
  • LlamaFactory@hiyouga

    统一高效微调 100 多种 LLM 与 VLM(ACL 2024)

    74,532+89近 7 天星标变化
  • sglang@sgl-project

    SGLang 是针对大型语言模型与多模态模型的高性能服务框架

    33,538+791近 7 天星标变化
  • ms-swift@modelscope

    使用 PEFT 或 Full-parameter 对 600+ LLM(Qwen3.6、DeepSeek-V4、GLM-5.1、InternLM3、Llama4、...)和 300+ MLLM(Qwen3-VL、Qwen3-Omni、InternVL3.5、Ovis2.5、GLM4.5v、Gemma4、Llava、Phi4、...)进行 CPT/SFT/DPO/GRPO(AAAI 2025)

    15,488+88近 7 天星标变化
  • TensorRT-LLM@NVIDIA

    TensorRT LLM 为用户提供易用的 Python API 来定义大型语言模型(LLM),并支持最先进的优化,以在 NVIDIA GPU 上高效执行推理。TensorRT LLM 还包含创建 Python 和 C++ 运行时的组件,以高性能方式编排推理执行。

    14,536+38近 7 天星标变化
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    12,196+2,578近 7 天星标变化
  • kimi-k3-in-c@FareedKhan-dev

    Kimi K3 2.78 兆参数模型,单 CPU 推理 8.24 GB RAM,C99 可携式:无 BLAS、无框架、无 GPU

    7,224+498近 7 天星标变化
  • flashinfer@flashinfer-ai

    FlashInfer:大型语言模型服务的内核库

    6,321+38近 7 天星标变化
  • Bangumi@czy0729

    :electron: 一个非官方 https://bgm.tv UI 首先的 Android 与 iOS 应用程序,使用 React Native 开发。 一个无广告、以爱好为驱动、不以盈利为目的、专门做 ACG 的类似豆瓣的追番记录,bgm.tv 第三方客户端。为移动端重新设计,内置大量加强的网页端难以实现的功能,且提供相当的自定义选项。目前已适配 iOS / Android。

    5,900+6近 7 天星标变化
  • GLM-4.5@zai-org

    GLM-4.5:Agentic、Reasoning、和 Coding (ARC) 基础模型

    4,422+1近 7 天星标变化
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】大型视觉语言模型的混合专家模型 (Mixture-of-Experts)

    2,322+0近 7 天星标变化
  • MoBA@MoonshotAI

    MoBA:长文本 LLM 的区块注意力混合模型

    2,174+1近 7 天星标变化
  • uccl@uccl-project

    UCCL 是一个高效的 GPU 通信库,涵盖集合通信、P2P(例如 KV 缓存传输、RL 权重传输)以及 EP(例如 GPU 驱动)

    1,502+3近 7 天星标变化
  • mixture-of-experts@davidmrau

    Noam Shazeer 等人所著“The Sparsely-Gated Mixture-of-Experts Layer”的 PyTorch 重新实现版。https://arxiv.org/abs/1701.06538

    1,253+0近 7 天星标变化
  • Tutel@microsoft

    Tutel MoE:优化 Mixture-of-Experts 库,使用 FP8/NVFP4/MXFP4 支持 GptOss/DeepSeek/Kimi-K2/Qwen3

    1,018+3近 7 天星标变化
  • llama-moe@pjlab-sys4nlp

    ⛷️ LLaMA-MoE:通过持续预训练从 LLaMA 构建混合专家模型 (EMNLP 2024)

    1,002+2近 7 天星标变化
  • cudnn-frontend@NVIDIA

    cuDNN Frontend 是 NVIDIA 的现代化开源 cuDNN 库入口,并提供日益增加的高性能开源核心集合。

    932+14近 7 天星标变化
  • Adan@sail-sg

    Adan:用于加速优化深度模型的自适应 Nesterov 动量算法

    822+0近 7 天星标变化
  • DeepSeek-671B-SFT-Guide@ScienceOne-AI

    DeepSeek-V3/R1 671B 全参数微调的开源解决方案,包含从训练到推理的完整代码和脚本,以及实践中积累的一些经验和结论。

    812+0近 7 天星标变化
  • SwiftLM@SharpAI

    ⚡ 适用于 Apple Silicon 的原生 MLX Swift LLM 推理服务器。兼容 OpenAI API、支持 100B+ MoE 模型的 SSD 流、TurboQuant KV 缓存压缩,以及 macOS + iOS iPhone 应用程序。

    760+8近 7 天星标变化
  • YOLO-Master@Tencent

    [CVPR2026]🚀🚀🚀论文官方代码 "YOLO-Master: MOE-Accelerated with Specialized Transformers for Enhanced Real-time Detection." *(YOLO = You Only Look Once)* 🔥🔥🔥

    710+14近 7 天星标变化
  • pegainfer@pegainfer-project

    纯 Rust + CUDA LLM 推理引擎 — 无需 PyTorch,兼容 OpenAI,支持 Qwen3 至 Kimi-K2 服务

    678+17近 7 天星标变化
  • Chinese-Mixtral@ymcui

    中文 Mixtral 混合专家大模型(Chinese Mixtral MoE LLMs)

    612+0近 7 天星标变化
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    549近 7 天星标变化
← 返回主题列表