跳到主要內容
buildradar
登入
主題 · mixture-of-experts

mixture-of-experts

標記 mixture-of-experts 主題、收錄中的開源專案,依星數排序。

專案數
18
總星數
71,279
平均星數
3,960
佔比
0.00%

常跟 mixture-of-experts 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 mixture-of-experts 主題的專案。

  • kimi-k3-in-c@FareedKhan-dev

    Kimi K3 2.78 兆參數模型,單 CPU 推理 8.24 GB RAM,C99 可攜式:無 BLAS、無框架、無 GPU

    7,547
  • Swiftlet@leonickson1

    Swiftlet 是一個 Swift 與 Metal 執行時期,透過從儲存空間串流專家權重,在 Apple 裝置上本地執行大型 Qwen Mixture-of-Experts 模型,使 35B 與 80B 模型能在低記憶體下執行,包含 iPhone。

    634
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    552
  • slotstream@carloslfu

    Run Qwen3.8-Flash-Next (125B MoE, 104 GB at 4-bit) on Macs with a fraction of that RAM by streaming experts from SSD. MLX + Swift, Ollama-compatible API.

    287
  • DeepSpeed@deepspeedai

    DeepSpeed 是一個深度學習優化函式庫,使分散式訓練與推論變得簡單、高效且有效

    43,058+0近 7 天星數變化
  • kimi-k3-in-c@FareedKhan-dev

    Kimi K3 2.78 兆參數模型,單 CPU 推理 8.24 GB RAM,C99 可攜式:無 BLAS、無框架、無 GPU

    7,547+490近 7 天星數變化
  • optillm@algorithmicsuperintelligence

    為 LLM 優化推理代理

    4,260+0近 7 天星數變化
  • hivemind@learning-at-home

    基於 PyTorch 的去中心化深度學習。專為在世界各地數千名志願者的設備上訓練模型而建構。

    2,515+0近 7 天星數變化
  • mixtral-offloading@dvmazur

    在 Colab 或消費級桌機上執行 Mixtral-8x7B 模型

    2,334+0近 7 天星數變化
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】大型視覺語言模型的混合專家模型 (Mixture-of-Experts)

    2,322+0近 7 天星數變化
  • mixture-of-experts@davidmrau

    Noam Shazeer 等人所著「The Sparsely-Gated Mixture-of-Experts Layer」的 PyTorch 重新實作版。https://arxiv.org/abs/1701.06538

    1,253+0近 7 天星數變化
  • Aria@rhymes-ai

    Aria 的程式碼庫 - 一個開源的多模態原生 MoE

    1,088+1近 7 天星數變化
  • Tutel@microsoft

    Tutel MoE:最佳化 Mixture-of-Experts 程式庫,使用 FP8/NVFP4/MXFP4 支援 GptOss/DeepSeek/Kimi-K2/Qwen3

    1,018+2近 7 天星數變化
  • llama-moe@pjlab-sys4nlp

    ⛷️ LLaMA-MoE:透過持續預訓練從 LLaMA 建構混合專家模型 (EMNLP 2024)

    1,002+1近 7 天星數變化
  • cudnn-frontend@NVIDIA

    cuDNN Frontend 是 NVIDIA 的現代化開源 cuDNN 函式庫入口,並提供日益增加的高效能開源核心集合。

    932+9近 7 天星數變化
  • smt@SMTorg

    SMT:代理模型工具箱

    912+0近 7 天星數變化
  • makeMoE@AviSoori1x

    受到 Andrej Karpathy 的 makemore 啟發,從頭實作的稀疏專家混合(sparse mixture of experts)語言模型 :)

    815+0近 7 天星數變化
  • Swiftlet@leonickson1

    Swiftlet 是一個 Swift 與 Metal 執行時期,透過從儲存空間串流專家權重,在 Apple 裝置上本地執行大型 Qwen Mixture-of-Experts 模型,使 35B 與 80B 模型能在低記憶體下執行,包含 iPhone。

    634+51近 7 天星數變化
  • Chinese-Mixtral@ymcui

    中文 Mixtral 混合專家大模型(Chinese Mixtral MoE LLMs)

    612+0近 7 天星數變化
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    552+19近 7 天星數變化
  • krasis@brontoguana

    Krasis 是一款混合型 LLM 執行時期,專注於在消費級 VRAM 受限的硬體上高效執行大型模型。

    519+3近 7 天星數變化
  • mergoo@Leeroo-AI

    用於輕鬆合併多個 LLM 專家並高效訓練合併後 LLM 的函式庫

    516+0近 7 天星數變化
← 返回主題列表