mixture-of-experts
mixture-of-experts がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
mixture-of-experts と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、mixture-of-experts がタグ付けされたリポジトリ。
- #1
2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。
★ 7,505 - #2
Swiftletは、ストレージから専門家ウェイトをストリーミングすることで、Apple製デバイス上で大規模なQwen Mixture-of-Expertsモデルをローカル実行するSwiftおよびMetalランタイムです。iPhoneを含む低RAM環境でも35Bおよび80Bモデルの実行を可能にします。
★ 631 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 550 - #4
Run Qwen3.8-Flash-Next (125B MoE, 104 GB at 4-bit) on Macs with a fraction of that RAM by streaming experts from SSD. MLX + Swift, Ollama-compatible API.
★ 287
- #1★ 43,058+0直近 7 日のスター増減
- #2
2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。
★ 7,505+300直近 7 日のスター増減 - #3★ 4,260+0直近 7 日のスター増減
- #4★ 2,515+0直近 7 日のスター増減
- #5
Google Colab や一般のデスクトップで Mixtral-8x7B モデルを実行する
★ 2,334+0直近 7 日のスター増減 - #6★ 2,322+0直近 7 日のスター増減
- #7
Noam Shazeer らによる論文「The Sparsely-Gated Mixture-of-Experts Layer」の PyTorch による再実装(https://arxiv.org/abs/1701.06538)
★ 1,253+0直近 7 日のスター増減 - #8★ 1,088+1直近 7 日のスター増減
- #9
Tutel MoE: 最適化された Mixture-of-Experts ライブラリ。FP8/NVFP4/MXFP4 を使用して GptOss/DeepSeek/Kimi-K2/Qwen3 をサポート
★ 1,018+2直近 7 日のスター増減 - #10★ 1,002+1直近 7 日のスター増減
- #11
cuDNN Frontendは、NVIDIAによるcuDNNライブラリへのモダンでオープンソースなエントリーポイントであり、高性能なオープンソースカーネルのコレクションを拡大しています。
★ 932+9直近 7 日のスター増減 - #12★ 912+0直近 7 日のスター増減
- #13★ 814+0直近 7 日のスター増減
- #14
Swiftletは、ストレージから専門家ウェイトをストリーミングすることで、Apple製デバイス上で大規模なQwen Mixture-of-Expertsモデルをローカル実行するSwiftおよびMetalランタイムです。iPhoneを含む低RAM環境でも35Bおよび80Bモデルの実行を可能にします。
★ 631+48直近 7 日のスター増減 - #15
中国語Mixtral混合専門家大規模言語モデル(Chinese Mixtral MoE LLMs)
★ 612+0直近 7 日のスター増減 - #16
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 550+18直近 7 日のスター増減 - #17★ 519+3直近 7 日のスター増減
- #18★ 516+1直近 7 日のスター増減