moe
moe がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
moe と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、moe がタグ付けされたリポジトリ。
- #1
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 11,798 - #2
2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。
★ 7,147 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 542
- #1★ 90,817+647直近 7 日のスター増減
- #2
100以上のLLMおよびVLMの統一的効率的なファインチューニング (ACL 2024)
★ 74,532+145直近 7 日のスター増減 - #3★ 33,538+1,018直近 7 日のスター増減
- #4
PEFTまたはFull-parameterを使用して、600以上のLLM (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) および300以上のMLLM (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) に適用する (AAAI 2025)。
★ 15,488+116直近 7 日のスター増減 - #5
TensorRT LLMは、ユーザーがLarge Language Models (LLMs) を定義するための使いやすいPython APIを提供し、NVIDIA GPU上で推論を効率的に実行するための最先端の最適化をサポートします。TensorRT LLMには、推論実行を高性能にオーケストレーションするためのPythonおよびC++ランタイムを作成するコンポーネントも含まれています。
★ 14,536+53直近 7 日のスター増減 - #6
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 11,798+2,808直近 7 日のスター増減 - #7
2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。
★ 7,147+493直近 7 日のスター増減 - #8
FlashInfer: LLMサービングのためのカーネルライブラリ
★ 6,321+68直近 7 日のスター増減 - #9
:electron: AndroidおよびiOS向けの非公式なUIファーストアプリクライアント。React Nativeで構築されています。広告がなく、趣味主導で、収益目的ではない、ACGに特化したDoubanライクな視聴記録機能を持つbgm.tvのサードパーティクライアント。モバイル向けに再設計され、ウェブ版では実現が難しい多くの強化機能を内蔵しており、相当なカスタマイズオプションを提供します。現在、iOS/Androidに対応しています。
★ 5,900+25直近 7 日のスター増減 - #10★ 4,422+5直近 7 日のスター増減
- #11★ 2,322+0直近 7 日のスター増減
- #12★ 2,174+5直近 7 日のスター増減
- #13★ 1,502+5直近 7 日のスター増減
- #14
Noam Shazeer らによる論文「The Sparsely-Gated Mixture-of-Experts Layer」の PyTorch による再実装(https://arxiv.org/abs/1701.06538)
★ 1,253+1直近 7 日のスター増減 - #15
Tutel MoE: 最適化された Mixture-of-Experts ライブラリ。FP8/NVFP4/MXFP4 を使用して GptOss/DeepSeek/Kimi-K2/Qwen3 をサポート
★ 1,017+2直近 7 日のスター増減 - #16★ 1,003+0直近 7 日のスター増減
- #17
cuDNN Frontendは、NVIDIAによるcuDNNライブラリへのモダンでオープンソースなエントリーポイントであり、高性能なオープンソースカーネルのコレクションを拡大しています。
★ 929+7直近 7 日のスター増減 - #18★ 822+0直近 7 日のスター増減
- #19
DeepSeek-V3/R1 671B のフルパラメータ微調整のためのオープンソースソリューション。トレーニングから推論までの完全なコードとスクリプトに加え、実践で得られた経験と結論が含まれています。
★ 812+0直近 7 日のスター増減 - #20
⚡ Apple Silicon向けのネイティブなMLX Swift LLM推論サーバー。OpenAI互換API、100B+ MoEモデル向けのSSDストリーミング、TurboQuant KVキャッシュ圧縮、macOSおよびiOS iPhoneアプリを搭載。
★ 758+5直近 7 日のスター増減 - #21
[CVPR2026]🚀🚀🚀 論文「YOLO-Master: MOE-Accelerated with Specialized Transformers for Enhanced Real-time Detection」の公式コード *(YOLO = You Only Look Once)* 🔥🔥🔥
★ 707+6直近 7 日のスター増減 - #22★ 673+13直近 7 日のスター増減
- #23
中国語Mixtral混合専門家大規模言語モデル(Chinese Mixtral MoE LLMs)
★ 612+0直近 7 日のスター増減 - #24
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 542—直近 7 日のスター増減