moe
标记 moe 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 moe 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 moe 主题的项目。
- #1
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 12,196 - #2
Kimi K3 2.78 兆参数模型,单 CPU 推理 8.24 GB RAM,C99 可携式:无 BLAS、无框架、无 GPU
★ 7,224 - #3
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 549
- #1★ 90,817+402近 7 天星标变化
- #2
统一高效微调 100 多种 LLM 与 VLM(ACL 2024)
★ 74,532+89近 7 天星标变化 - #3★ 33,538+791近 7 天星标变化
- #4
使用 PEFT 或 Full-parameter 对 600+ LLM(Qwen3.6、DeepSeek-V4、GLM-5.1、InternLM3、Llama4、...)和 300+ MLLM(Qwen3-VL、Qwen3-Omni、InternVL3.5、Ovis2.5、GLM4.5v、Gemma4、Llava、Phi4、...)进行 CPT/SFT/DPO/GRPO(AAAI 2025)
★ 15,488+88近 7 天星标变化 - #5
TensorRT LLM 为用户提供易用的 Python API 来定义大型语言模型(LLM),并支持最先进的优化,以在 NVIDIA GPU 上高效执行推理。TensorRT LLM 还包含创建 Python 和 C++ 运行时的组件,以高性能方式编排推理执行。
★ 14,536+38近 7 天星标变化 - #6
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 12,196+2,578近 7 天星标变化 - #7
Kimi K3 2.78 兆参数模型,单 CPU 推理 8.24 GB RAM,C99 可携式:无 BLAS、无框架、无 GPU
★ 7,224+498近 7 天星标变化 - #8
FlashInfer:大型语言模型服务的内核库
★ 6,321+38近 7 天星标变化 - #9
:electron: 一个非官方 https://bgm.tv UI 首先的 Android 与 iOS 应用程序,使用 React Native 开发。 一个无广告、以爱好为驱动、不以盈利为目的、专门做 ACG 的类似豆瓣的追番记录,bgm.tv 第三方客户端。为移动端重新设计,内置大量加强的网页端难以实现的功能,且提供相当的自定义选项。目前已适配 iOS / Android。
★ 5,900+6近 7 天星标变化 - #10★ 4,422+1近 7 天星标变化
- #11★ 2,322+0近 7 天星标变化
- #12★ 2,174+1近 7 天星标变化
- #13★ 1,502+3近 7 天星标变化
- #14
Noam Shazeer 等人所著“The Sparsely-Gated Mixture-of-Experts Layer”的 PyTorch 重新实现版。https://arxiv.org/abs/1701.06538
★ 1,253+0近 7 天星标变化 - #15
Tutel MoE:优化 Mixture-of-Experts 库,使用 FP8/NVFP4/MXFP4 支持 GptOss/DeepSeek/Kimi-K2/Qwen3
★ 1,018+3近 7 天星标变化 - #16★ 1,002+2近 7 天星标变化
- #17
cuDNN Frontend 是 NVIDIA 的现代化开源 cuDNN 库入口,并提供日益增加的高性能开源核心集合。
★ 932+14近 7 天星标变化 - #18★ 822+0近 7 天星标变化
- #19
DeepSeek-V3/R1 671B 全参数微调的开源解决方案,包含从训练到推理的完整代码和脚本,以及实践中积累的一些经验和结论。
★ 812+0近 7 天星标变化 - #20
⚡ 适用于 Apple Silicon 的原生 MLX Swift LLM 推理服务器。兼容 OpenAI API、支持 100B+ MoE 模型的 SSD 流、TurboQuant KV 缓存压缩,以及 macOS + iOS iPhone 应用程序。
★ 760+8近 7 天星标变化 - #21
[CVPR2026]🚀🚀🚀论文官方代码 "YOLO-Master: MOE-Accelerated with Specialized Transformers for Enhanced Real-time Detection." *(YOLO = You Only Look Once)* 🔥🔥🔥
★ 710+14近 7 天星标变化 - #22★ 678+17近 7 天星标变化
- #23
中文 Mixtral 混合专家大模型(Chinese Mixtral MoE LLMs)
★ 612+0近 7 天星标变化 - #24
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 549—近 7 天星标变化