Saltar al contenido principal
buildradar
Sign in
Tema · moe

moe

Repositorios de código abierto monitorizados etiquetados con moe, ordenados por estrellas.

Repositorios
24
Estrellas totales
278.965
Estrellas de media
11.624
Proporción
0,01%

Temas que aparecen con frecuencia junto a moe en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con moe.

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    11.884
  • kimi-k3-in-c@FareedKhan-dev

    Un Kimi K3 de 2,78 billones de parámetros ejecutando inferencia en una sola CPU con 8,24 GB de RAM. C99 portátil: sin BLAS, sin framework, sin GPU.

    7161
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543
  • vllm@vllm-project

    Un motor de inferencia y servicio de alto rendimiento y eficiente en memoria para LLMs

    90.817+402Variación de estrellas de los últimos 7 días
  • LlamaFactory@hiyouga

    Ajuste fino eficiente y unificado de más de 100 LLMs y VLMs (ACL 2024)

    74.532+89Variación de estrellas de los últimos 7 días
  • sglang@sgl-project

    SGLang es un marco de servicio de alto rendimiento para modelos de lenguaje grande y modelos multimodales.

    33.538+791Variación de estrellas de los últimos 7 días
  • ms-swift@modelscope

    Usa PEFT o parámetros completos para CPT/SFT/DPO/GRPO en más de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) y más de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).

    15.488+88Variación de estrellas de los últimos 7 días
  • TensorRT-LLM@NVIDIA

    TensorRT LLM ofrece a los usuarios una API de Python fácil de usar para definir Modelos de Lenguaje Grande (LLMs) y admite optimizaciones de vanguardia para realizar inferencias de manera eficiente en GPUs NVIDIA. TensorRT LLM también contiene componentes para crear entornos de ejecución en Python y C++ que organizan la ejecución de inferencias de alto rendimiento.

    14.536+38Variación de estrellas de los últimos 7 días
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    11.884+2287Variación de estrellas de los últimos 7 días
  • kimi-k3-in-c@FareedKhan-dev

    Un Kimi K3 de 2,78 billones de parámetros ejecutando inferencia en una sola CPU con 8,24 GB de RAM. C99 portátil: sin BLAS, sin framework, sin GPU.

    7161+442Variación de estrellas de los últimos 7 días
  • flashinfer@flashinfer-ai

    FlashInfer: Biblioteca de kernels para servir LLM

    6321+38Variación de estrellas de los últimos 7 días
  • Bangumi@czy0729

    Una aplicación cliente no oficial con interfaz enfocada para https://bgm.tv en Android e iOS, construida con React Native.

    5900+6Variación de estrellas de los últimos 7 días
  • GLM-4.5@zai-org

    GLM-4.5: Modelos base de agentes, razonamiento y codificación (ARC)

    4422+1Variación de estrellas de los últimos 7 días
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】 Mixture-of-Experts para grandes modelos de visión y lenguaje

    2322+0Variación de estrellas de los últimos 7 días
  • MoBA@MoonshotAI

    MoBA: Mixture of Block Attention para LLMs de contexto largo

    2174+1Variación de estrellas de los últimos 7 días
  • uccl@uccl-project

    UCCL es una biblioteca de comunicación eficiente para GPUs, que cubre colectivos, P2P (por ejemplo, transferencia de caché KV, transferencia de pesos RL) y EP (por ejemplo, impulsado por GPU).

    1502+3Variación de estrellas de los últimos 7 días
  • mixture-of-experts@davidmrau

    Reimplementación en PyTorch de "The Sparsely-Gated Mixture-of-Experts Layer" de Noam Shazeer et al. https://arxiv.org/abs/1701.06538

    1253+0Variación de estrellas de los últimos 7 días
  • Tutel@microsoft

    Tutel MoE: Biblioteca optimizada de Mixture-of-Experts, compatible con GptOss/DeepSeek/Kimi-K2/Qwen3 usando FP8/NVFP4/MXFP4

    1017+3Variación de estrellas de los últimos 7 días
  • llama-moe@pjlab-sys4nlp

    ⛷️ LLaMA-MoE: Construcción de Mixture-of-Experts a partir de LLaMA con preentrenamiento continuo (EMNLP 2024)

    1003+2Variación de estrellas de los últimos 7 días
  • cudnn-frontend@NVIDIA

    cuDNN Frontend es el punto de entrada moderno y de código abierto de NVIDIA a la biblioteca cuDNN y a una creciente colección de kernels de alto rendimiento.

    929+11Variación de estrellas de los últimos 7 días
  • Adan@sail-sg

    Adan: Algoritmo de momento de Nesterov adaptativo para una optimización más rápida de modelos profundos.

    822+0Variación de estrellas de los últimos 7 días
  • DeepSeek-671B-SFT-Guide@ScienceOne-AI

    Solución de código abierto para el ajuste fino de parámetros completos de DeepSeek-V3/R1 671B, que incluye código y scripts completos desde el entrenamiento hasta la inferencia, así como experiencias prácticas y conclusiones.

    812+0Variación de estrellas de los últimos 7 días
  • SwiftLM@SharpAI

    Servidor de inferencia LLM nativo en MLX Swift para Apple Silicon. API compatible con OpenAI, streaming SSD para modelos MoE de más de 100B, compresión de caché KV TurboQuant, aplicación para MACOS + iOS iPhone.

    758+6Variación de estrellas de los últimos 7 días
  • YOLO-Master@Tencent

    [CVPR2026] Código oficial para el artículo "YOLO-Master: MOE-Accelerated with Specialized Transformers for Enhanced Real-time Detection." (YOLO = You Only Look Once)

    707+12Variación de estrellas de los últimos 7 días
  • pegainfer@pegainfer-project

    Motor de inferencia LLM en Rust puro + CUDA; sin PyTorch, compatible con OpenAI, sirve desde Qwen3 hasta Kimi-K2

    673+14Variación de estrellas de los últimos 7 días
  • Chinese-Mixtral@ymcui

    Modelos de lenguaje grandes (LLM) Mixtral MoE en chino.

    612+0Variación de estrellas de los últimos 7 días
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543Variación de estrellas de los últimos 7 días
← Volver a temas