Pular para o conteúdo principal
buildradar
Entrar

ARahim3/mlx-dspark

@ARahim3

Decodificação de LLM até 4x mais rápida no Apple Silicon, sem perdas. Port nativo em MLX do DSpark da DeepSeek e da decodificação especulativa DFlash do z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, Bonsai-27B ternário.

Estrelas
647
Bifurcações
53
Linguagem
Python
Licença
MIT
Último push
há 20 horas
Pythonmacosmetalclaude-codecodexllm-inferencelocal-llmpiapple-siliconmlxinference-enginespeculative-decodingdflash2dsparkqwen3-8

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.