Aller au contenu principal
buildradar
Se connecter

ARahim3/mlx-dspark

@ARahim3

Décodage LLM jusqu'à 4 fois plus rapide sur Apple Silicon, sans perte. Portage MLX natif du décodage spéculatif DSpark de DeepSeek et DFlash de z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, Bonsai-27B ternaire.

Étoiles
647
Bifurcations
53
Langage
Python
Licence
MIT
Dernier push
il y a 23 heures
Pythonmacosmetalclaude-codecodexllm-inferencelocal-llmpiapple-siliconmlxinference-enginespeculative-decodingdflash2dsparkqwen3-8

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.