Lompat ke konten utama
buildradar
Masuk

ARahim3/mlx-dspark

@ARahim3

Dekode LLM hingga 4x lebih cepat di Apple Silicon, tanpa kehilangan data. Port MLX asli dari DSpark DeepSeek & DFlash speculative decoding z-lab — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, LFM2.5, Ornith-1.0, ternary Bonsai-27B.

Bintang
647
Fork
53
Bahasa
Python
Lisensi
MIT
Push terakhir
22 jam yang lalu
Pythonmacosmetalclaude-codecodexllm-inferencelocal-llmpiapple-siliconmlxinference-enginespeculative-decodingdflash2dsparkqwen3-8

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.