Chuyển tới nội dung chính
buildradar
Đăng nhập

ARahim3/mlx-dspark

@ARahim3

Giải mã LLM nhanh hơn tới 4 lần trên Apple Silicon, không mất dữ liệu. Bản port MLX gốc của DSpark từ DeepSeek và DFlash từ z-lab cho giải mã suy đoán — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, LFM2.5, Ornith-1.0, ternary Bonsai-27B.

Sao
647
Fork
53
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
23 giờ trước
Pythonmacosmetalclaude-codecodexllm-inferencelocal-llmpiapple-siliconmlxinference-enginespeculative-decodingdflash2dsparkqwen3-8

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.