SigmanticAI/apex-inference-chip
@SigmanticAIUn design de puce d'inférence qui exécute un vrai LLM (Qwen2.5-0.5B) sur FPGA — une couche décodeur de transformateur en RTL, chaque valeur silicium bit‑exacte par rapport à un modèle de référence. 0,56 tok/s mesuré, une hausse de 140×, trace complète des preuves.
Étoiles
615
Bifurcations
11
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 3 semaines
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.