Zum Hauptinhalt springen
buildradar
Sign in

SigmanticAI/apex-inference-chip

@SigmanticAI

Ein Inferenz-Chip-Design, das ein echtes LLM (Qwen2.5-0.5B) auf einem FPGA ausführt — eine Transformer-Decoder-Schicht in RTL, jeder Siliziumwert bitgenau gegenüber einem Referenzmodell. Gemessen 0,56 Token/s, ein 140-facher Anstieg, vollständige Nachweise.

Sterne
615
Forks
11
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 3 Wochen
Python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.