SigmanticAI/apex-inference-chip
@SigmanticAIEin Inferenz-Chip-Design, das ein echtes LLM (Qwen2.5-0.5B) auf einem FPGA ausführt — eine Transformer-Decoder-Schicht in RTL, jeder Siliziumwert bitgenau gegenüber einem Referenzmodell. Gemessen 0,56 Token/s, ein 140-facher Anstieg, vollständige Nachweise.
Sterne
615
Forks
11
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 3 Wochen
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.