跳到主要內容
buildradar
登入

SigmanticAI/apex-inference-chip

@SigmanticAI

在 FPGA 上運行真實 LLM (Qwen2.5-0.5B) 的推論晶片設計 — 以 RTL 實現一個 transformer 解碼器層,每個矽晶值皆與黃金模型位元精確對應。實測速度 0.56 tok/s、效能提升 140 倍,具備完整佐證軌跡。

星數
615
Fork 數
11
語言
Python
授權
Apache-2.0
最後推送
3 週前
Python

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。