跳到主要内容
buildradar
登录

SigmanticAI/apex-inference-chip

@SigmanticAI

在 FPGA 上运行真实 LLM (Qwen2.5-0.5B) 的推理芯片设计 — 以 RTL 实现一个 transformer 解码器层,每个硅晶值皆与黄金模型比特精确对应。实测速度 0.56 tok/s、性能提升 140 倍,具备完整佐证轨迹。

星数
615
Fork 数
11
语言
Python
许可
Apache-2.0
最后推送
3周前
Python

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。