Saltar al contenido principal
buildradar
Sign in

SigmanticAI/apex-inference-chip

@SigmanticAI

Diseño de chip de inferencia que ejecuta un LLM real (Qwen2.5-0.5B) en FPGA: una capa de decodificador transformer en RTL, con cada bit de silicio exacto respecto al modelo original. 0.56 tok/s medidos, un aumento de 140x, con registro completo de evidencias.

Estrellas
615
Bifurcaciones
11
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 3 semanas
Python

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.