SigmanticAI/apex-inference-chip
@SigmanticAIDiseño de chip de inferencia que ejecuta un LLM real (Qwen2.5-0.5B) en FPGA: una capa de decodificador transformer en RTL, con cada bit de silicio exacto respecto al modelo original. 0.56 tok/s medidos, un aumento de 140x, con registro completo de evidencias.
Estrellas
615
Bifurcaciones
11
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 3 semanas
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.