SigmanticAI/apex-inference-chip
@SigmanticAIUm design de chip de inferência que executa um LLM real (Qwen2.5-0.5B) em FPGA — uma camada de decodificador transformer em RTL, com cada bit de valor de silício exato em relação a um modelo de referência. 0,56 tok/s medido, um aumento de 140x, com trilha de evidências completa.
Estrelas
615
Bifurcações
11
Linguagem
Python
Licença
Apache-2.0
Último push
há 3 semanas
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.