Pular para o conteúdo principal
buildradar
Sign in

SigmanticAI/apex-inference-chip

@SigmanticAI

Um design de chip de inferência que executa um LLM real (Qwen2.5-0.5B) em FPGA — uma camada de decodificador transformer em RTL, com cada bit de valor de silício exato em relação a um modelo de referência. 0,56 tok/s medido, um aumento de 140x, com trilha de evidências completa.

Estrelas
615
Bifurcações
11
Linguagem
Python
Licença
Apache-2.0
Último push
há 3 semanas
Python

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.