Lompat ke konten utama
buildradar
Sign in

SigmanticAI/apex-inference-chip

@SigmanticAI

Desain chip inferensi yang menjalankan LLM nyata (Qwen2.5-0.5B) di FPGA — satu lapisan decoder transformer dalam RTL, setiap bit nilai silikon tepat sama dengan model referensi. Diukur 0.56 tok/s, peningkatan 140×, jejak bukti lengkap.

Bintang
615
Fork
11
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
3 minggu yang lalu
Python

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.