SigmanticAI/apex-inference-chip
@SigmanticAIएक इन्फेरेंस चिप डिज़ाइन जो FPGA पर एक वास्तविक LLM (Qwen2.5-0.5B) चलाता है — RTL में एक ट्रांसफार्मर डिकोडर लेयर, गोल्डन मॉडल के विरुद्ध प्रत्येक सिलिकॉन वैल्यू बिट-एक्जेक्ट। 0.56 tok/s मापा गया, 140× वृद्धि, पूर्ण साक्ष्य ट्रेल।
स्टार
615
फ़ोर्क
11
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
3 सप्ताह पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।