मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

Bruce-Lee-LY/cuda_hgemm

@Bruce-Lee-LY

WMMA API और MMA PTX इंस्ट्रक्शन का उपयोग करके टेन्सर कोर के साथ हाफ-प्रिसिजन जनरल मैट्रिक्स मल्टीप्लिकेशन (HGEMM) की कई ऑप्टिमाइज़ेशन विधियाँ।

स्टार
568
फ़ोर्क
91
भाषा
Cuda
लाइसेंस
MIT
आख़िरी push
2 वर्ष पहले
Cudacudagpucublasgemmnvidiahgemmmatrix-multiplytensor-core

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।