Bruce-Lee-LY/cuda_hgemm
@Bruce-Lee-LYWMMA API और MMA PTX इंस्ट्रक्शन का उपयोग करके टेन्सर कोर के साथ हाफ-प्रिसिजन जनरल मैट्रिक्स मल्टीप्लिकेशन (HGEMM) की कई ऑप्टिमाइज़ेशन विधियाँ।
स्टार
568
फ़ोर्क
91
भाषा
Cuda
लाइसेंस
MIT
आख़िरी push
2 वर्ष पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।