Bruce-Lee-LY/cuda_hgemm
@Bruce-Lee-LYPlusieurs méthodes d'optimisation de la multiplication de matrices générales en demi-précision (HGEMM) utilisant les tensor cores avec l'API WMMA et l'instruction PTX MMA.
Étoiles
568
Bifurcations
91
Langage
Cuda
Licence
MIT
Dernier push
il y a 2 ans
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.