Aller au contenu principal
buildradar
Se connecter

Bruce-Lee-LY/cuda_hgemm

@Bruce-Lee-LY

Plusieurs méthodes d'optimisation de la multiplication de matrices générales en demi-précision (HGEMM) utilisant les tensor cores avec l'API WMMA et l'instruction PTX MMA.

Étoiles
568
Bifurcations
91
Langage
Cuda
Licence
MIT
Dernier push
il y a 2 ans
Cudacudagpucublasgemmnvidiahgemmmatrix-multiplytensor-core

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.