Bruce-Lee-LY/cuda_hgemm
@Bruce-Lee-LYVerschiedene Optimierungsmethoden für die allgemeine Matrixmultiplikation in halber Genauigkeit (HGEMM) unter Verwendung von Tensor Cores mit WMMA-API und MMA-PTX-Instruktionen.
Sterne
568
Forks
91
Sprache
Cuda
Lizenz
MIT
Letzter Push
vor 2 Jahren
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.