Zum Hauptinhalt springen
buildradar
Anmelden

Bruce-Lee-LY/cuda_hgemm

@Bruce-Lee-LY

Verschiedene Optimierungsmethoden für die allgemeine Matrixmultiplikation in halber Genauigkeit (HGEMM) unter Verwendung von Tensor Cores mit WMMA-API und MMA-PTX-Instruktionen.

Sterne
568
Forks
91
Sprache
Cuda
Lizenz
MIT
Letzter Push
vor 2 Jahren
Cudacudagpucublasgemmnvidiahgemmmatrix-multiplytensor-core

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.