Saltar al contenido principal
buildradar
Iniciar sesión

Bruce-Lee-LY/cuda_hgemm

@Bruce-Lee-LY

Varios métodos de optimización para multiplicación de matrices generales de media precisión (HGEMM) utilizando Tensor Core con la API WMMA y la instrucción MMA PTX.

Estrellas
568
Bifurcaciones
91
Lenguaje
Cuda
Licencia
MIT
Último push
hace 2 años
Cudacudagpucublasgemmnvidiahgemmmatrix-multiplytensor-core

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.