メインコンテンツへスキップ
buildradar
ログイン

Bruce-Lee-LY/cuda_hgemm

@Bruce-Lee-LY

WMMA API と MMA PTX 命令を使用した Tensor Core による半精度汎用行列乗算 (HGEMM) のいくつかの最適化手法

スター
568
フォーク
91
言語
Cuda
ライセンス
MIT
最終プッシュ
2 年前
Cudacudagpucublasgemmnvidiahgemmmatrix-multiplytensor-core

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。