メインコンテンツへスキップ
buildradar
Sign in

NVIDIA/TransformerEngine

@NVIDIA

NVIDIA GPU上のTransformerモデルを高速化するライブラリ。Hopper、Ada、Blackwell GPUでの8ビットおよび4ビット浮動小数点(FP8およびFP4)精度を利用し、学習と推論の両方でより低いメモリ使用量と優れたパフォーマンスを提供します。

スター
3,509
フォーク
814
言語
Python
ライセンス
Apache-2.0
最終プッシュ
3 日前
Pythonpythonmachine-learningdeep-learningcudapytorchjaxgpufp8fp4

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。