NVIDIA/TransformerEngine
@NVIDIANVIDIA GPU上のTransformerモデルを高速化するライブラリ。Hopper、Ada、Blackwell GPUでの8ビットおよび4ビット浮動小数点(FP8およびFP4)精度を利用し、学習と推論の両方でより低いメモリ使用量と優れたパフォーマンスを提供します。
スター
3,509
フォーク
814
言語
Python
ライセンス
Apache-2.0
最終プッシュ
3 日前
関連 Intel(0)
関連 Intel はまだありません
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。