Lompat ke konten utama
buildradar
Sign in

NVIDIA/TransformerEngine

@NVIDIA

Sebuah pustaka untuk mengakselerasi model Transformer pada GPU NVIDIA, termasuk menggunakan presisi floating point 8-bit dan 4-bit (FP8 dan FP4) pada GPU Hopper, Ada, dan Blackwell, untuk memberikan performa yang lebih baik dengan penggunaan memori yang lebih rendah baik dalam pelatihan maupun inferensi.

Bintang
3.509
Fork
814
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
2 hari yang lalu
Pythonpythonmachine-learningdeep-learningcudapytorchjaxgpufp8fp4

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.