NVIDIA/TransformerEngine
@NVIDIASebuah pustaka untuk mengakselerasi model Transformer pada GPU NVIDIA, termasuk menggunakan presisi floating point 8-bit dan 4-bit (FP8 dan FP4) pada GPU Hopper, Ada, dan Blackwell, untuk memberikan performa yang lebih baik dengan penggunaan memori yang lebih rendah baik dalam pelatihan maupun inferensi.
Bintang
3.509
Fork
814
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
2 hari yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.