Saltar al contenido principal
buildradar
Sign in

NVIDIA/TransformerEngine

@NVIDIA

Una biblioteca para acelerar modelos Transformer en GPUs de NVIDIA, incluyendo el uso de precisión de punto flotante de 8 y 4 bits (FP8 y FP4) en GPUs Hopper, Ada y Blackwell, para ofrecer un mejor rendimiento con menor uso de memoria tanto en entrenamiento como en inferencia.

Estrellas
3509
Bifurcaciones
814
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 3 días
Pythonpythonmachine-learningdeep-learningcudapytorchjaxgpufp8fp4

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.