NVIDIA/TransformerEngine
@NVIDIAUna biblioteca para acelerar modelos Transformer en GPUs de NVIDIA, incluyendo el uso de precisión de punto flotante de 8 y 4 bits (FP8 y FP4) en GPUs Hopper, Ada y Blackwell, para ofrecer un mejor rendimiento con menor uso de memoria tanto en entrenamiento como en inferencia.
Estrellas
3509
Bifurcaciones
814
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 3 días
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.