NVIDIA/TransformerEngine
@NVIDIAUma biblioteca para acelerar modelos Transformer em GPUs NVIDIA, incluindo o uso de precisão de ponto flutuante de 8 bits e 4 bits (FP8 e FP4) em GPUs Hopper, Ada e Blackwell, proporcionando melhor desempenho com menor uso de memória tanto no treinamento quanto na inferência.
Estrelas
3.509
Bifurcações
814
Linguagem
Python
Licença
Apache-2.0
Último push
há 2 dias
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.