NVIDIA/Model-Optimizer
@NVIDIAUma biblioteca unificada de técnicas de otimização de modelos SOTA, como quantização, destilação, poda, busca de arquitetura neural, decodificação especulativa, etc. Compacta modelos de deep learning para frameworks de implantação downstream, como TensorRT-LLM, TensorRT, vLLM, etc., a fim de otimizar a velocidade de inferência.
Estrelas
3.697
Bifurcações
578
Linguagem
Python
Licença
Apache-2.0
Último push
há 5 dias
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.