NVIDIA/Model-Optimizer
@NVIDIAUna librería unificada de técnicas de optimización de modelos SOTA como cuantización, destilación, poda, búsqueda de arquitectura neuronal, decodificación especulativa, etc. Comprime modelos de deep learning para frameworks de implementación posteriores como TensorRT-LLM, TensorRT, vLLM, etc., para optimizar la velocidad de inferencia.
Estrellas
3697
Bifurcaciones
578
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 5 días
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.