NVIDIA/Model-Optimizer
@NVIDIAUne bibliothèque unifiée de techniques d'optimisation SOTA telles que la quantification, la distillation, l'élagage, la recherche d'architecture neuronale et le décodage spéculatif. Elle compresse les modèles de deep learning pour des frameworks de déploiement comme TensorRT-LLM, TensorRT, vLLM, etc., afin d'optimiser la vitesse d'inférence.
Étoiles
3 697
Bifurcations
578
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 5 jours
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.