NVIDIA/Model-Optimizer
@NVIDIAEine einheitliche Bibliothek für SOTA-Modelloptimierungstechniken wie Quantisierung, Distillation, Pruning, Neural Architecture Search, Speculative Decoding usw. Sie komprimiert Deep-Learning-Modelle für nachgeschaltete Bereitstellungsframeworks wie TensorRT-LLM, TensorRT, vLLM usw., um die Inferenzgeschwindigkeit zu optimieren.
Sterne
3.697
Forks
578
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 5 Tagen
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.