Zum Hauptinhalt springen
buildradar
Sign in

NVIDIA/Model-Optimizer

@NVIDIA

Eine einheitliche Bibliothek für SOTA-Modelloptimierungstechniken wie Quantisierung, Distillation, Pruning, Neural Architecture Search, Speculative Decoding usw. Sie komprimiert Deep-Learning-Modelle für nachgeschaltete Bereitstellungsframeworks wie TensorRT-LLM, TensorRT, vLLM usw., um die Inferenzgeschwindigkeit zu optimieren.

Sterne
3.697
Forks
578
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 5 Tagen
Python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.