Zum Hauptinhalt springen
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

LLM-Modell-Quantisierungs- (Kompprimierungs-) Toolkit mit Hardware-Beschleunigungsunterstützung für Nvidia-, AMD-, Intel-GPUs und Intel/AMD/Apple-CPUs über HF, vLLM und SGLang.

Sterne
1.248
Forks
204
Sprache
Python
Lizenz
NOASSERTION
Letzter Push
vor 3 Tagen
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.