ModelCloud/GPTQModel
@ModelCloudBoîte à outils de quantification (compression) de modèles LLM avec accélération matérielle pour GPU Nvidia, AMD, Intel et CPU Intel/AMD/Apple via HF, vLLM et SGLang.
Étoiles
1 248
Bifurcations
205
Langage
Python
Licence
NOASSERTION
Dernier push
il y a 5 jours
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.