ModelCloud/GPTQModel
@ModelCloudKit de herramientas de cuantización (compresión) de modelos LLM con soporte de aceleración por hardware para GPU Nvidia, AMD, Intel y CPU Intel/AMD/Apple a través de HF, vLLM y SGLang.
Estrellas
1248
Bifurcaciones
205
Lenguaje
Python
Licencia
NOASSERTION
Último push
hace 6 días
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.