turboderp-org/exllamav3
@turboderp-orgUna biblioteca optimizada de cuantización e inferencia para ejecutar LLM localmente en GPU modernas de consumo.
Estrellas
1267
Bifurcaciones
146
Lenguaje
Python
Licencia
MIT
Último push
hace 6 días
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.