tonbistudio/turboquant-pytorch
@tonbistudioImplementación desde cero en PyTorch de TurboQuant de Google (ICLR 2026) para la compresión de caché KV en LLM. Compresión 5x a 3 bits con 99.5% de fidelidad de atención.
Estrellas
1044
Bifurcaciones
139
Lenguaje
Python
Licencia
MIT
Último push
hace 5 meses
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.