Saltar al contenido principal
buildradar
Iniciar sesión

tonbistudio/turboquant-pytorch

@tonbistudio

Implementación desde cero en PyTorch de TurboQuant de Google (ICLR 2026) para la compresión de caché KV en LLM. Compresión 5x a 3 bits con 99.5% de fidelidad de atención.

Estrellas
1044
Bifurcaciones
139
Lenguaje
Python
Licencia
MIT
Último push
hace 5 meses
Python

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.