Zum Hauptinhalt springen
buildradar
Anmelden

tonbistudio/turboquant-pytorch

@tonbistudio

PyTorch-Implementierung von Googles TurboQuant (ICLR 2026) von Grund auf für die LLM-KV-Cache-Kompression. 5-fache Kompression bei 3 Bit und 99,5 % Attention-Fidelität.

Sterne
1.044
Forks
139
Sprache
Python
Lizenz
MIT
Letzter Push
vor 5 Monaten
Python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.