Lompat ke konten utama
buildradar
Masuk

tonbistudio/turboquant-pytorch

@tonbistudio

Implementasi dari nol PyTorch untuk Google TurboQuant (ICLR 2026) guna kompresi cache KV LLM. Kompresi 5x pada 3-bit dengan fidelitas attention 99,5%.

Bintang
1.044
Fork
140
Bahasa
Python
Lisensi
MIT
Push terakhir
5 bulan yang lalu
Python

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.