tonbistudio/turboquant-pytorch
@tonbistudioImplementasi dari nol PyTorch untuk Google TurboQuant (ICLR 2026) guna kompresi cache KV LLM. Kompresi 5x pada 3-bit dengan fidelitas attention 99,5%.
Bintang
1.044
Fork
140
Bahasa
Python
Lisensi
MIT
Push terakhir
5 bulan yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.