Chuyển tới nội dung chính
buildradar
Đăng nhập

tonbistudio/turboquant-pytorch

@tonbistudio

Triển khai từ đầu bằng PyTorch cho TurboQuant của Google (ICLR 2026) để nén KV cache LLM. Nén 5 lần ở mức 3-bit với độ trung thực chú ý 99,5%.

Sao
1.044
Fork
140
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
5 tháng trước
Python

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.