scrya-com/rotorquant
@scrya-comNén bộ đệm KV thông qua xoay khối chéo. Vượt qua TurboQuant: PPL tốt hơn (6.91 so với 7.07), giải mã nhanh hơn 28%, tiền điền (prefill) nhanh hơn 5.3 lần, ít tham số hơn 44%. Tích hợp trực tiếp vào llama.cpp.
Sao
1.045
Fork
89
Ngôn ngữ
Python
Giấy phép
—
Push gần nhất
4 tháng trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.