メインコンテンツへスキップ
buildradar
ログイン

tonbistudio/turboquant-pytorch

@tonbistudio

LLM KVキャッシュ圧縮のためのGoogle製 TurboQuant (ICLR 2026) のスクラッチからのPyTorch実装。3-bitで99.5%のアテンション忠実度を保ちながら5倍の圧縮を実現。

スター
1,044
フォーク
139
言語
Python
ライセンス
MIT
最終プッシュ
5 か月前
Python

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。