Vahe1994/AQLM
@Vahe1994Dépôt officiel PyTorch pour la compression extrême de grands modèles de langage via la quantification additive (https://arxiv.org/pdf/2401.06118.pdf) et PV-Tuning : au-delà de l'estimation straight-through pour la compression extrême de LLM (https://arxiv.org/abs/2405.14852).
Étoiles
1 329
Bifurcations
194
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 6 mois
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.