Aller au contenu principal
buildradar
Se connecter

tomaarsen/attention_sinks

@tomaarsen

Étend les LLM existants bien au-delà de leur longueur d'entraînement d'origine avec une utilisation de mémoire constante, sans réentraînement

Étoiles
734
Bifurcations
44
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 2 ans
Pythonpythonllmllmstransformersnlp

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.