Saltar al contenido principal
buildradar
Iniciar sesión

tomaarsen/attention_sinks

@tomaarsen

Extiende LLMs existentes mucho más allá de su longitud de entrenamiento original con un uso de memoria constante y sin necesidad de reentrenamiento

Estrellas
734
Bifurcaciones
44
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 2 años
Pythonpythonllmllmstransformersnlp

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.