tomaarsen/attention_sinks
@tomaarsenExtiende LLMs existentes mucho más allá de su longitud de entrenamiento original con un uso de memoria constante y sin necesidad de reentrenamiento
Estrellas
734
Bifurcaciones
44
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 2 años
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.