tomaarsen/attention_sinks
@tomaarsenEstenda LLMs existentes muito além do comprimento de treinamento original com uso constante de memória, sem retreinamento
Estrelas
734
Bifurcações
44
Linguagem
Python
Licença
Apache-2.0
Último push
há 2 anos
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.