linear-attention
Repositórios de código aberto acompanhados marcados com linear-attention, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de linear-attention no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com linear-attention.
- #1
Um Kimi K3 de 2,78 trilhões de parâmetros executando inferência em uma única CPU com 8,24 GB de RAM. C99 portátil: sem BLAS, sem framework, sem GPU.
★ 7.159
- #1
RWKV (pronuncia-se RwaKuv) é uma RNN com excelente desempenho em LLM, que também pode ser treinada diretamente como um transformer GPT (paralelizável). Estamos na versão RWKV-7 "Goose". Ele combina o melhor de RNN e transformer: ótimo desempenho, tempo linear, espaço constante (sem kv-cache), treinamento rápido, comprimento de contexto infinito e sentence embedding gratuito.
★ 14.695+12Variação de estrelas nos últimos 7 dias - #2
Um Kimi K3 de 2,78 trilhões de parâmetros executando inferência em uma única CPU com 8,24 GB de RAM. C99 portátil: sem BLAS, sem framework, sem GPU.
★ 7.159+493Variação de estrelas nos últimos 7 dias