deepseek-ai/FlashMLA
@deepseek-aiFlashMLA: Kernels eficientes de Multi-head Latent Attention
Estrelas
12.896
Bifurcações
1.141
Linguagem
C++
Licença
MIT
Último push
há 1 mês
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.