deepseek-ai/FlashMLA
@deepseek-aiFlashMLA: Kernels eficientes de atención latente multikernel (Multi-head Latent Attention)
Estrellas
12.896
Bifurcaciones
1141
Lenguaje
C++
Licencia
MIT
Último push
hace 1 mes
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.