Saltar al contenido principal
buildradar
Sign in
Tema · flash-attention

flash-attention

Repositorios de código abierto monitorizados etiquetados con flash-attention, ordenados por estrellas.

Repositorios
10
Estrellas totales
58.661
Estrellas de media
5866
Proporción
0,00%

Temas que aparecen con frecuencia junto a flash-attention en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con flash-attention.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • Qwen@QwenLM

    El repositorio oficial de Qwen (通义千问) chat y modelo de lenguaje grande preentrenado propuesto por Alibaba Cloud.

    21.688+14Variación de estrellas de los últimos 7 días
  • LeetCUDA@xlite-dev

    Notas de aprendizaje de CUDA moderno con PyTorch para principiantes, más de 200 CUDA Kernels, Tensor Cores, HGEMM, FA-2 MMA.

    11.875+25Variación de estrellas de los últimos 7 días
  • InternLM@InternLM

    Lanzamiento oficial de la serie InternLM (InternLM, InternLM2, InternLM2.5, InternLM3).

    7277+4Variación de estrellas de los últimos 7 días
  • Proyecto de segunda fase de LLaMA-2 y Alpaca-2 en chino + modelo de contexto ultra largo de 64K (LLaMA-2 y Alpaca-2 LLMs en chino con modelos de contexto largo de 64K)

    7120+0Variación de estrellas de los últimos 7 días
  • Awesome-LLM-Inference@xlite-dev

    📚 Una lista seleccionada de los mejores artículos de inferencia LLM/VLM con código: Flash-Attention, Paged-Attention, WINT8/4, paralelismo, etc. 🎉

    5482+3Variación de estrellas de los últimos 7 días
  • MoBA@MoonshotAI

    MoBA: Mixture of Block Attention para LLMs de contexto largo

    2174+1Variación de estrellas de los últimos 7 días
  • cudnn-frontend@NVIDIA

    cuDNN Frontend es el punto de entrada moderno y de código abierto de NVIDIA a la biblioteca cuDNN y a una creciente colección de kernels de alto rendimiento.

    929+11Variación de estrellas de los últimos 7 días
  • rcm@NVlabs

    rCM y Causal-rCM: Algoritmos e infraestructuras unificadas y líderes para la destilación de difusión de video bidireccional/autorregresiva a gran escala

    800+6Variación de estrellas de los últimos 7 días
  • Atención dispersa entrenable, rápida y eficiente en memoria

    761+11Variación de estrellas de los últimos 7 días
  • tessera@zengxiao-he

    De profesor a tiles: un motor de destilación y servicio de LLM creado desde cero: kernels personalizados de Triton/CUDA, destilación FSDP, procesamiento por lotes continuo paged-KV, decodificación especulativa, una puerta de enlace en Rust, un oráculo JAX y herramientas de interpretabilidad.

    566+30Variación de estrellas de los últimos 7 días
← Volver a temas