Saltar al contenido principal
buildradar
Sign in
Tema · inference-acceleration

inference-acceleration

Repositorios de código abierto monitorizados etiquetados con inference-acceleration, ordenados por estrellas.

Repositorios
4
Estrellas totales
9747
Estrellas de media
2437
Proporción
0,00%

Temas que aparecen con frecuencia junto a inference-acceleration en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con inference-acceleration.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention logra una aceleración de 2 a 5 veces en comparación con FlashAttention, sin perder métricas de extremo a extremo en modelos de lenguaje, imagen y video.

    3699+14Variación de estrellas de los últimos 7 días
  • TurboDiffusion@thu-ml

    TurboDiffusion: Aceleración de 100 a 200 veces para modelos de difusión de video

    3634+6Variación de estrellas de los últimos 7 días
  • TeaCache@ali-vilab

    Timestep Embedding Tells: Es hora de implementar caché para modelos de difusión de video.

    1371+2Variación de estrellas de los últimos 7 días
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention: una atención dispersa sin entrenamiento que acelera la inferencia de cualquier modelo.

    1043+1Variación de estrellas de los últimos 7 días
← Volver a temas