Aller au contenu principal
buildradar
Sign in
Sujet · flash-attention

flash-attention

Dépôts open source suivis étiquetés flash-attention, triés par étoiles.

Dépôts
10
Total d'étoiles
58 661
Étoiles en moyenne
5 866
Part
0,00%

Sujets qui apparaissent souvent aux côtés de flash-attention sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés flash-attention.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • Qwen@QwenLM

    Le dépôt officiel de Qwen (通义千问), un modèle de langage étendu de chat et pré-entraîné proposé par Alibaba Cloud.

    21 688+14Évolution des étoiles sur les 7 derniers jours
  • LeetCUDA@xlite-dev

    Notes d'apprentissage modernes sur CUDA avec PyTorch pour débutants, incluant plus de 200 noyaux CUDA, Tensor Cores, HGEMM, FA-2 MMA.

    11 875+25Évolution des étoiles sur les 7 derniers jours
  • InternLM@InternLM

    Publication officielle de la série InternLM (InternLM, InternLM2, InternLM2.5, InternLM3).

    7 277+4Évolution des étoiles sur les 7 derniers jours
  • Projet de phase 2 pour les grands modèles LLaMA-2 et Alpaca-2 en chinois, incluant des modèles avec un contexte étendu de 64K.

    7 120+0Évolution des étoiles sur les 7 derniers jours
  • Awesome-LLM-Inference@xlite-dev

    Liste organisée d'articles de recherche sur l'inférence LLM/VLM avec code : Flash-Attention, Paged-Attention, WINT8/4, parallélisme, etc.

    5 482+3Évolution des étoiles sur les 7 derniers jours
  • MoBA@MoonshotAI

    MoBA : Mixture of Block Attention pour les LLM à long contexte

    2 174+1Évolution des étoiles sur les 7 derniers jours
  • cudnn-frontend@NVIDIA

    cuDNN Frontend est le point d'entrée moderne et open-source de NVIDIA vers la bibliothèque cuDNN et une collection croissante de noyaux open-source haute performance.

    929+11Évolution des étoiles sur les 7 derniers jours
  • rcm@NVlabs

    rCM & Causal-rCM : Algorithmes et infrastructures de pointe unifiés pour la distillation de diffusion vidéo bidirectionnelle/autorégressive à grande échelle

    800+6Évolution des étoiles sur les 7 derniers jours
  • Attention creuse (sparse attention) entraînable, rapide et économe en mémoire

    761+11Évolution des étoiles sur les 7 derniers jours
  • tessera@zengxiao-he

    From teacher to tiles — a from-scratch LLM distillation & serving engine: custom Triton/CUDA kernels, FSDP distillation, paged-KV continuous batching, speculative decoding, a Rust gateway, a JAX oracle, and interpretability tooling.

    566+30Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets