メインコンテンツへスキップ
buildradar
Sign in
トピック · flash-attention

flash-attention

flash-attention がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
10
総スター数
58,661
平均スター数
5,866
シェア
0.00%

flash-attention と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、flash-attention がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • Qwen@QwenLM

    Alibaba Cloudが提案するQwen (通义千问) チャットおよび事前学習済み大規模言語モデルの公式リポジトリ。

    21,688+32直近 7 日のスター増減
  • LeetCUDA@xlite-dev

    初心者向けのモダンなCUDA学習ノート(PyTorch使用)、200以上のCUDAカーネル、Tensor Cores、HGEMM、FA-2 MMA。

    11,875+39直近 7 日のスター増減
  • InternLM@InternLM

    InternLMシリーズ(InternLM, InternLM2, InternLM2.5, InternLM3)の公式リリース。

    7,277+8直近 7 日のスター増減
  • 中国語LLaMA-2 & Alpaca-2大規模モデルフェーズ2プロジェクト + 64K超長コンテキストモデル (Chinese LLaMA-2 & Alpaca-2 LLMs with 64K long context models)

    7,120+0直近 7 日のスター増減
  • Awesome-LLM-Inference@xlite-dev

    📚コード付きの素晴らしいLLM/VLM推論論文の厳選リスト:Flash-Attention、Paged-Attention、WINT8/4、Parallelismなど🎉

    5,482+4直近 7 日のスター増減
  • MoBA@MoonshotAI

    MoBA: 長コンテキストLLMのためのMixture of Block Attention

    2,174+5直近 7 日のスター増減
  • cudnn-frontend@NVIDIA

    cuDNN Frontendは、NVIDIAによるcuDNNライブラリへのモダンでオープンソースなエントリーポイントであり、高性能なオープンソースカーネルのコレクションを拡大しています。

    929+7直近 7 日のスター増減
  • rcm@NVlabs

    大規模な双方向/自己回帰ビデオ拡散モデルの蒸留に向けた、主導的かつ統合されたアルゴリズムおよびインフラストラクチャ(rCM & Causal-rCM)

    800+6直近 7 日のスター増減
  • トレーニング可能で高速かつメモリ効率の良いスパースアテンション

    761+9直近 7 日のスター増減
  • tessera@zengxiao-he

    教師モデルからタイルまで — フルスクラッチのLLM蒸留・サービングエンジン:カスタムTriton/CUDAカーネル、FSDP蒸留、ページ化KV連続バッチ処理、推測デコーディング、Rustゲートウェイ、JAXオラクル、および解釈可能性ツール。

    566+46直近 7 日のスター増減
← トピック一覧に戻る