跳到主要內容
buildradar
Sign in
主題 · flash-attention

flash-attention

標記 flash-attention 主題、收錄中的開源專案,依星數排序。

專案數
10
總星數
58,661
平均星數
5,866
佔比
0.00%

常跟 flash-attention 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 flash-attention 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • Qwen@QwenLM

    Qwen(通義千問)聊天與預訓練大型語言模型的官方倉庫,由阿里雲提出

    21,688+32近 7 天星數變化
  • LeetCUDA@xlite-dev

    適合初學者的現代 CUDA 學習筆記,搭配 PyTorch,包含 200 多個 CUDA 核心、Tensor Cores、HGEMM、FA-2 MMA。

    11,875+39近 7 天星數變化
  • InternLM@InternLM

    InternLM 系列正式發布(InternLM、InternLM2、InternLM2.5、InternLM3)

    7,277+8近 7 天星數變化
  • 中文 LLaMA-2 與 Alpaca-2 大模型二期專案 + 64K 超長上下文模型

    7,120+0近 7 天星數變化
  • Awesome-LLM-Inference@xlite-dev

    📚 精選Awesome LLM/VLM推理論文與程式碼清單:Flash-Attention、Paged-Attention、WINT8/4、Parallelism等。🎉

    5,482+4近 7 天星數變化
  • MoBA@MoonshotAI

    MoBA:長文本 LLM 的區塊注意力混合模型

    2,174+5近 7 天星數變化
  • cudnn-frontend@NVIDIA

    cuDNN Frontend 是 NVIDIA 的現代化開源 cuDNN 函式庫入口,並提供日益增加的高效能開源核心集合。

    929+7近 7 天星數變化
  • rcm@NVlabs

    rCM 與 Causal-rCM:大規模雙向/自迴歸影片擴散蒸餾的領先與統一演算法/基礎設施

    800+6近 7 天星數變化
  • 可訓練、快速且記憶體效率高的稀疏注意力機制

    761+9近 7 天星數變化
  • tessera@zengxiao-he

    從教師模型到模型切片——從零開始的 LLM 蒸餾與服務引擎:包含自訂 Triton/CUDA 核心、FSDP 蒸餾、paged-KV 連續批次處理、推測解碼、Rust 閘道、JAX 預測器與可解釋性工具。

    566+46近 7 天星數變化
← 返回主題列表