跳到主要内容
buildradar
Sign in
主题 · flash-attention

flash-attention

标记 flash-attention 主题、收录中的开源项目,按星标数排序。

项目数
10
总星标数
58,661
平均星标数
5,866
占比
0.00%

常跟 flash-attention 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 flash-attention 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • Qwen@QwenLM

    Qwen(通义千问)聊天与预训练大型语言模型的官方仓库,由阿里云提出

    21,688+14近 7 天星标变化
  • LeetCUDA@xlite-dev

    现代 CUDA 学习笔记,配合 PyTorch,适合初学者,包含 200 多个 CUDA 核心、Tensor Cores、HGEMM、FA-2 MMA。

    11,875+25近 7 天星标变化
  • InternLM@InternLM

    InternLM 系列正式发布(InternLM、InternLM2、InternLM2.5、InternLM3)

    7,277+4近 7 天星标变化
  • 中文 LLaMA-2 与 Alpaca-2 大模型二期项目 + 64K 超长上下文模型

    7,120+0近 7 天星标变化
  • Awesome-LLM-Inference@xlite-dev

    📚 精选Awesome LLM/VLM推理论文与代码清单:Flash-Attention、Paged-Attention、WINT8/4、Parallelism等。🎉

    5,482+3近 7 天星标变化
  • MoBA@MoonshotAI

    MoBA:长文本 LLM 的区块注意力混合模型

    2,174+1近 7 天星标变化
  • cudnn-frontend@NVIDIA

    cuDNN Frontend 是 NVIDIA 的现代化开源 cuDNN 库入口,并提供日益增加的高性能开源核心集合。

    932+13近 7 天星标变化
  • rcm@NVlabs

    rCM 与 Causal-rCM:大规模双向/自回归视频扩散蒸馏的领先与统一算法/基础设施

    800+6近 7 天星标变化
  • 可训练、快速且内存效率高的稀疏注意力机制

    761+10近 7 天星标变化
  • tessera@zengxiao-he

    从教师模型到模型切片——从零开始的 LLM 蒸馏与服务引擎:包含自定义 Triton/CUDA 内核、FSDP 蒸馏、paged-KV 连续批处理、推测解码、Rust 网关、JAX 预测器与可解释性工具。

    566+30近 7 天星标变化
← 返回主题列表