跳到主要内容
buildradar
登录
主题 · cuda

cuda

标记 cuda 主题、收录中的开源项目,按星标数排序。

共 216 个项目
  • rust-cuda@Rust-GPU

    完整的 Rust 生态系,提供编写与执行高速 GPU 代码的库与工具。

    5,334+0近 7 天星标变化
  • cuml@NVIDIA

    NVIDIA cuML:GPU 加速的机器学习库

    5,269+0近 7 天星标变化
  • kaolin@NVIDIAGameWorks

    加速 3D 深度学习研究的 PyTorch 库。

    5,163+0近 7 天星标变化
  • nccl@NVIDIA

    为多 GPU 通讯优化的原语,支持集合运算。

    5,041+0近 7 天星标变化
  • arrayfire@arrayfire

    ArrayFire:通用 GPU 函式库。

    4,903+0近 7 天星标变化
  • CTranslate2@OpenNMT

    Transformer 模型的快速推理引擎

    4,658+0近 7 天星标变化
  • Tengine@OAID

    Tengine 是一个轻量、高效、模块化的推理引擎,适用于嵌入式装置

    4,533+0近 7 天星标变化
  • tiny-cuda-nn@NVlabs

    Lightning fast C++/CUDA 神经网络框架。

    4,530+0近 7 天星标变化
  • hip@ROCm

    HIP:C++ Heterogeneous‑Compute Interface for Portability

    4,395+0近 7 天星标变化
  • iree@iree-org

    可重定向的 MLIR 基础机器学习编译器与运行时工具包

    3,914+0近 7 天星标变化
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention 在速度上比 FlashAttention 提升 2-5 倍,且不损失语言、影像与影片模型的端到端指标

    3,699+0近 7 天星标变化
  • 从单一原生应用程序训练、检查、编辑、自动化并导出 3D 高斯喷射场景。

    3,645+0近 7 天星标变化
  • A library for accelerating Transformer models on NVIDIA GPUs, including using 8-bit and 4-bit floating point (FP8 and FP4) precision on Hopper, Ada and Blackwell GPUs, to provide better performance with lower memory utilization in both training and inference.

    3,518+0近 7 天星标变化
  • viseron@roflcoopter

    自托管、仅本地 NVR 和 AI 计算机视觉软件。具备物体检测、运动检测、人脸识别等功能,让你能够监控家中、办公室或任何你想监控的地方。

    3,468+0近 7 天星标变化
  • lygia@patriciogonzalezvivo

    LYGIA 是一个细粒度且支持多种语言(GLSL、HLSL、Metal、WGSL、WEGL 和 CUDA)的着色器库,专为性能与灵活性而设计

    3,423+0近 7 天星标变化
  • Remotery@Celtoys

    单一 C 文件,实时 CPU/GPU 分析器,带远程 Web 观察器

    3,312+0近 7 天星标变化
  • 如何在 CUDA 中优化某些算法。

    3,242+0近 7 天星标变化
  • jittor@Jittor

    Jittor 是一个基于 JIT 编译和元运算符的高性能深度学习框架

    3,232+0近 7 天星标变化
  • lc0@LeelaChessZero

    开源神经网络棋类引擎,支持GPU加速与广泛硬件

    3,197+0近 7 天星标变化
  • skills@NVIDIA

    适用于 NVIDIA 产品的 Agent Skills — 可安装至 Claude Code、Codex 及其他编码 Agent,以端到端运行物理 AI、机器人、模拟、CUDA 和 RAG 工作流。

    3,180+0近 7 天星标变化
  • cuda-oxide@NVlabs

    cuda-oxide 是一个实验性的 Rust 到 CUDA 编译器,让您能以安全且地道的 Rust 编写 (SIMT) GPU 内核。它直接将标准 Rust 代码编译为 PTX — 无需 DSL,无需外部语言绑定,纯粹是 Rust。

    3,118+0近 7 天星标变化
  • aresdb@uber

    GPU 加速的实时分析存储与查询引擎。

    3,076+0近 7 天星标变化
  • heavydb@heavyai

    HeavyDB(前身为 MapD/OmniSciDB)

    3,059+0近 7 天星标变化
  • ramalama@containers

    RamaLama 是一款开源开发者工具,通过大家熟悉的容器语言,简化了从任何来源在本地提供 AI 模型的流程,并促进其在生产环境中的推理应用。

    3,031+0近 7 天星标变化
  • TensorRT@pytorch

    使用 TensorRT 为 NVIDIA GPU 编译 PyTorch/TorchScript/FX 的编译器

    2,989+0近 7 天星标变化
  • ao@pytorch

    PyTorch 原生量化,用于训练和推理

    2,961+0近 7 天星标变化
  • MinkowskiEngine@NVIDIA

    Minkowski Engine 是一个用于高维稀疏张量的自动微分神经网络库

    2,957+0近 7 天星标变化
  • NVIDIA GPU Operator 用于在 Kubernetes 中创建、配置与管理 GPU

    2,857+0近 7 天星标变化
  • lucebox@Luce-Org

    适用于消费级与异构硬件的 LLM 推测式推理服务器

    2,829+0近 7 天星标变化
  • futhark@diku-dk

    一个数据平行的函数式编程语言

    2,794+0近 7 天星标变化
← 返回主题列表