Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · cuda

cuda

Các kho mã nguồn mở đang theo dõi được gắn thẻ cuda, sắp xếp theo số sao.

216 kho mã
  • rust-cuda@Rust-GPU

    Hệ sinh thái các thư viện và công cụ để viết và thực thi mã GPU nhanh hoàn toàn bằng Rust.

    5.334+0Thay đổi số sao trong 7 ngày qua
  • cuml@NVIDIA

    NVIDIA cuML: Học máy tăng tốc bằng GPU

    5.269+0Thay đổi số sao trong 7 ngày qua
  • kaolin@NVIDIAGameWorks

    Thư viện PyTorch để tăng tốc nghiên cứu học sâu 3D

    5.163+0Thay đổi số sao trong 7 ngày qua
  • nccl@NVIDIA

    Các hàm nguyên thủy được tối ưu hóa cho giao tiếp đa GPU tập thể

    5.041+0Thay đổi số sao trong 7 ngày qua
  • arrayfire@arrayfire

    ArrayFire: một thư viện GPU đa năng.

    4.903+0Thay đổi số sao trong 7 ngày qua
  • CTranslate2@OpenNMT

    Côngemy suy luận nhanh cho các mô hình Transformer

    4.658+0Thay đổi số sao trong 7 ngày qua
  • Tengine@OAID

    Tengine là một công cụ suy luận mô-đun, hiệu năng cao, gọn nhẹ dành cho thiết bị nhúng.

    4.533+0Thay đổi số sao trong 7 ngày qua
  • tiny-cuda-nn@NVlabs

    Khung mạng neural C++/CUDA cực nhanh

    4.530+0Thay đổi số sao trong 7 ngày qua
  • hip@ROCm

    HIP: Giao diện tính toán dị thể C++ để chuyển Ứng dụng

    4.395+0Thay đổi số sao trong 7 ngày qua
  • iree@iree-org

    Một bộ công cụ thời gian chạy và trình biên dịch máy học dựa trên MLIR có thể tái định hướng.

    3.914+0Thay đổi số sao trong 7 ngày qua
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention đạt tốc độ xử lý nhanh hơn 2-5 lần so với FlashAttention, mà không làm giảm các chỉ số tổng thể trên các mô hình ngôn ngữ, hình ảnh và video.

    3.699+0Thay đổi số sao trong 7 ngày qua
  • Đào tạo, kiểm tra, chỉnh sửa, tự động hóa và xuất các cảnh 3D Gaussian Splatting từ một ứng dụng gốc duy nhất.

    3.645+0Thay đổi số sao trong 7 ngày qua
  • Một thư viện tăng tốc các mô hình Transformer trên GPU NVIDIA, bao gồm sử dụng độ chính xác dấu phẩy động 8-bit và 4-bit (FP8 và FP4) trên GPU Hopper, Ada và Blackwell, nhằm cung cấp hiệu suất tốt hơn với mức sử dụng bộ nhớ thấp hơn trong cả quá trình huấn luyện và suy luận.

    3.518+0Thay đổi số sao trong 7 ngày qua
  • viseron@roflcoopter

    Phần mềm NVR và Thị giác máy tính AI tự lưu trữ, chỉ chạy cục bộ. Với các tính năng như phát hiện đối tượng, phát hiện chuyển động, nhận diện khuôn mặt và nhiều tính năng khác, giúp bạn giám sát ngôi nhà, văn phòng hoặc bất kỳ nơi nào bạn muốn.

    3.468+0Thay đổi số sao trong 7 ngày qua
  • lygia@patriciogonzalezvivo

    LYGIA là một thư viện shader dạng hạt và đa ngôn ngữ (GLSL, HLSL, Metal, WGSL, WEGL và CUDA) được thiết kế cho hiệu suất và tính linh hoạt

    3.423+0Thay đổi số sao trong 7 ngày qua
  • Remotery@Celtoys

    Tệp C duy nhân, Trình cấu hình CPU/GPU thời gian thực với Trình xem Web từ xa

    3.312+0Thay đổi số sao trong 7 ngày qua
  • cách tối ưu hóa một số thuật toán trong CUDA.

    3.242+0Thay đổi số sao trong 7 ngày qua
  • jittor@Jittor

    Jittor là một framework học sâu hiệu năng cao dựa trên biên dịch JIT và meta-operator.

    3.232+0Thay đổi số sao trong 7 ngày qua
  • lc0@LeelaChessZero

    Công cụ chơi cờ vua bằng mạng nơ-ron mã nguồn mở với khả năng tăng tốc GPU và hỗ trợ phần cứng rộng rãi.

    3.197+0Thay đổi số sao trong 7 ngày qua
  • skills@NVIDIA

    Kỹ năng Agent dành cho sản phẩm NVIDIA — cài đặt vào Claude Code, Codex và các coding agent khác để chạy toàn diện các luồng công việc về AI vật lý, robot, mô phỏng, CUDA và RAG.

    3.180+0Thay đổi số sao trong 7 ngày qua
  • cuda-oxide@NVlabs

    cuda-oxide là một trình biên dịch thử nghiệm từ Rust sang CUDA cho phép bạn viết các kernel GPU (SIMT) bằng mã Rust an toàn (tương đối), chuẩn mực. Nó biên dịch mã Rust tiêu chuẩn trực tiếp thành PTX — không cần DSL, không cần liên kết ngôn ngữ khác, chỉ thuần túy là Rust.

    3.118+0Thay đổi số sao trong 7 ngày qua
  • aresdb@uber

    Kho lưu trữ phân tích thời gian thực được hỗ trợ bởi GPU và công cụ truy vấn.

    3.076+0Thay đổi số sao trong 7 ngày qua
  • heavydb@heavyai

    HeavyDB (trước đây là MapD/OmniSciDB)

    3.059+0Thay đổi số sao trong 7 ngày qua
  • ramalama@containers

    RamaLama là công cụ dành cho nhà phát triển mã nguồn mở giúp đơn giản hóa việc triển khai cục bộ các mô hình AI từ mọi nguồn và hỗ trợ sử dụng chúng để suy luận trong môi trường production, tất cả thông qua cú pháp quen thuộc của container.

    3.031+0Thay đổi số sao trong 7 ngày qua
  • TensorRT@pytorch

    Trình biên dịch PyTorch/TorchScript/FX cho GPU NVIDIA sử dụng TensorRT

    2.989+0Thay đổi số sao trong 7 ngày qua
  • ao@pytorch

    Lượng tử hóa gốc bằng PyTorch cho việc huấn luyện và suy luận

    2.961+0Thay đổi số sao trong 7 ngày qua
  • MinkowskiEngine@NVIDIA

    Minkowski Engine là một thư viện mạng nơ-ron tự động tính đạo hàm (auto-diff) cho tensor thưa chiều cao

    2.957+0Thay đổi số sao trong 7 ngày qua
  • NVIDIA GPU Operator tạo, cấu hình và quản lý GPU trong Kubernetes

    2.857+0Thay đổi số sao trong 7 ngày qua
  • lucebox@Luce-Org

    Máy chủ suy luận phỏng đoán LLM cho phần cứng tiêu dùng và không đồng nhất

    2.829+0Thay đổi số sao trong 7 ngày qua
  • futhark@diku-dk

    :boom::computer::boom: Một ngôn ngữ lập trình hàm song song dữ liệu

    2.794+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề