Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · cuda

cuda

Các kho mã nguồn mở đang theo dõi được gắn thẻ cuda, sắp xếp theo số sao.

216 kho mã
  • tt-metal@tenstorrent

    Thư viện toán tử TT-NN và mô hình lập trình kernel cấp thấp TT-Metalium.

    1.655+0Thay đổi số sao trong 7 ngày qua
  • gpu-hot@psalias2006

    🔥 Bảng điều khiển GPU NVIDIA thời gian thực

    1.625+0Thay đổi số sao trong 7 ngày qua
  • thundersvm@Xtra-Computing

    ThunderSVM: Thư viện SVM nhanh trên GPU và CPU

    1.622+0Thay đổi số sao trong 7 ngày qua
  • mnn-llm@wangzhaode

    Dự án triển khai LLM dựa trên MNN. Dự án này đã được hợp nhất vào MNN.

    1.617+0Thay đổi số sao trong 7 ngày qua
  • InferenceX@SemiAnalysisAI

    Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & sắp ra mắt™ TPUv6e/v7/Trainium2/3 | Nền tảng nghiên cứu benchmark suy luận liên tục mã nguồn mở — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, sắp ra mắt™ TPUv6e/v7/Trainium2/3

    1.613+0Thay đổi số sao trong 7 ngày qua
  • 3d-ken-burns@sniklaus

    Triển khai Hiệu ứng 3D Ken Burns từ một Ảnh đơn sử dụng PyTorch

    1.569+0Thay đổi số sao trong 7 ngày qua
  • autokernel@RightNow-AI

    Tự động nghiên cứu cho các GPU kernel. Cung cấp bất kỳ mô hình PyTorch nào, đi ngủ và thức dậy với các Triton kernel được tối ưu hóa.

    1.545+0Thay đổi số sao trong 7 ngày qua
  • uccl@uccl-project

    UCCL là một thư viện giao tiếp hiệu quả dành cho GPU, bao gồm các hoạt động tập thể, P2P (ví dụ: truyền bộ đệm KV, truyền trọng số RL) và EP (ví dụ: do GPU điều khiển)

    1.502+0Thay đổi số sao trong 7 ngày qua
  • TornadoVM@beehive-lab

    Viết bằng Java. Chạy trên GPU. Tốc độ cao.

    1.492+0Thay đổi số sao trong 7 ngày qua
  • 🔥🔥🔥 TensorRT cho YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS...... 🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎

    1.460+0Thay đổi số sao trong 7 ngày qua
  • MatX@NVIDIA

    Thư viện tính toán số học GPU C++20 hiệu quả với cú pháp giống Python

    1.444+0Thay đổi số sao trong 7 ngày qua
  • Tự triển khai mô hình Chatterbox TTS mạnh mẽ. Máy chủ này cung cấp Web UI thân thiện với người dùng, các điểm cuối API linh hoạt (bao gồm tương thích với OpenAI), giọng đọc có sẵn, nhân bản giọng nói và xử lý văn bản quy mô sách nói lớn. Chạy tăng tốc trên NVIDIA (CUDA), AMD (ROCm) và CPU.

    1.427+0Thay đổi số sao trong 7 ngày qua
  • CUDA.jl@JuliaGPU

    Lập trình CUDA trong Julia.

    1.426+0Thay đổi số sao trong 7 ngày qua
  • Arraymancer@mratsim

    Một thư viện tensor nhanh chóng, tiện dụng và di động bằng Nim tập trung vào học sâu cho CPU, GPU và các thiết bị nhúng thông qua các backend OpenMP, Cuda và OpenCL

    1.407+0Thay đổi số sao trong 7 ngày qua
  • flux@bytedance

    Một thư viện chồng lấp giao tiếp nhanh dành cho tính song parallel tensor/expert trên GPU.

    1.358+0Thay đổi số sao trong 7 ngày qua
  • LuxCore@LuxCoreRender

    Kho mã nguồn LuxCore

    1.323+0Thay đổi số sao trong 7 ngày qua
  • stable-fast@chengzeyi

    https://wavespeed.ai/ Khung tối ưu hóa hiệu suất suy luận tốt nhất cho HuggingFace Diffusers trên GPU NVIDIA.

    1.304+0Thay đổi số sao trong 7 ngày qua
  • stdgpu@stotko

    stdgpu: Cấu trúc dữ liệu kiểu STL hiệu quả trên GPU

    1.270+0Thay đổi số sao trong 7 ngày qua
  • graphvite@DeepGraphLearning

    GraphVite: Hệ thống nhúng đồ thị tổng quát và hiệu năng cao

    1.269+0Thay đổi số sao trong 7 ngày qua
  • ffmpeg-build-script@markus-perl

    Kịch bản dựng FFmpeg cung cấp một cách dễ dàng để xây dựng FFmpeg tĩnh trên OSX và Linux bao gồm các codec không miễn phí.

    1.215+0Thay đổi số sao trong 7 ngày qua
  • cudarc@chelsea0x3b

    Trình bao bọc Rust an toàn quanh CUDA toolkit

    1.214+0Thay đổi số sao trong 7 ngày qua
  • oneAPI-samples@oneapi-src

    Mã nguồn mẫu cho Intel® oneAPI Toolkits

    1.162+0Thay đổi số sao trong 7 ngày qua
  • pyopencl@inducer

    Tích hợp OpenCL cho Python, kèm theo nhiều tính năng hấp dẫn

    1.150+0Thay đổi số sao trong 7 ngày qua
  • juice@fff-rs

    Công cụ Machine Learning dành cho Hacker

    1.132+0Thay đổi số sao trong 7 ngày qua
  • neanderthal@uncomplicate

    Thư viện Matrix cho Clojure có tốc độ nhanh

    1.128+0Thay đổi số sao trong 7 ngày qua
  • sglang-omni@sgl-project

    SGLang-Omni hỗ trợ phục vụ hiệu suất cao cho TTS, ASR, các mô hình giọng nói và đa năng (omni).

    1.118+56Thay đổi số sao trong 7 ngày qua
  • tiny-vllm@jmaczan

    Xây dựng công cụ suy luận LLM hiệu suất cao của riêng bạn bằng C++ và CUDA - một phiên bản nhỏ hơn của vLLM

    1.104+10Thay đổi số sao trong 7 ngày qua
  • gunrock@gunrock

    Phân tích đồ thị GPU CUDA/C++ có thể lập trình

    1.097+0Thay đổi số sao trong 7 ngày qua
  • cupoch@neka-nat

    Robot với điện toán GPU

    1.063+1Thay đổi số sao trong 7 ngày qua
  • LuisaCompute@LuisaGroup

    Framework kết xuất hiệu năng cao trên kiến trúc luồng dữ liệu

    1.044+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề