Zum Hauptinhalt springen
buildradar
Anmelden
Thema · cuda

cuda

Erfasste Open-Source-Repos mit dem Tag cuda, sortiert nach Sternen.

216 Repos
  • tt-metal@tenstorrent

    :metal: TT-NN-Operatorenbibliothek und TT-Metalium Low-Level-Kernel-Programmiermodell.

    1.655+0Sterne-Änderung der letzten 7 Tage
  • gpu-hot@psalias2006

    🔥 Echtzeit-NVIDIA-GPU-Dashboard

    1.625+0Sterne-Änderung der letzten 7 Tage
  • thundersvm@Xtra-Computing

    ThunderSVM: Eine schnelle SVM-Bibliothek für GPUs und CPUs

    1.622+0Sterne-Änderung der letzten 7 Tage
  • mnn-llm@wangzhaode

    LLM-Bereitstellungsprojekt basierend auf MNN. Dieses Projekt wurde in MNN integriert.

    1.617+0Sterne-Änderung der letzten 7 Tage
  • InferenceX@SemiAnalysisAI

    Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3

    1.613+0Sterne-Änderung der letzten 7 Tage
  • 3d-ken-burns@sniklaus

    Eine Implementierung des 3D-Ken-Burns-Effekts aus einem einzelnen Bild mit PyTorch

    1.569+0Sterne-Änderung der letzten 7 Tage
  • autokernel@RightNow-AI

    Automatische Forschung für GPU-Kernel. Gib ihm ein beliebiges PyTorch-Modell, geh schlafen und wache mit optimierten Triton-Kerneln auf.

    1.545+0Sterne-Änderung der letzten 7 Tage
  • uccl@uccl-project

    UCCL ist eine effiziente Kommunikationsbibliothek für GPUs, die Collectives, P2P (z. B. KV-Cache-Transfer, RL-Gewichtetransfer) und EP (z. B. GPU-gesteuert) abdeckt.

    1.502+0Sterne-Änderung der letzten 7 Tage
  • TornadoVM@beehive-lab

    Java schreiben. Auf GPUs ausführen. Schnell.

    1.492+0Sterne-Änderung der letzten 7 Tage
  • 🔥🔥🔥 TensorRT für YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS...... 🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎

    1.460+0Sterne-Änderung der letzten 7 Tage
  • MatX@NVIDIA

    Eine effiziente C++20-GPU-Bibliothek für numerisches Rechnen mit Python-ähnlicher Syntax

    1.444+0Sterne-Änderung der letzten 7 Tage
  • Hosten Sie das leistungsstarke Chatterbox TTS-Modell selbst. Dieser Server bietet eine benutzerfreundliche Web-UI, flexible API-Endpunkte (inkl. OpenAI-Kompatibilität), vordefinierte Stimmen, Klonen von Stimmen und Textverarbeitung im Umfang großer Hörbücher. Läuft beschleunigt auf NVIDIA (CUDA), AMD (ROCm) und CPU.

    1.427+0Sterne-Änderung der letzten 7 Tage
  • CUDA.jl@JuliaGPU

    CUDA-Programmierung in Julia.

    1.426+0Sterne-Änderung der letzten 7 Tage
  • Arraymancer@mratsim

    Eine schnelle, ergonomische und portable Tensor-Bibliothek in Nim mit Fokus auf Deep Learning für CPU, GPU und eingebettete Geräte über OpenMP-, Cuda- und OpenCL-Backends

    1.407+0Sterne-Änderung der letzten 7 Tage
  • flux@bytedance

    Eine schnelle, kommunikationsüberlappende Bibliothek für Tensor- und Experten-Parallelität auf GPUs.

    1.358+0Sterne-Änderung der letzten 7 Tage
  • LuxCore@LuxCoreRender

    LuxCore-Quellcode-Repository

    1.323+0Sterne-Änderung der letzten 7 Tage
  • stable-fast@chengzeyi

    https://wavespeed.ai/ Das beste Framework zur Inferenz-Leistungsoptimierung für HuggingFace Diffusers auf NVIDIA-GPUs.

    1.304+0Sterne-Änderung der letzten 7 Tage
  • stdgpu@stotko

    stdgpu: Effiziente STL-ähnliche Datenstrukturen auf der GPU

    1.270+0Sterne-Änderung der letzten 7 Tage
  • graphvite@DeepGraphLearning

    GraphVite: Ein allgemeines und hochleistungsfähiges Graph-Embedding-System

    1.269+0Sterne-Änderung der letzten 7 Tage
  • ffmpeg-build-script@markus-perl

    Das FFmpeg-Build-Skript bietet eine einfache Möglichkeit, ein statisches FFmpeg auf OSX und Linux einschließlich nicht-freier Codecs zu erstellen.

    1.215+0Sterne-Änderung der letzten 7 Tage
  • cudarc@chelsea0x3b

    Sicherer Rust-Wrapper für das CUDA-Toolkit

    1.214+0Sterne-Änderung der letzten 7 Tage
  • oneAPI-samples@oneapi-src

    Beispiele für Intel® oneAPI Toolkits

    1.162+0Sterne-Änderung der letzten 7 Tage
  • pyopencl@inducer

    OpenCL-Integration für Python sowie nützliche Zusatzfunktionen

    1.150+0Sterne-Änderung der letzten 7 Tage
  • juice@fff-rs

    Die Machine-Learning-Engine für Hacker

    1.131+0Sterne-Änderung der letzten 7 Tage
  • neanderthal@uncomplicate

    Schnelle Clojure-Matrix-Bibliothek

    1.128+0Sterne-Änderung der letzten 7 Tage
  • sglang-omni@sgl-project

    SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.

    1.118+56Sterne-Änderung der letzten 7 Tage
  • tiny-vllm@jmaczan

    Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM

    1.100+10Sterne-Änderung der letzten 7 Tage
  • gunrock@gunrock

    Programmierbare CUDA/C++ GPU-Graphenanalytik

    1.096+0Sterne-Änderung der letzten 7 Tage
  • cupoch@neka-nat

    Robotik mit GPU-Computing

    1.064+1Sterne-Änderung der letzten 7 Tage
  • LuisaCompute@LuisaGroup

    Leistungsstarkes Rendering-Framework auf Stream-Architekturen

    1.044+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen