Zum Hauptinhalt springen
buildradar
Anmelden
Thema · cuda

cuda

Erfasste Open-Source-Repos mit dem Tag cuda, sortiert nach Sternen.

216 Repos
  • rust-cuda@Rust-GPU

    Ökosystem aus Bibliotheken und Werkzeugen zum Schreiben und Ausführen von schnellem GPU-Code vollständig in Rust.

    5.334+0Sterne-Änderung der letzten 7 Tage
  • cuml@NVIDIA

    NVIDIA cuML: GPU-beschleunigtes maschinelles Lernen

    5.269+0Sterne-Änderung der letzten 7 Tage
  • kaolin@NVIDIAGameWorks

    Eine PyTorch-Bibliothek zur Beschleunigung der 3D-Deep-Learning-Forschung

    5.163+0Sterne-Änderung der letzten 7 Tage
  • nccl@NVIDIA

    Optimierte Primitive für kollektive Multi-GPU-Kommunikation

    5.041+0Sterne-Änderung der letzten 7 Tage
  • arrayfire@arrayfire

    ArrayFire: Eine Allzweck-GPU-Bibliothek.

    4.903+0Sterne-Änderung der letzten 7 Tage
  • CTranslate2@OpenNMT

    Schnelle Inferenz-Engine für Transformer-Modelle.

    4.658+0Sterne-Änderung der letzten 7 Tage
  • Tengine@OAID

    Tengine ist eine schlanke, hochleistungsfähige, modulare Inferenz-Engine für eingebettete Geräte

    4.533+0Sterne-Änderung der letzten 7 Tage
  • tiny-cuda-nn@NVlabs

    Blitzschnelles C++/CUDA-Framework für neuronale Netze

    4.530+0Sterne-Änderung der letzten 7 Tage
  • hip@ROCm

    HIP: C++ Heterogeneous-Compute-Schnittstelle für Portabilität

    4.395+0Sterne-Änderung der letzten 7 Tage
  • iree@iree-org

    Ein zielplattformunabhängiger, MLIR-basierter Compiler- und Laufzeit-Toolkit für maschinelles Lernen.

    3.914+0Sterne-Änderung der letzten 7 Tage
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention erzielt eine 2- bis 5-fache Beschleunigung im Vergleich zu FlashAttention, ohne Einbußen bei End-to-End-Metriken über Sprach-, Bild- und Videomodelle hinweg.

    3.699+0Sterne-Änderung der letzten 7 Tage
  • Trainieren, inspizieren, bearbeiten, automatisieren und exportieren Sie 3D Gaussian Splatting-Szenen aus einer einzigen nativen Anwendung heraus.

    3.645+0Sterne-Änderung der letzten 7 Tage
  • Eine Bibliothek zur Beschleunigung von Transformer-Modellen auf NVIDIA-GPUs, einschließlich der Verwendung von 8-Bit- und 4-Bit-Gleitkommapräzision (FP8 und FP4) auf Hopper-, Ada- und Blackwell-GPUs, um eine bessere Leistung bei geringerer Speichernutzung sowohl beim Training als auch bei der Inferenz zu erzielen.

    3.518+0Sterne-Änderung der letzten 7 Tage
  • viseron@roflcoopter

    Selbstgehostete, rein lokale NVR- und KI-Computer-Vision-Software. Mit Funktionen wie Objekterkennung, Bewegungserkennung, Gesichtserkennung und mehr bietet sie Ihnen die Möglichkeit, Ihr Zuhause, Ihr Büro oder jeden anderen Ort zu überwachen.

    3.468+0Sterne-Änderung der letzten 7 Tage
  • lygia@patriciogonzalezvivo

    LYGIA ist eine granulare und mehrsprachige (GLSL, HLSL, Metal, WGSL, WEGL und CUDA) Shader-Bibliothek, die auf Leistung und Flexibilität ausgelegt ist

    3.423+0Sterne-Änderung der letzten 7 Tage
  • Remotery@Celtoys

    Einzelne C-Datei, Echtzeit-CPU/GPU-Profiler mit Remote-Web-Viewer

    3.312+0Sterne-Änderung der letzten 7 Tage
  • Anleitung zur Optimierung bestimmter Algorithmen in CUDA.

    3.242+0Sterne-Änderung der letzten 7 Tage
  • jittor@Jittor

    Jittor ist ein Hochleistungs-Deep-Learning-Framework basierend auf JIT-Kompilierung und Meta-Operatoren.

    3.232+0Sterne-Änderung der letzten 7 Tage
  • lc0@LeelaChessZero

    Open-Source-Schach-Engine mit neuronalem Netzwerk, GPU-Beschleunigung und breiter Hardwareunterstützung.

    3.197+0Sterne-Änderung der letzten 7 Tage
  • skills@NVIDIA

    Agent-Skills für NVIDIA-Produkte — zur Installation in Claude Code, Codex und andere Coding-Agenten, um Physical AI, Robotik, Simulation, CUDA und RAG-Workflows end-to-end auszuführen.

    3.180+0Sterne-Änderung der letzten 7 Tage
  • cuda-oxide@NVlabs

    cuda-oxide ist ein experimenteller Rust-zu-CUDA-Compiler, mit dem Sie (SIMT)-GPU-Kernel in sicherem(n), idiomatischem Rust schreiben können. Er kompiliert Standard-Rust-Code direkt zu PTX – keine DSLs, keine Fremdsprachen-Bindings, einfach nur Rust.

    3.118+0Sterne-Änderung der letzten 7 Tage
  • aresdb@uber

    Eine GPU-beschleunigte Echtzeit-Analytik-Speicher- und Abfrage-Engine.

    3.076+0Sterne-Änderung der letzten 7 Tage
  • heavydb@heavyai

    HeavyDB (ehemals MapD/OmniSciDB)

    3.059+0Sterne-Änderung der letzten 7 Tage
  • ramalama@containers

    RamaLama ist ein Open-Source-Entwicklertool, das die lokale Bereitstellung von KI-Modellen aus beliebigen Quellen vereinfacht und ihre Nutzung für die Inferenz in der Produktion über die vertraute Sprache von Containern erleichtert.

    3.031+0Sterne-Änderung der letzten 7 Tage
  • TensorRT@pytorch

    PyTorch/TorchScript/FX-Compiler für NVIDIA-GPUs unter Verwendung von TensorRT

    2.989+0Sterne-Änderung der letzten 7 Tage
  • ao@pytorch

    PyTorch-native Quantisierung für Training und Inferenz.

    2.961+0Sterne-Änderung der letzten 7 Tage
  • MinkowskiEngine@NVIDIA

    Minkowski Engine ist eine Auto-Diff-Bibliothek für neuronale Netze für hochdimensionale spärliche Tensoren.

    2.957+0Sterne-Änderung der letzten 7 Tage
  • Der NVIDIA GPU Operator erstellt, konfiguriert und verwaltet GPUs in Kubernetes

    2.857+0Sterne-Änderung der letzten 7 Tage
  • lucebox@Luce-Org

    LLM-Inferenzserver für spekulatives Sampling auf Consumer- und heterogener Hardware

    2.829+0Sterne-Änderung der letzten 7 Tage
  • futhark@diku-dk

    :boom::computer::boom: Eine datenparallele funktionale Programmiersprache

    2.794+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen