cuda-kernels
Erfasste Open-Source-Repos mit dem Tag cuda-kernels, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit cuda-kernels am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit cuda-kernels getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Moderne CUDA-Lernnotizen mit PyTorch für Anfänger, 200+ CUDA-Kernel, Tensor Cores, HGEMM, FA-2 MMA.
★ 11.875+25Sterne-Änderung der letzten 7 Tage - #2
Beispiele für CUDA-Entwickler, die Funktionen des CUDA Toolkits demonstrieren
★ 9.585+19Sterne-Änderung der letzten 7 Tage - #3★ 8.041+8Sterne-Änderung der letzten 7 Tage
- #4
Ökosystem aus Bibliotheken und Werkzeugen zum Schreiben und Ausführen von schnellem GPU-Code vollständig in Rust.
★ 5.334+3Sterne-Änderung der letzten 7 Tage - #5
LLM-Inferenzserver für spekulatives Sampling auf Consumer- und heterogener Hardware
★ 2.829+16Sterne-Änderung der letzten 7 Tage - #6★ 2.500+8Sterne-Änderung der letzten 7 Tage
- #7★ 1.933+0Sterne-Änderung der letzten 7 Tage
- #8★ 1.214-1Sterne-Änderung der letzten 7 Tage
- #9
Eine Machine-Learning-Bibliothek mit TypeScript-API und Rust-Backend. Kompatibel mit CUDA und WebGPU. Entwickelt, um zu verstehen, wie ML-Frameworks und -Modelle intern funktionieren.
★ 1.005+8Sterne-Änderung der letzten 7 Tage - #10
Das cuDNN Frontend ist NVIDIAs moderner Open-Source-Einstiegspunkt in die cuDNN-Bibliothek und eine wachsende Sammlung von Hochleistungs-Open-Source-Kerneln.
★ 931+13Sterne-Änderung der letzten 7 Tage - #11★ 925+1Sterne-Änderung der letzten 7 Tage
- #12
Reines Rust + CUDA LLM-Inferenz-Engine — kein PyTorch, OpenAI-kompatibel, bedient Qwen3 bis Kimi-K2
★ 677+18Sterne-Änderung der letzten 7 Tage - #13
FlashRT ist eine leistungsstarke Echtzeit-Inferenz-Engine für KI-Workloads mit kleinen Batches und geringer Latenz. Die Hauptintegration umfasst die VLA-Steuerung für Pi0, Pi0.5, GROOT N1.6 und Pi0-FAST sowie Unterstützung für LLMs wie Qwen3.6-27B.
★ 550+15Sterne-Änderung der letzten 7 Tage