Cuda
Erfasste Open-Source-Repos mit Cuda als Hauptsprache, sortiert nach Sternen.
- #31raft@NVIDIA
RAFT enthält grundlegende, weit verbreitete Algorithmen und Primitiven für Machine Learning und Information Retrieval. Die Algorithmen sind CUDA-beschleunigt und bilden Bausteine zur einfacheren Erstellung von Hochleistungsanwendungen.
★ 1.037+1Sterne-Änderung der letzten 7 Tage - #32cuopt@NVIDIA
GPU-beschleunigte Entscheidungsoptimierung
★ 1.032+11Sterne-Änderung der letzten 7 Tage - #33NKSR@nv-tlabs
[CVPR 2023 Highlight] Neuronale Kernel-Oberflächenrekonstruktion
★ 986+1Sterne-Änderung der letzten 7 Tage - #34CudaSift@Celebrandil
Eine CUDA-Implementierung von SIFT für NVIDIA-GPUs (1,2 ms auf einer GTX 1060)
★ 953+2Sterne-Änderung der letzten 7 Tage - #35nvbench@NVIDIA
CUDA-Kernel-Benchmarking-Bibliothek
★ 924+4Sterne-Änderung der letzten 7 Tage - #36multi-gpu-programming-models@NVIDIA
Beispiele, die verfügbare Optionen zur Programmierung mehrerer GPUs in einem einzelnen Knoten oder Cluster demonstrieren
★ 911+0Sterne-Änderung der letzten 7 Tage - #37tron@NovaCodeu
USDT-Wallet-Vanity-Adressgenerator, Trx-Vanity, Tron-GPU-Vanity-Quellcode, TRON-Wallet-Vanity-Adressgenerator, Tron-Adress-Vanity-Generator
★ 869+1Sterne-Änderung der letzten 7 Tage - #38lietorch@princeton-vl★ 853+2Sterne-Änderung der letzten 7 Tage
- #39cuvs@NVIDIA
cuVS – eine Bibliothek für Vektorsuche und Clustering auf der GPU
★ 841+3Sterne-Änderung der letzten 7 Tage - #40GPUMD@brucefan1983
Molekulardynamik auf Grafikprozessoren (GPUs)
★ 828+1Sterne-Änderung der letzten 7 Tage - #41NeuS2@19reborn
[ICCV 2023] Offizieller Code für NeuS2
★ 736+1Sterne-Änderung der letzten 7 Tage - #42AMGX@NVIDIA
Bibliothek für verteilte Mehrgitter-Gleichungslöser auf GPU
★ 690+3Sterne-Änderung der letzten 7 Tage - #43ai-infra-hpc@jinbooooom
HPC-Tutorial, einschließlich kollektiver Kommunikation (MPI, NCCL), CUDA-Programmierung, Vektor-SIMD, RDMA-Kommunikation usw.
★ 682+19Sterne-Änderung der letzten 7 Tage - #44radfoam@theialab
Originalimplementierung von „Radiant Foam: Real-Time Differentiable Ray Tracing“
★ 665+0Sterne-Änderung der letzten 7 Tage - #45unet.cu@clu0
UNet-Diffusionsmodell in reinem CUDA.
★ 663+0Sterne-Änderung der letzten 7 Tage - #46cuCollections@NVIDIA★ 661+0Sterne-Änderung der letzten 7 Tage
- #47recommenders-addons@tensorflow
Zusätzliche Hilfsprogramme und Helfer zur Erweiterung von TensorFlow beim Erstellen von Empfehlungssystemen, beigesteuert und gewartet von SIG Recommenders.
★ 636+1Sterne-Änderung der letzten 7 Tage - #48GPU@a-hamdi
100 Tage Erstellen von GPU-Kerneln!
★ 629+1Sterne-Änderung der letzten 7 Tage - #49fast.cu@pranjalssh
Von Grund auf neu geschriebene, schnellste Kernel
★ 615+4Sterne-Änderung der letzten 7 Tage - #50gpuRIR@DavidDiazGuerra
Python-Bibliothek zur Simulation von Raumimpulsantworten (RIR) mit GPU-Beschleunigung.
★ 611+1Sterne-Änderung der letzten 7 Tage - #51DiffPhysDrone@HenryHuYu
Veröffentlicht in Nature Machine Intelligence! Der erste echte Roboter (Quadrokopter) auf Basis von differenzierbarem Physik-Training.
★ 605+7Sterne-Änderung der letzten 7 Tage - #52cudahandbook@ArchaeaSoftware
Quellcode begleitend zum The CUDA Handbook.
★ 598+0Sterne-Änderung der letzten 7 Tage - #53Parallel-Computing-Cuda-C@CisMine
Lernleitfaden für CUDA
★ 569+0Sterne-Änderung der letzten 7 Tage - #54DarkPose@ilovepose
Verteilungsbewusste Koordinatenrepräsentation für die menschliche Pose-Schätzung.
★ 568+1Sterne-Änderung der letzten 7 Tage - #55cuda_hgemm@Bruce-Lee-LY
Verschiedene Optimierungsmethoden für die allgemeine Matrixmultiplikation in halber Genauigkeit (HGEMM) unter Verwendung von Tensor Cores mit WMMA-API und MMA-PTX-Instruktionen.
★ 567+1Sterne-Änderung der letzten 7 Tage - #56qwen600@yassa9
Statische, minimalistische Single-Batch-Inferenz-Engine für qwen3-0.6B, ausschließlich für CUDA
★ 559+0Sterne-Änderung der letzten 7 Tage - #57tiny-flash-attention@66RING
Flash-Attention-Tutorial in Python, Triton, CUDA und Cutlass
★ 532+1Sterne-Änderung der letzten 7 Tage - #58megalodon@XuezheMax
Referenzimplementierung des Megalodon 7B-Modells
★ 526+0Sterne-Änderung der letzten 7 Tage - #59mnist-cuda@Infatoshi★ 515+2Sterne-Änderung der letzten 7 Tage
- #60BasicCUDA@CalvinXKY
Ein Tutorial für CUDA & PyTorch
★ 507—Sterne-Änderung der letzten 7 Tage