gpu
Erfasste Open-Source-Repos mit dem Tag gpu, sortiert nach Sternen.
- #121★ 1.664+2Sterne-Änderung der letzten 7 Tage
- #122
:metal: TT-NN-Operatorenbibliothek und TT-Metalium Low-Level-Kernel-Programmiermodell.
★ 1.655+11Sterne-Änderung der letzten 7 Tage - #123
Awesome Lists für Tenure-Track-Assistenzprofessoren und Doktoranden.
★ 1.646+0Sterne-Änderung der letzten 7 Tage - #124★ 1.625+0Sterne-Änderung der letzten 7 Tage
- #125
ThunderSVM: Eine schnelle SVM-Bibliothek für GPUs und CPUs
★ 1.622+0Sterne-Änderung der letzten 7 Tage - #126
Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3
★ 1.613+33Sterne-Änderung der letzten 7 Tage - #127★ 1.600+79Sterne-Änderung der letzten 7 Tage
- #128★ 1.577+1Sterne-Änderung der letzten 7 Tage
- #129
Eine leichtgewichtige 2D-Grafikbibliothek für moderne GPUs, die eine hochleistungsfähige Text-, Bild- und Vektor-Rendertung auf allen gängigen Plattformen ermöglicht.
★ 1.576+1Sterne-Änderung der letzten 7 Tage - #130
Eine schnelle und benutzerfreundliche Laufzeitumgebung für Transformer-Inferenz (Bert, Albert, GPT2, Decoders usw.) auf CPU und GPU.
★ 1.550+1Sterne-Änderung der letzten 7 Tage - #131
Automatische Forschung für GPU-Kernel. Gib ihm ein beliebiges PyTorch-Modell, geh schlafen und wache mit optimierten Triton-Kerneln auf.
★ 1.545+7Sterne-Änderung der letzten 7 Tage - #132
Eine schnelle Plotting-Bibliothek der nächsten Generation, die auf WGPU unter Verwendung der pygfx-Rendering-Engine läuft
★ 1.524+0Sterne-Änderung der letzten 7 Tage - #133
UCCL ist eine effiziente Kommunikationsbibliothek für GPUs, die Collectives, P2P (z. B. KV-Cache-Transfer, RL-Gewichtetransfer) und EP (z. B. GPU-gesteuert) abdeckt.
★ 1.502+3Sterne-Änderung der letzten 7 Tage - #134
Eine GPU-beschleunigte Rechenbibliothek zum Ausführen von Physiksimulationen und anderen GPGPU-Berechnungen in einem Webbrowser.
★ 1.483+0Sterne-Änderung der letzten 7 Tage - #135
Visuelles SLAM-/Odometrie-Paket basierend auf NVIDIA-beschleunigtem cuVSLAM
★ 1.454+5Sterne-Änderung der letzten 7 Tage - #136
Eine effiziente C++20-GPU-Bibliothek für numerisches Rechnen mit Python-ähnlicher Syntax
★ 1.444+0Sterne-Änderung der letzten 7 Tage - #137
Intel® Graphics Compute Runtime für oneAPI Level Zero und OpenCL™ Driver
★ 1.434+2Sterne-Änderung der letzten 7 Tage - #138★ 1.426+2Sterne-Änderung der letzten 7 Tage
- #139
🌊 Julia-Software für schnelle, benutzerfreundliche, flexible, ozeanorientierte Strömungsmechanik auf CPUs und GPUs
★ 1.412+0Sterne-Änderung der letzten 7 Tage - #140
Vorkompilierte Mesa3D-Treiber für Windows
★ 1.410+3Sterne-Änderung der letzten 7 Tage - #141
Berechnet Token/s und GPU-Speicherbedarf für beliebige LLMs. Unterstützt llama.cpp/ggml/bnb/QLoRA-Quantisierung.
★ 1.406+0Sterne-Änderung der letzten 7 Tage - #142★ 1.367+2Sterne-Änderung der letzten 7 Tage
- #143
Eine schnelle, kommunikationsüberlappende Bibliothek für Tensor- und Experten-Parallelität auf GPUs.
★ 1.358+3Sterne-Änderung der letzten 7 Tage - #144
Extension für Scikit-learn als nahtlose Möglichkeit, deine Scikit-learn-Anwendung zu beschleunigen
★ 1.356+0Sterne-Änderung der letzten 7 Tage - #145★ 1.319+0Sterne-Änderung der letzten 7 Tage
- #146
🔥 Ein autonomer KI-Agent, der Ihre Deep-Learning-Experimente rund um die Uhr im Schlaf ausführt. Kostenlose Überwachung, Leader-Worker-Architektur, konstanter Speicher.
★ 1.288+3Sterne-Änderung der letzten 7 Tage - #147★ 1.270+0Sterne-Änderung der letzten 7 Tage
- #148
GraphVite: Ein allgemeines und hochleistungsfähiges Graph-Embedding-System
★ 1.269+0Sterne-Änderung der letzten 7 Tage - #149
Beispiele für Programme, die mit Modal erstellt wurden
★ 1.264+2Sterne-Änderung der letzten 7 Tage - #150
KernelBench: Können LLMs GPU-Kernel schreiben? – Benchmark + Toolkit mit Torch -> CUDA (+ weitere DSLs)
★ 1.227+7Sterne-Änderung der letzten 7 Tage