cuda
Erfasste Open-Source-Repos mit dem Tag cuda, sortiert nach Sternen.
- #91
:metal: TT-NN-Operatorenbibliothek und TT-Metalium Low-Level-Kernel-Programmiermodell.
★ 1.655+0Sterne-Änderung der letzten 7 Tage - #92★ 1.625+0Sterne-Änderung der letzten 7 Tage
- #93
ThunderSVM: Eine schnelle SVM-Bibliothek für GPUs und CPUs
★ 1.622+0Sterne-Änderung der letzten 7 Tage - #94
LLM-Bereitstellungsprojekt basierend auf MNN. Dieses Projekt wurde in MNN integriert.
★ 1.617+0Sterne-Änderung der letzten 7 Tage - #95
Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3
★ 1.613+0Sterne-Änderung der letzten 7 Tage - #96
Eine Implementierung des 3D-Ken-Burns-Effekts aus einem einzelnen Bild mit PyTorch
★ 1.569+0Sterne-Änderung der letzten 7 Tage - #97
Automatische Forschung für GPU-Kernel. Gib ihm ein beliebiges PyTorch-Modell, geh schlafen und wache mit optimierten Triton-Kerneln auf.
★ 1.545+0Sterne-Änderung der letzten 7 Tage - #98
UCCL ist eine effiziente Kommunikationsbibliothek für GPUs, die Collectives, P2P (z. B. KV-Cache-Transfer, RL-Gewichtetransfer) und EP (z. B. GPU-gesteuert) abdeckt.
★ 1.502+0Sterne-Änderung der letzten 7 Tage - #99★ 1.492+0Sterne-Änderung der letzten 7 Tage
- #100
🔥🔥🔥 TensorRT für YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS...... 🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎
★ 1.460+0Sterne-Änderung der letzten 7 Tage - #101
Eine effiziente C++20-GPU-Bibliothek für numerisches Rechnen mit Python-ähnlicher Syntax
★ 1.444+0Sterne-Änderung der letzten 7 Tage - #102
Hosten Sie das leistungsstarke Chatterbox TTS-Modell selbst. Dieser Server bietet eine benutzerfreundliche Web-UI, flexible API-Endpunkte (inkl. OpenAI-Kompatibilität), vordefinierte Stimmen, Klonen von Stimmen und Textverarbeitung im Umfang großer Hörbücher. Läuft beschleunigt auf NVIDIA (CUDA), AMD (ROCm) und CPU.
★ 1.427+0Sterne-Änderung der letzten 7 Tage - #103★ 1.426+0Sterne-Änderung der letzten 7 Tage
- #104
Eine schnelle, ergonomische und portable Tensor-Bibliothek in Nim mit Fokus auf Deep Learning für CPU, GPU und eingebettete Geräte über OpenMP-, Cuda- und OpenCL-Backends
★ 1.407+0Sterne-Änderung der letzten 7 Tage - #105
Eine schnelle, kommunikationsüberlappende Bibliothek für Tensor- und Experten-Parallelität auf GPUs.
★ 1.358+0Sterne-Änderung der letzten 7 Tage - #106★ 1.323+0Sterne-Änderung der letzten 7 Tage
- #107
https://wavespeed.ai/ Das beste Framework zur Inferenz-Leistungsoptimierung für HuggingFace Diffusers auf NVIDIA-GPUs.
★ 1.304+0Sterne-Änderung der letzten 7 Tage - #108★ 1.270+0Sterne-Änderung der letzten 7 Tage
- #109
GraphVite: Ein allgemeines und hochleistungsfähiges Graph-Embedding-System
★ 1.269+0Sterne-Änderung der letzten 7 Tage - #110
Das FFmpeg-Build-Skript bietet eine einfache Möglichkeit, ein statisches FFmpeg auf OSX und Linux einschließlich nicht-freier Codecs zu erstellen.
★ 1.215+0Sterne-Änderung der letzten 7 Tage - #111★ 1.214+0Sterne-Änderung der letzten 7 Tage
- #112
Beispiele für Intel® oneAPI Toolkits
★ 1.162+0Sterne-Änderung der letzten 7 Tage - #113★ 1.150+0Sterne-Änderung der letzten 7 Tage
- #114★ 1.131+0Sterne-Änderung der letzten 7 Tage
- #115
Schnelle Clojure-Matrix-Bibliothek
★ 1.128+0Sterne-Änderung der letzten 7 Tage - #116
SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.
★ 1.118+56Sterne-Änderung der letzten 7 Tage - #117
Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM
★ 1.100+10Sterne-Änderung der letzten 7 Tage - #118★ 1.096+0Sterne-Änderung der letzten 7 Tage
- #119★ 1.064+1Sterne-Änderung der letzten 7 Tage
- #120
Leistungsstarkes Rendering-Framework auf Stream-Architekturen
★ 1.044+1Sterne-Änderung der letzten 7 Tage