cuda
Repositori open source terpantau bertanda cuda, diurutkan berdasarkan bintang.
- #91
Platform Riset Benchmark Inferensi Berkelanjutan Open Source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & segera hadir™ TPUv6e/v7/Trainium2/3 | Platform riset benchmark inferensi berkelanjutan open-source — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, segera hadir™ TPUv6e/v7/Trainium2/3
★ 1.667+0Perubahan bintang dalam 7 hari terakhir - #92
:metal: Pustaka operator TT-NN, dan model pemrograman kernel tingkat rendah TT-Metalium.
★ 1.666+0Perubahan bintang dalam 7 hari terakhir - #93★ 1.631+0Perubahan bintang dalam 7 hari terakhir
- #94
ThunderSVM: Pustaka SVM Cepat pada GPU dan CPU
★ 1.622+0Perubahan bintang dalam 7 hari terakhir - #95★ 1.616+0Perubahan bintang dalam 7 hari terakhir
- #96
Implementasi Efek 3D Ken Burns dari Gambar Tunggal menggunakan PyTorch
★ 1.570+0Perubahan bintang dalam 7 hari terakhir - #97
Pencarian otomatis untuk kernel GPU. Berikan model PyTorch apa pun, tidurlah, dan bangun dengan kernel Triton yang telah dioptimalkan.
★ 1.556+0Perubahan bintang dalam 7 hari terakhir - #98
UCCL adalah pustaka komunikasi yang efisien untuk GPU, mencakup kolektif, P2P (misal, transfer cache KV, transfer bobot RL), dan EP (misal, yang digerakkan oleh GPU)
★ 1.512+0Perubahan bintang dalam 7 hari terakhir - #99★ 1.500+0Perubahan bintang dalam 7 hari terakhir
- #100
🔥🔥🔥 TensorRT untuk YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS...... 🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎
★ 1.461+0Perubahan bintang dalam 7 hari terakhir - #101★ 1.444+0Perubahan bintang dalam 7 hari terakhir
- #102
Host sendiri model TTS Chatterbox yang kuat. Server ini menawarkan Web UI yang ramah pengguna, endpoint API yang fleksibel (termasuk kompatibel dengan OpenAI), suara prasetel, kloning suara, dan pemrosesan teks skala buku audio besar. Berjalan dipercepat di NVIDIA (CUDA), AMD (ROCm), dan CPU.
★ 1.440+0Perubahan bintang dalam 7 hari terakhir - #103★ 1.426+0Perubahan bintang dalam 7 hari terakhir
- #104
Pustaka tensor yang cepat, ergonomis, dan portabel dalam Nim dengan fokus deep learning untuk CPU, GPU, dan perangkat tertanam melalui backend OpenMP, Cuda, dan OpenCL
★ 1.406+0Perubahan bintang dalam 7 hari terakhir - #105★ 1.360+0Perubahan bintang dalam 7 hari terakhir
- #106★ 1.326+0Perubahan bintang dalam 7 hari terakhir
- #107
https://wavespeed.ai/ Framework optimisasi performa inferensi terbaik untuk HuggingFace Diffusers pada GPU NVIDIA.
★ 1.304+0Perubahan bintang dalam 7 hari terakhir - #108★ 1.270+0Perubahan bintang dalam 7 hari terakhir
- #109★ 1.269+0Perubahan bintang dalam 7 hari terakhir
- #110★ 1.217+0Perubahan bintang dalam 7 hari terakhir
- #111
Skrip build FFmpeg menyediakan cara mudah untuk mem-build FFmpeg statis di OSX dan Linux dengan menyertakan codec non-bebas.
★ 1.215+0Perubahan bintang dalam 7 hari terakhir - #112
Contoh untuk Intel® oneAPI Toolkits
★ 1.160+0Perubahan bintang dalam 7 hari terakhir - #113
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 1.159+56Perubahan bintang dalam 7 hari terakhir - #114★ 1.150+0Perubahan bintang dalam 7 hari terakhir
- #115★ 1.132+0Perubahan bintang dalam 7 hari terakhir
- #116
Pustaka Matriks Clojure yang cepat
★ 1.128+0Perubahan bintang dalam 7 hari terakhir - #117
Bangun mesin inferensi LLM berkinerja tinggi Anda sendiri dalam C++ dan CUDA - versi yang lebih kecil dari vLLM.
★ 1.104+10Perubahan bintang dalam 7 hari terakhir - #118★ 1.097+0Perubahan bintang dalam 7 hari terakhir
- #119★ 1.063+1Perubahan bintang dalam 7 hari terakhir
- #120
Framework rendering berkinerja tinggi pada arsitektur stream.
★ 1.044+1Perubahan bintang dalam 7 hari terakhir