cuda
標記 cuda 主題、收錄中的開源專案,依星數排序。
- #91
開源持續推論基準研究平台 — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & 即將推出™ TPUv6e/v7/Trainium2/3
★ 1,667+0近 7 天星數變化 - #92★ 1,666+0近 7 天星數變化
- #93★ 1,631+0近 7 天星數變化
- #94
ThunderSVM:基於 GPU 與 CPU 的快速 SVM 函式庫
★ 1,622+0近 7 天星數變化 - #95★ 1,616+0近 7 天星數變化
- #96
從單一影像實現 3D Ken Burns 效果的 PyTorch 實作
★ 1,570+0近 7 天星數變化 - #97
GPU 核心自動研究。給它任何 PyTorch 模型,睡個覺,醒來就能獲得最佳化的 Triton 核心。
★ 1,556+0近 7 天星數變化 - #98★ 1,512+0近 7 天星數變化
- #99★ 1,500+0近 7 天星數變化
- #100
🔥🔥🔥 適用於 YOLOv8、YOLOv8-Pose、YOLOv8-Seg、YOLOv8-Cls、YOLOv7、YOLOv6、YOLOv5、YOLONAS......的 TensorRT 🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎
★ 1,461+0近 7 天星數變化 - #101★ 1,444+0近 7 天星數變化
- #102
自架強大的 Chatterbox TTS 模型。此伺服器提供使用者友善的 Web UI、靈活的 API 端點(包含相容 OpenAI)、預定義語音、語音複製,以及大型有聲書規模的文字處理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速執行。
★ 1,440+0近 7 天星數變化 - #103★ 1,426+0近 7 天星數變化
- #104
一個在 Nim 中快速、符合人體工學且可攜的張量庫,透過 OpenMP、Cuda 和 OpenCL 後端專注於 CPU、GPU 和嵌入式裝置的深度學習
★ 1,406+0近 7 天星數變化 - #105★ 1,360+0近 7 天星數變化
- #106★ 1,326+0近 7 天星數變化
- #107
https://wavespeed.ai/ 用於 NVIDIA GPU 上 HuggingFace Diffusers 的最佳推論效能最佳化框架。
★ 1,304+0近 7 天星數變化 - #108★ 1,270+0近 7 天星數變化
- #109★ 1,269+0近 7 天星數變化
- #110★ 1,217+0近 7 天星數變化
- #111
FFmpeg 建置指令碼提供了一個簡單的方法,在 OSX 和 Linux 上建置包含非自由編碼解碼器的靜態 FFmpeg。
★ 1,215+0近 7 天星數變化 - #112
Intel® oneAPI Toolkits 的範例程式碼
★ 1,160+0近 7 天星數變化 - #113
SGLang-Omni 為 TTS、ASR、語音與全能模型提供高效能服務。
★ 1,159+56近 7 天星數變化 - #114★ 1,150+0近 7 天星數變化
- #115★ 1,132+0近 7 天星數變化
- #116
快速的 Clojure 矩陣庫
★ 1,128+0近 7 天星數變化 - #117★ 1,104+10近 7 天星數變化
- #118★ 1,097+0近 7 天星數變化
- #119★ 1,063+1近 7 天星數變化
- #120
串流架構上的高效能渲染框架
★ 1,044+1近 7 天星數變化