cuda
cuda टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #91
:metal: TT-NN ऑपरेटर लाइब्रेरी, और TT-Metalium लो-लेवल कर्नेल प्रोग्रामिंग मॉडल।
★ 1,655+0पिछले 7 दिनों में स्टार का बदलाव - #92★ 1,625+0पिछले 7 दिनों में स्टार का बदलाव
- #93
ThunderSVM: GPU और CPU पर आधारित एक तेज़ SVM लाइब्रेरी
★ 1,622+0पिछले 7 दिनों में स्टार का बदलाव - #94★ 1,617+0पिछले 7 दिनों में स्टार का बदलाव
- #95
ओपन सोर्स निरंतर अनुमान बेंचमार्क अनुसंधान प्लेटफ़ॉर्म — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 और जल्द ही™ TPUv6e/v7/Trainium2/3
★ 1,613+0पिछले 7 दिनों में स्टार का बदलाव - #96
PyTorch का उपयोग करके सिंगल इमेज से 3D Ken Burns Effect का कार्यान्वयन
★ 1,569+0पिछले 7 दिनों में स्टार का बदलाव - #97
GPU कर्नेल के लिए ऑटो-रिसर्च। इसे कोई भी PyTorch मॉडल दें, सो जाएं, और अनुकूलित Triton कर्नेल के साथ जागें।
★ 1,545+0पिछले 7 दिनों में स्टार का बदलाव - #98
UCCL GPU के लिए एक कुशल संचार लाइब्रेरी है, जिसमें कलेक्टिव्स, P2P (जैसे, KV कैश ट्रांसफर, RL वेट ट्रांसफर), और EP (जैसे, GPU-संचालित) शामिल हैं।
★ 1,502+0पिछले 7 दिनों में स्टार का बदलाव - #99★ 1,492+0पिछले 7 दिनों में स्टार का बदलाव
- #100
🔥🔥🔥 YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS आदि के लिए TensorRT... 🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎
★ 1,460+0पिछले 7 दिनों में स्टार का बदलाव - #101★ 1,444+0पिछले 7 दिनों में स्टार का बदलाव
- #102
शक्तिशाली Chatterbox TTS मॉडल को सेल्फ-हॉस्ट करें। यह सर्वर एक उपयोगकर्ता के अनुकूल Web UI, लचीले API एंडपॉइंट (OpenAI संगत सहित), पूर्वनिर्धारित आवाज़ें, वॉयस क्लोनिंग, और बड़े ऑडियोबुक-स्केल टेक्स्ट प्रोसेसिंग प्रदान करता है। NVIDIA (CUDA), AMD (ROCm), और CPU पर त्वरित रूप से चलता है।
★ 1,427+0पिछले 7 दिनों में स्टार का बदलाव - #103★ 1,426+0पिछले 7 दिनों में स्टार का बदलाव
- #104
OpenMP, Cuda और OpenCL बैकएंड के माध्यम से CPU, GPU और एम्बेडेड उपकरणों के लिए डीप लर्निंग फोकस के साथ Nim में एक तेज़, एर्गोनॉमिक और पोर्टेबल टेंसर लाइब्रेरी
★ 1,407+0पिछले 7 दिनों में स्टार का बदलाव - #105★ 1,358+0पिछले 7 दिनों में स्टार का बदलाव
- #106★ 1,323+0पिछले 7 दिनों में स्टार का बदलाव
- #107
https://wavespeed.ai/ NVIDIA GPU पर HuggingFace Diffusers के लिए सर्वश्रेष्ठ इन्फेरेंस परफॉर्मेंस ऑप्टिमाइज़ेशन फ्रेमवर्क।
★ 1,304+0पिछले 7 दिनों में स्टार का बदलाव - #108★ 1,270+0पिछले 7 दिनों में स्टार का बदलाव
- #109★ 1,269+0पिछले 7 दिनों में स्टार का बदलाव
- #110
FFmpeg बिल्ड स्क्रिप्ट गैर-मुक्त कोडेक्स के साथ OSX और Linux पर एक स्थिर FFmpeg बनाने का एक आसान तरीका प्रदान करती है।
★ 1,215+0पिछले 7 दिनों में स्टार का बदलाव - #111★ 1,214+0पिछले 7 दिनों में स्टार का बदलाव
- #112
Intel® oneAPI Toolkits के लिए सैंपल
★ 1,162+0पिछले 7 दिनों में स्टार का बदलाव - #113★ 1,150+0पिछले 7 दिनों में स्टार का बदलाव
- #114★ 1,131+0पिछले 7 दिनों में स्टार का बदलाव
- #115
तेज़ Clojure मैट्रिक्स लाइब्रेरी।
★ 1,128+0पिछले 7 दिनों में स्टार का बदलाव - #116
SGLang-Omni, TTS, ASR, स्पीच और ओम्नी मॉडल के लिए उच्च-प्रदर्शन सर्विंग को सक्षम बनाता है।
★ 1,118+56पिछले 7 दिनों में स्टार का बदलाव - #117
C++ और CUDA में अपना खुद का उच्च-प्रदर्शन LLM इन्फेरेंस इंजन बनाएं - vLLM का एक छोटा संस्करण
★ 1,100+10पिछले 7 दिनों में स्टार का बदलाव - #118★ 1,096+0पिछले 7 दिनों में स्टार का बदलाव
- #119★ 1,064+1पिछले 7 दिनों में स्टार का बदलाव
- #120
स्ट्रीम आर्किटेक्चर पर आधारित उच्च-प्रदर्शन रेंडरिंग फ्रेमवर्क
★ 1,044+1पिछले 7 दिनों में स्टार का बदलाव