cuda
cuda टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #31
पूरी तरह से Rust में तेज़ GPU कोड लिखने और निष्पादित करने के लिए लाइब्रेरी और टूल का इकोसिस्टम।
★ 5,334+0पिछले 7 दिनों में स्टार का बदलाव - #32★ 5,269+0पिछले 7 दिनों में स्टार का बदलाव
- #33★ 5,163+0पिछले 7 दिनों में स्टार का बदलाव
- #34★ 5,041+0पिछले 7 दिनों में स्टार का बदलाव
- #35★ 4,903+0पिछले 7 दिनों में स्टार का बदलाव
- #36
Transformer मॉडल के लिए तेज़ इन्फेंस इंजन।
★ 4,658+0पिछले 7 दिनों में स्टार का बदलाव - #37★ 4,533+0पिछले 7 दिनों में स्टार का बदलाव
- #38
अत्यंत तेज़ C++/CUDA तंत्रिका नेटवर्क फ्रेमवर्क
★ 4,530+0पिछले 7 दिनों में स्टार का बदलाव - #39★ 4,395+0पिछले 7 दिनों में स्टार का बदलाव
- #40★ 3,914+0पिछले 7 दिनों में स्टार का बदलाव
- #41
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention भाषा, छवि और वीडियो मॉडल में एंड-टू-एंड मेट्रिक्स खोए बिना FlashAttention की तुलना में 2-5x गति प्राप्त करता है।
★ 3,699+0पिछले 7 दिनों में स्टार का बदलाव - #42
एक ही नेटिव एप्लिकेशन से 3D Gaussian Splatting दृश्यों को प्रशिक्षित करें, निरीक्षण करें, संपादित करें, स्वचालित करें और निर्यात करें।
★ 3,645+0पिछले 7 दिनों में स्टार का बदलाव - #43
NVIDIA GPU पर Transformer मॉडल को तेज़ी से चलाने के लिए एक लाइब्रेरी, जिसमें Hopper, Ada और Blackwell GPU पर 8-बिट और 4-बिट फ़्लोटिंग पॉइंट (FP8 और FP4) सटीक का उपयोग शामिल है, ताकि ट्रेनिंग और इन्फेंस दोनों में कम मेमोरी उपयोग के साथ बेहतर प्रदर्शन मिल सके।
★ 3,518+0पिछले 7 दिनों में स्टार का बदलाव - #44
सेल्फ-होस्टेड, केवल स्थानीय NVR और AI कंप्यूटर विज़न सॉफ्टवेयर। ऑब्जेक्ट डिटेक्शन, मोशन डिटेक्शन, फेस रिकग्निशन और अन्य सुविधाओं के साथ, यह आपको अपने घर, कार्यालय या किसी अन्य स्थान पर नज़र रखने की शक्ति देता है।
★ 3,468+0पिछले 7 दिनों में स्टार का बदलाव - #45
LYGIA, प्रदर्शन और लचीलेपन के लिए डिज़ाइन किया गया एक दानेदार और बहु-भाषा (GLSL, HLSL, Metal, WGSL, WEGL और CUDA) शेडर लाइब्रेरी है
★ 3,423+0पिछले 7 दिनों में स्टार का बदलाव - #46★ 3,312+0पिछले 7 दिनों में स्टार का बदलाव
- #47
cuda में कुछ एल्गोरिदम को कैसे अनुकूलित करें।
★ 3,242+0पिछले 7 दिनों में स्टार का बदलाव - #48
Jittor JIT कंपाइलिंग और मेटा-ऑपरेटरों पर आधारित एक उच्च-प्रदर्शन deep learning फ्रेमवर्क है।
★ 3,232+0पिछले 7 दिनों में स्टार का बदलाव - #49★ 3,197+0पिछले 7 दिनों में स्टार का बदलाव
- #50
NVIDIA उत्पादों के लिए एजेंट स्किल्स — फिजिकल AI, रोबोटिक्स, सिमुलेशन, CUDA और RAG वर्कफ़्लो को अंत से अंत तक चलाने के लिए Claude Code, Codex और अन्य कोडिंग एजेंटों में इंस्टॉल करें।
★ 3,180+0पिछले 7 दिनों में स्टार का बदलाव - #51
cuda-oxide एक प्रयोगात्मक Rust-to-CUDA कंपाइलर है जो आपको सुरक्षित और स्वाभाविक Rust में (SIMT) GPU कर्नेल लिखने की अनुमति देता है। यह मानक Rust कोड को सीधे PTX में संकलित करता है - कोई DSL नहीं, कोई विदेशी भाषा बाइंडिंग नहीं, केवल Rust।
★ 3,118+0पिछले 7 दिनों में स्टार का बदलाव - #52★ 3,076+0पिछले 7 दिनों में स्टार का बदलाव
- #53★ 3,059+0पिछले 7 दिनों में स्टार का बदलाव
- #54
RamaLama एक ओपन-सोर्स डेवलपर टूल है जो किसी भी स्रोत से AI मॉडल की स्थानीय सर्विसिंग को सरल बनाता है और कंटेनरों की परिचित भाषा के माध्यम से उत्पादन में अनुमान के लिए उनके उपयोग को सुविधाजनक बनाता है।
★ 3,031+0पिछले 7 दिनों में स्टार का बदलाव - #55★ 2,989+0पिछले 7 दिनों में स्टार का बदलाव
- #56★ 2,961+0पिछले 7 दिनों में स्टार का बदलाव
- #57
Minkowski Engine उच्च-आयामी स्पार्स टेंसर के लिए एक ऑटो-डिफ़ न्यूरल नेटवर्क लाइब्रेरी है
★ 2,957+0पिछले 7 दिनों में स्टार का बदलाव - #58
NVIDIA GPU Operator Kubernetes में GPU को बनाता, कॉन्फ़िगर और प्रबंधित करता है।
★ 2,857+0पिछले 7 दिनों में स्टार का बदलाव - #59★ 2,829+0पिछले 7 दिनों में स्टार का बदलाव
- #60★ 2,794+0पिछले 7 दिनों में स्टार का बदलाव