मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें
विषय · cuda

cuda

cuda टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

216 रिपॉजिटरी
  • डिस्ट्रीब्यूटेड PyTorch ट्रेनिंग कोड लिखने के तरीके पर सर्वोत्तम अभ्यास और गाइड।

    631+2पिछले 7 दिनों में स्टार का बदलाव
  • ginkgo@ginkgo-project

    संख्यात्मक रैखिक बीजगणित (Numerical linear algebra) सॉफ्टवेयर पैकेज

    622+2पिछले 7 दिनों में स्टार का बदलाव
  • LuisaRender@LuisaGroup

    LuisaCompute पर आधारित उच्च-प्रदर्शन वाला क्रॉस-प्लेटफॉर्म मोंटे कार्लो रेंडरर।

    618+1पिछले 7 दिनों में स्टार का बदलाव
  • FastFold@hpcaitech

    GPU क्लस्टर पर AlphaFold ट्रेनिंग और इन्फरेंस को ऑप्टिमाइज़ करना।

    616+0पिछले 7 दिनों में स्टार का बदलाव
  • AutoDock-GPU@ccsb-scripps

    GPU और अन्य एक्सेलेरेटर के लिए AutoDock

    610+1पिछले 7 दिनों में स्टार का बदलाव
  • attorch@BobMcDear

    OpenAI के Triton का उपयोग करके Python में लिखा गया PyTorch के न्यूरल नेटवर्क मॉड्यूल का एक सबसेट।

    604+0पिछले 7 दिनों में स्टार का बदलाव
  • personal-os-setup@AmineDjeghri

    Windows, Linux, MacOS, Google TV, Stremio, Home Assistant और अन्य (WSL2, GPU ड्राइवर और डेवलपमेंट टूल सहित) को आसानी से कॉन्फ़िगर करने के लिए एक ऐप और गाइड। अपने UX और उत्पादकता में सुधार करें।

    602+0पिछले 7 दिनों में स्टार का बदलाव
  • yzma@hybridgroup

    Go विथ योर ओन इंटेलिजेंस - Go एप्लिकेशन जो हार्डवेयर एक्सेलेरेशन का उपयोग करके स्थानीय इन्फरेंस के लिए सीधे llama.cpp को एकीकृत करते हैं

    599+17पिछले 7 दिनों में स्टार का बदलाव
  • yalm@andrewkchan

    Yet Another Language Model: C++/CUDA में LLM अनुमान, I/O को छोड़कर कोई लाइब्रेरी नहीं

    597+1पिछले 7 दिनों में स्टार का बदलाव
  • pymde@cvxgrp

    PyTorch के साथ मिनिमम-डिस्टॉर्शन एम्बेडिंग

    594+1पिछले 7 दिनों में स्टार का बदलाव
  • dace@spcl

    DaCe - डेटा सेंट्रिक पैरेलल प्रोग्रामिंग।

    592+0पिछले 7 दिनों में स्टार का बदलाव
  • nvshmem@NVIDIA

    NVIDIA NVSHMEM, OpenSHMEM पर आधारित NVIDIA GPU के लिए एक समानांतर प्रोग्रामिंग इंटरफ़ेस है। NVSHMEM प्रोग्रामर्स को CUDA कर्नेल के भीतर और CUDA स्ट्रीम पर वन-साइडेड संचार करने की अनुमति देकर मल्टी-प्रोसेसर संचार और समन्वय ओवरहेड को काफी कम कर सकता है।

    585+4पिछले 7 दिनों में स्टार का बदलाव
  • radarsimpy@radarsimx

    Python और C++ के साथ बनाया गया रडार सिम्युलेटर।

    576+3पिछले 7 दिनों में स्टार का बदलाव
  • jitify@NVIDIA

    CUDA रनटाइम संकलन (NVRTC) के उपयोग को सरल बनाने के लिए एक सिंगल-हेडर C++ लाइब्रेरी।

    574+0पिछले 7 दिनों में स्टार का बदलाव
  • KuiperLLama@zjhellofss

    कैंपस प्लेसमेंट, इंटर्नशिप के लिए एक बेहतरीन प्रोजेक्ट, जो आपको शून्य से LLama2/3 और Qwen2.5 का समर्थन करने वाला लार्ज मॉडल इन्फरेंस फ्रेमवर्क बनाना सिखाता है।

    574+0पिछले 7 दिनों में स्टार का बदलाव
  • llm_training_handbook@huggingface

    लार्ज लैंग्वेज मॉडल्स के सफल प्रशिक्षण में मदद करने के लिए कार्यप्रणालियों का एक खुला संग्रह।

    569+2पिछले 7 दिनों में स्टार का बदलाव
  • cuda_hgemm@Bruce-Lee-LY

    WMMA API और MMA PTX इंस्ट्रक्शन का उपयोग करके टेन्सर कोर के साथ हाफ-प्रिसिजन जनरल मैट्रिक्स मल्टीप्लिकेशन (HGEMM) की कई ऑप्टिमाइज़ेशन विधियाँ।

    568+0पिछले 7 दिनों में स्टार का बदलाव
  • tessera@zengxiao-he

    शून्य से निर्मित LLM डिस्टिलेशन और सर्विंग इंजन: कस्टम Triton/CUDA कर्नेल, FSDP डिस्टिलेशन, पेज्ड-KV कंटीन्यूअस बैचिंग, सट्टा डिकोडिंग, एक Rust गेटवे, एक JAX ओरेकल और व्याख्यात्मकता उपकरण।

    566+0पिछले 7 दिनों में स्टार का बदलाव
  • FlashRT@flashrt-project

    FlashRT छोटे-बैच, विलंबता-संवेदनशील AI वर्कलोड के लिए एक उच्च-प्रदर्शन रीयल-टाइम इन्फरेंस इंजन है। इसका प्रमुख एकीकरण Pi0, Pi0.5, GROOT N1.6, और Pi0-FAST के लिए प्रोडक्शन VLA नियंत्रण है। यह LLM जैसे qwen3.6-27B को भी सपोर्ट करता है।

    562+14पिछले 7 दिनों में स्टार का बदलाव
  • qwen600@yassa9

    स्टेटिक suckless सिंगल बैच CUDA-only qwen3-0.6B मिनी इन्फेरेंस इंजन

    560+1पिछले 7 दिनों में स्टार का बदलाव
  • llm-algo-leetcode@datawhalechina

    सिद्धांत, समाधान और टेस्ट केस के साथ LLM एल्गोरिदम प्रैक्टिस लैब।

    559+20पिछले 7 दिनों में स्टार का बदलाव
  • nbd-vram@c0deJedi

    Linux पर अपने NVIDIA GPU के VRAM को स्वैप स्पेस के रूप में उपयोग करें। सोल्डेड मेमोरी और बिना अपग्रेड पथ वाले लैपटॉप के लिए बनाया गया है। यदि आपके पास 8GB VRAM वाला RTX कार्ड है और आप SSD पर स्वैप हो रहे हैं, तो यह उस VRAM को काम में लगाता है

    555+4पिछले 7 दिनों में स्टार का बदलाव
  • relion@3dem

    क्रायो-इलेक्ट्रॉन माइक्रोस्कोपी के लिए इमेज-प्रोसेसिंग सॉफ़्टवेयर

    552+2पिछले 7 दिनों में स्टार का बदलाव
  • slurm-docker-cluster@giovtorres

    docker-compose का उपयोग करने वाला एक Slurm क्लस्टर।

    544+2पिछले 7 दिनों में स्टार का बदलाव
  • cu@gorgonia

    पैकेज cu CUDA Driver API के लिए एक मुहावरेदार इंटरफ़ेस प्रदान करता है।

    532+0पिछले 7 दिनों में स्टार का बदलाव
  • pytorch-hed@sniklaus

    PyTorch में Holistically-Nested Edge Detection का पुन: कार्यान्वयन

    525+0पिछले 7 दिनों में स्टार का बदलाव
  • INSTA@Zielon

    INSTA - इंस्टेंट वॉल्यूमेट्रिक हेड अवतार [CVPR2023]

    518-1पिछले 7 दिनों में स्टार का बदलाव
  • plotoptix@rnd-team-dev

    OptiX 9.1 फ्रेमवर्क पर आधारित Python में डेटा विज़ुअलाइज़ेशन और रे ट्रेसिंग।

    518+0पिछले 7 दिनों में स्टार का बदलाव
  • Ubuntu Desktop के लिए Docker इमेज जो HW GPU त्वरित GUI ऐप्स का समर्थन करती है। आप Cloud VM की तरह ही ssh या रिमोट डेस्कटॉप के साथ कंटेनर तक पहुँच सकते हैं।

    515+0पिछले 7 दिनों में स्टार का बदलाव
  • यह रिपॉजिटरी कुछ बेहतरीन सार्वजनिक CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX और High Performance Computing (HPC) प्रोजेक्ट्स की सूची है।

    512+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस