Aller au contenu principal
buildradar
Se connecter
Sujet · cuda

cuda

Dépôts open source suivis étiquetés cuda, triés par étoiles.

216 dépôts
  • Meilleures pratiques et guides pour écrire du code de formation distribuée PyTorch

    631+2Évolution des étoiles sur les 7 derniers jours
  • ginkgo@ginkgo-project

    Logiciel d'algèbre linéaire numérique

    622+2Évolution des étoiles sur les 7 derniers jours
  • LuisaRender@LuisaGroup

    Moteur de rendu Monte Carlo multiplateforme haute performance basé sur LuisaCompute.

    618+1Évolution des étoiles sur les 7 derniers jours
  • FastFold@hpcaitech

    Optimisation de l'entraînement et de l'inférence d'AlphaFold sur des clusters de GPU

    616+0Évolution des étoiles sur les 7 derniers jours
  • AutoDock-GPU@ccsb-scripps

    AutoDock pour les GPU et autres accélérateurs

    610+1Évolution des étoiles sur les 7 derniers jours
  • attorch@BobMcDear

    Un sous-ensemble des modules de réseaux de neurones de PyTorch, écrits en Python avec le Triton d'OpenAI.

    604+0Évolution des étoiles sur les 7 derniers jours
  • personal-os-setup@AmineDjeghri

    Une application et un guide pour configurer facilement Windows, Linux, MacOS, Google TV, Stremio, Home Assistant et plus encore (notamment WSL2, les pilotes GPU et les outils de développement). Améliorez votre expérience utilisateur et votre productivité.

    602+0Évolution des étoiles sur les 7 derniers jours
  • yzma@hybridgroup

    Go avec votre propre intelligence - Applications Go qui intègrent directement llama.cpp pour l'inférence locale avec accélération matérielle.

    599+17Évolution des étoiles sur les 7 derniers jours
  • yalm@andrewkchan

    Yet Another Language Model : inférence LLM en C++/CUDA, sans aucune bibliothèque à l'exception des E/S.

    597+1Évolution des étoiles sur les 7 derniers jours
  • pymde@cvxgrp

    Plongement à distorsion minimale avec PyTorch

    594+1Évolution des étoiles sur les 7 derniers jours
  • dace@spcl

    DaCe - Programmation parallèle centrée sur les données

    592+0Évolution des étoiles sur les 7 derniers jours
  • nvshmem@NVIDIA

    NVIDIA NVSHMEM est une interface de programmation parallèle pour les GPU NVIDIA basée sur OpenSHMEM. NVSHMEM peut réduire considérablement la communication multi-processus et les frais généraux de coordination en permettant aux programmeurs d'effectuer une communication unilatérale à partir des noyaux CUDA et sur les flux CUDA.

    585+4Évolution des étoiles sur les 7 derniers jours
  • radarsimpy@radarsimx

    Simulateur radar construit avec Python et C++

    576+3Évolution des étoiles sur les 7 derniers jours
  • jitify@NVIDIA

    Une bibliothèque C++ en en-tête unique pour simplifier l'utilisation de la compilation runtime CUDA (NVRTC).

    574+0Évolution des étoiles sur les 7 derniers jours
  • KuiperLLama@zjhellofss

    Un excellent projet pour le recrutement universitaire, d'automne, de printemps et les stages, vous guidant pour implémenter à partir de zéro un framework d'inférence de grands modèles prenant en charge LLama2/3 et Qwen2.5.

    574+0Évolution des étoiles sur les 7 derniers jours
  • llm_training_handbook@huggingface

    Une collection ouverte de méthodologies pour faciliter l'entraînement réussi de grands modèles de langage.

    569+2Évolution des étoiles sur les 7 derniers jours
  • cuda_hgemm@Bruce-Lee-LY

    Plusieurs méthodes d'optimisation de la multiplication de matrices générales en demi-précision (HGEMM) utilisant les tensor cores avec l'API WMMA et l'instruction PTX MMA.

    568+0Évolution des étoiles sur les 7 derniers jours
  • tessera@zengxiao-he

    From teacher to tiles — a from-scratch LLM distillation & serving engine: custom Triton/CUDA kernels, FSDP distillation, paged-KV continuous batching, speculative decoding, a Rust gateway, a JAX oracle, and interpretability tooling.

    566+0Évolution des étoiles sur les 7 derniers jours
  • FlashRT@flashrt-project

    FlashRT est un moteur d'inférence haute performance en temps réel pour les charges de travail IA à faible lot et sensibles à la latence. L'intégration phare concerne le contrôle VLA en production pour Pi0, Pi0.5, GROOT N1.6 et Pi0-FAST. Il prend également en charge les LLM tels que qwen3.6-27B.

    562+14Évolution des étoiles sur les 7 derniers jours
  • qwen600@yassa9

    Moteur de mini-inférence statique, suckless, mono-lot (single batch) et exclusivement CUDA pour qwen3-0.6B

    560+1Évolution des étoiles sur les 7 derniers jours
  • llm-algo-leetcode@datawhalechina

    LLM algorithm practice lab with theory, solutions, and test cases.《大模型算法与系统教程》面向大模型入门到进阶的算法实战教程,覆盖原理讲解、答案解析、测试用例与 CUDA/Triton 实战。

    559+20Évolution des étoiles sur les 7 derniers jours
  • nbd-vram@c0deJedi

    Utilisez la VRAM de votre GPU NVIDIA comme espace d'échange (swap) sous Linux. Conçu pour les ordinateurs portables avec mémoire soudée sans possibilité de mise à niveau. Si vous avez une carte RTX avec 8 Go de VRAM et que vous utilisez le swap sur SSD, cela permet d'exploiter cette VRAM.

    555+4Évolution des étoiles sur les 7 derniers jours
  • relion@3dem

    Logiciel de traitement d'images pour la cryo-microscopie électronique

    552+2Évolution des étoiles sur les 7 derniers jours
  • slurm-docker-cluster@giovtorres

    Un cluster Slurm utilisant docker-compose

    544+2Évolution des étoiles sur les 7 derniers jours
  • cu@gorgonia

    Le package cu fournit une interface idiomatique à l'API du pilote CUDA.

    532+0Évolution des étoiles sur les 7 derniers jours
  • pytorch-hed@sniklaus

    Une réimplémentation de Holistically-Nested Edge Detection en PyTorch

    525+0Évolution des étoiles sur les 7 derniers jours
  • plotoptix@rnd-team-dev

    Visualisation de données et ray tracing en Python basés sur le framework OptiX 9.1.

    518+0Évolution des étoiles sur les 7 derniers jours
  • INSTA@Zielon

    INSTA - Avatars de tête volumétriques instantanés [CVPR2023]

    518-1Évolution des étoiles sur les 7 derniers jours
  • Image Docker pour Ubuntu Desktop prenant en charge les applications GUI avec accélération matérielle GPU. Accédez au conteneur via ssh ou bureau à distance, comme une VM Cloud.

    515+0Évolution des étoiles sur les 7 derniers jours
  • Serveur d'inférence linguistique open-source, local et auto-hébergé, hautement optimisé, prenant en charge ASR/STT, TTS et LLM via WebRTC, REST et WS.

    512+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets