Aller au contenu principal
buildradar
Se connecter
Sujet · cuda

cuda

Dépôts open source suivis étiquetés cuda, triés par étoiles.

216 dépôts
  • rust-cuda@Rust-GPU

    Écosystème de bibliothèques et d'outils pour écrire et exécuter du code GPU rapide entièrement en Rust.

    5 334+0Évolution des étoiles sur les 7 derniers jours
  • cuml@NVIDIA

    NVIDIA cuML : Apprentissage automatique accéléré par GPU

    5 269+0Évolution des étoiles sur les 7 derniers jours
  • kaolin@NVIDIAGameWorks

    Une bibliothèque PyTorch pour accélérer la recherche en deep learning 3D.

    5 163+0Évolution des étoiles sur les 7 derniers jours
  • nccl@NVIDIA

    Primitives optimisées pour la communication collective multi-GPU

    5 041+0Évolution des étoiles sur les 7 derniers jours
  • arrayfire@arrayfire

    ArrayFire : une bibliothèque GPU polyvalente.

    4 903+0Évolution des étoiles sur les 7 derniers jours
  • CTranslate2@OpenNMT

    Moteur d'inférence rapide pour les modèles Transformer

    4 658+0Évolution des étoiles sur les 7 derniers jours
  • Tengine@OAID

    Tengine est un moteur d'inférence modulaire, léger et haute performance pour appareils embarqués.

    4 533+0Évolution des étoiles sur les 7 derniers jours
  • tiny-cuda-nn@NVlabs

    Framework de réseau de neurones C++/CUDA ultra-rapide.

    4 530+0Évolution des étoiles sur les 7 derniers jours
  • hip@ROCm

    HIP : Interface de calcul hétérogène en C++ pour la portabilité

    4 395+0Évolution des étoiles sur les 7 derniers jours
  • iree@iree-org

    Un compilateur d'apprentissage automatique et une boîte à outils d'exécution basés sur MLIR et retargetables.

    3 914+0Évolution des étoiles sur les 7 derniers jours
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention permet une accélération de 2 à 5x par rapport à FlashAttention, sans perte de métriques de bout en bout pour les modèles de langage, d'image et de vidéo.

    3 699+0Évolution des étoiles sur les 7 derniers jours
  • Entraînez, inspectez, modifiez, automatisez et exportez des scènes 3D Gaussian Splatting depuis une application native unique.

    3 645+0Évolution des étoiles sur les 7 derniers jours
  • Une bibliothèque pour accélérer les modèles Transformer sur les GPU NVIDIA, incluant l'utilisation de la précision en virgule flottante 8 bits et 4 bits (FP8 et FP4) sur les GPU Hopper, Ada et Blackwell, pour offrir de meilleures performances avec une utilisation mémoire réduite lors de l'entraînement et de l'inférence.

    3 518+0Évolution des étoiles sur les 7 derniers jours
  • viseron@roflcoopter

    Logiciel NVR et de vision par ordinateur IA auto-hébergé et local. Avec des fonctionnalités telles que la détection d'objets, de mouvement, la reconnaissance faciale et plus encore, il permet de surveiller votre domicile, bureau ou tout autre lieu.

    3 468+0Évolution des étoiles sur les 7 derniers jours
  • lygia@patriciogonzalezvivo

    LYGIA est une bibliothèque de shaders granulaire et multi-langage (GLSL, HLSL, Metal, WGSL, WEGL et CUDA) conçue pour la performance et la flexibilité.

    3 423+0Évolution des étoiles sur les 7 derniers jours
  • Remotery@Celtoys

    Profileur CPU/GPU temps réel en un seul fichier C avec visionneuse Web distante.

    3 312+0Évolution des étoiles sur les 7 derniers jours
  • Guide d'optimisation d'algorithmes en CUDA.

    3 242+0Évolution des étoiles sur les 7 derniers jours
  • jittor@Jittor

    Jittor est un framework de deep learning haute performance basé sur la compilation JIT et les méta-opérateurs.

    3 232+0Évolution des étoiles sur les 7 derniers jours
  • lc0@LeelaChessZero

    Moteur d'échecs open-source basé sur les réseaux de neurones avec accélération GPU et large prise en charge matérielle.

    3 197+0Évolution des étoiles sur les 7 derniers jours
  • skills@NVIDIA

    Compétences d'agent pour les produits NVIDIA — à installer dans Claude Code, Codex et d'autres agents de codage pour exécuter des flux de travail d'IA physique, de robotique, de simulation, de CUDA et de RAG de bout en bout.

    3 180+0Évolution des étoiles sur les 7 derniers jours
  • cuda-oxide@NVlabs

    cuda-oxide est un compilateur expérimental Rust-vers-CUDA qui permet d'écrire des noyaux GPU (SIMT) en Rust idiomatique et sécurisé. Il compile le code Rust standard directement en PTX, sans DSL ni liaisons de langage étranger.

    3 118+0Évolution des étoiles sur les 7 derniers jours
  • aresdb@uber

    Moteur de stockage et de requête analytique en temps réel accéléré par GPU.

    3 076+0Évolution des étoiles sur les 7 derniers jours
  • heavydb@heavyai

    HeavyDB (anciennement MapD/OmniSciDB).

    3 059+0Évolution des étoiles sur les 7 derniers jours
  • ramalama@containers

    RamaLama est un outil open-source simplifiant l'hébergement local de modèles d'IA et facilitant leur utilisation pour l'inférence en production, via le langage familier des conteneurs.

    3 031+0Évolution des étoiles sur les 7 derniers jours
  • TensorRT@pytorch

    Compilateur PyTorch/TorchScript/FX pour GPU NVIDIA utilisant TensorRT.

    2 989+0Évolution des étoiles sur les 7 derniers jours
  • ao@pytorch

    Quantification native PyTorch pour l'entraînement et l'inférence

    2 961+0Évolution des étoiles sur les 7 derniers jours
  • MinkowskiEngine@NVIDIA

    Minkowski Engine est une bibliothèque de réseaux de neurones à différenciation automatique pour les tenseurs creux de haute dimension.

    2 957+0Évolution des étoiles sur les 7 derniers jours
  • NVIDIA GPU Operator crée, configure et gère les GPU dans Kubernetes

    2 857+0Évolution des étoiles sur les 7 derniers jours
  • lucebox@Luce-Org

    Serveur d'inférence spéculative LLM pour matériel grand public et hétérogène

    2 829+0Évolution des étoiles sur les 7 derniers jours
  • futhark@diku-dk

    Un langage de programmation fonctionnel à parallélisme de données.

    2 794+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets