cuda
Dépôts open source suivis étiquetés cuda, triés par étoiles.
- #31
Écosystème de bibliothèques et d'outils pour écrire et exécuter du code GPU rapide entièrement en Rust.
★ 5 334+0Évolution des étoiles sur les 7 derniers jours - #32★ 5 269+0Évolution des étoiles sur les 7 derniers jours
- #33★ 5 163+0Évolution des étoiles sur les 7 derniers jours
- #34★ 5 041+0Évolution des étoiles sur les 7 derniers jours
- #35★ 4 903+0Évolution des étoiles sur les 7 derniers jours
- #36
Moteur d'inférence rapide pour les modèles Transformer
★ 4 658+0Évolution des étoiles sur les 7 derniers jours - #37
Tengine est un moteur d'inférence modulaire, léger et haute performance pour appareils embarqués.
★ 4 533+0Évolution des étoiles sur les 7 derniers jours - #38
Framework de réseau de neurones C++/CUDA ultra-rapide.
★ 4 530+0Évolution des étoiles sur les 7 derniers jours - #39★ 4 395+0Évolution des étoiles sur les 7 derniers jours
- #40
Un compilateur d'apprentissage automatique et une boîte à outils d'exécution basés sur MLIR et retargetables.
★ 3 914+0Évolution des étoiles sur les 7 derniers jours - #41
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention permet une accélération de 2 à 5x par rapport à FlashAttention, sans perte de métriques de bout en bout pour les modèles de langage, d'image et de vidéo.
★ 3 699+0Évolution des étoiles sur les 7 derniers jours - #42
Entraînez, inspectez, modifiez, automatisez et exportez des scènes 3D Gaussian Splatting depuis une application native unique.
★ 3 645+0Évolution des étoiles sur les 7 derniers jours - #43
Une bibliothèque pour accélérer les modèles Transformer sur les GPU NVIDIA, incluant l'utilisation de la précision en virgule flottante 8 bits et 4 bits (FP8 et FP4) sur les GPU Hopper, Ada et Blackwell, pour offrir de meilleures performances avec une utilisation mémoire réduite lors de l'entraînement et de l'inférence.
★ 3 518+0Évolution des étoiles sur les 7 derniers jours - #44
Logiciel NVR et de vision par ordinateur IA auto-hébergé et local. Avec des fonctionnalités telles que la détection d'objets, de mouvement, la reconnaissance faciale et plus encore, il permet de surveiller votre domicile, bureau ou tout autre lieu.
★ 3 468+0Évolution des étoiles sur les 7 derniers jours - #45
LYGIA est une bibliothèque de shaders granulaire et multi-langage (GLSL, HLSL, Metal, WGSL, WEGL et CUDA) conçue pour la performance et la flexibilité.
★ 3 423+0Évolution des étoiles sur les 7 derniers jours - #46★ 3 312+0Évolution des étoiles sur les 7 derniers jours
- #47
Guide d'optimisation d'algorithmes en CUDA.
★ 3 242+0Évolution des étoiles sur les 7 derniers jours - #48
Jittor est un framework de deep learning haute performance basé sur la compilation JIT et les méta-opérateurs.
★ 3 232+0Évolution des étoiles sur les 7 derniers jours - #49
Moteur d'échecs open-source basé sur les réseaux de neurones avec accélération GPU et large prise en charge matérielle.
★ 3 197+0Évolution des étoiles sur les 7 derniers jours - #50
Compétences d'agent pour les produits NVIDIA — à installer dans Claude Code, Codex et d'autres agents de codage pour exécuter des flux de travail d'IA physique, de robotique, de simulation, de CUDA et de RAG de bout en bout.
★ 3 180+0Évolution des étoiles sur les 7 derniers jours - #51
cuda-oxide est un compilateur expérimental Rust-vers-CUDA qui permet d'écrire des noyaux GPU (SIMT) en Rust idiomatique et sécurisé. Il compile le code Rust standard directement en PTX, sans DSL ni liaisons de langage étranger.
★ 3 118+0Évolution des étoiles sur les 7 derniers jours - #52★ 3 076+0Évolution des étoiles sur les 7 derniers jours
- #53★ 3 059+0Évolution des étoiles sur les 7 derniers jours
- #54
RamaLama est un outil open-source simplifiant l'hébergement local de modèles d'IA et facilitant leur utilisation pour l'inférence en production, via le langage familier des conteneurs.
★ 3 031+0Évolution des étoiles sur les 7 derniers jours - #55★ 2 989+0Évolution des étoiles sur les 7 derniers jours
- #56★ 2 961+0Évolution des étoiles sur les 7 derniers jours
- #57
Minkowski Engine est une bibliothèque de réseaux de neurones à différenciation automatique pour les tenseurs creux de haute dimension.
★ 2 957+0Évolution des étoiles sur les 7 derniers jours - #58
NVIDIA GPU Operator crée, configure et gère les GPU dans Kubernetes
★ 2 857+0Évolution des étoiles sur les 7 derniers jours - #59★ 2 829+0Évolution des étoiles sur les 7 derniers jours
- #60★ 2 794+0Évolution des étoiles sur les 7 derniers jours