NVIDIA
Erfasste Open-Source-Repos von NVIDIA, sortiert nach Sternen.
- #1
Führe Agenten wie Hermes, LangChain Deep Agents und OpenClaw sicherer in NVIDIA OpenShell mit verwaltetem Inferencing aus.
★ 22.350+42Sterne-Änderung der letzten 7 Tage - #2
Laufende Forschungsarbeiten zum Trainieren von Transformer-Modellen im großen Maßstab
★ 17.714+45Sterne-Änderung der letzten 7 Tage - #3
Quellcode des offenen NVIDIA Linux GPU-Kernelmoduls
★ 17.335+14Sterne-Änderung der letzten 7 Tage - #4
Sicherheitsscanner für KI-Agenten-Skills. Erkennen Sie Schwachstellen, schädliche Muster, Sicherheitsrisiken, Prompt Injection, Datenexfiltration und Lieferkettenrisiken in Claude Code-, Codex- und MCP-Skills, bevor Sie sie installieren.
★ 15.711+515Sterne-Änderung der letzten 7 Tage - #5
Modernste Deep-Learning-Skripte, organisiert nach Modellen – einfach zu trainieren und bereitzustellen mit reproduzierbarer Genauigkeit und Leistung auf Infrastruktur für den Unternehmenseinsatz.
★ 14.846+4Sterne-Änderung der letzten 7 Tage - #6
TensorRT LLM bietet Benutzern eine benutzerfreundliche Python-API zum Definieren von Large Language Models (LLMs) und unterstützt modernste Optimierungen zur effizienten Inferenz auf NVIDIA-GPUs. TensorRT LLM enthält zudem Komponenten zum Erstellen von Python- und C++-Runtimes, die die Inferenzausführung performant steuern.
★ 14.536+38Sterne-Änderung der letzten 7 Tage - #7
NVIDIA® TensorRT™ ist ein SDK für die Hochleistungs-Inferenz von Deep Learning auf NVIDIA-GPUs. Dieses Repository enthält die Open-Source-Komponenten von TensorRT.
★ 13.313+8Sterne-Änderung der letzten 7 Tage - #8
NVIDIA Cosmos ist eine offene Plattform aus Weltmodellen, Datensätzen und Tools, die Entwicklern die Erstellung von Physical AI für Roboter, autonome Fahrzeuge, intelligente Infrastruktur und mehr ermöglicht.
★ 11.713+44Sterne-Änderung der letzten 7 Tage - #9
PersonaPlex-Code.
★ 10.398+2Sterne-Änderung der letzten 7 Tage - #10★ 10.369+24Sterne-Änderung der letzten 7 Tage
- #11★ 9.740+1Sterne-Änderung der letzten 7 Tage
- #12
Beispiele für CUDA-Entwickler, die Funktionen des CUDA Toolkits demonstrieren
★ 9.585+19Sterne-Änderung der letzten 7 Tage - #13★ 9.094+23Sterne-Änderung der letzten 7 Tage
- #14
Eine PyTorch-Erweiterung: Tools für einfache Mixed-Precision- und verteilte Trainings in PyTorch
★ 8.998+2Sterne-Änderung der letzten 7 Tage - #15★ 8.494+77Sterne-Änderung der letzten 7 Tage
- #16
NVIDIA Isaac GR00T N1.7 – Ein Basismodell für Allzweckroboter.
★ 7.988+37Sterne-Änderung der letzten 7 Tage - #17
Ein Python-Framework für GPU-beschleunigte Simulationen, Robotik und maschinelles Lernen.
★ 7.070+17Sterne-Änderung der letzten 7 Tage - #18★ 6.923-1Sterne-Änderung der letzten 7 Tage
- #19
Transformer-bezogene Optimierung, einschließlich BERT, GPT
★ 6.448+1Sterne-Änderung der letzten 7 Tage - #20
Eine GPU-beschleunigte Bibliothek mit hochoptimierten Bausteinen und einer Ausführungs-Engine für die Datenverarbeitung zur Beschleunigung von Deep-Learning-Training- und Inferenzanwendungen.
★ 5.740+2Sterne-Änderung der letzten 7 Tage - #21★ 5.296+1Sterne-Änderung der letzten 7 Tage
- #22★ 5.269-1Sterne-Änderung der letzten 7 Tage
- #23★ 5.041+9Sterne-Änderung der letzten 7 Tage
- #24
Container unter Nutzung von NVIDIA GPUs erstellen und ausführen
★ 4.536+5Sterne-Änderung der letzten 7 Tage - #25
Generative KI-Referenz-Workflows, optimiert für beschleunigte Infrastruktur und Mikroservice-Architektur.
★ 4.169+4Sterne-Änderung der letzten 7 Tage - #26
NVIDIA-Geräte-Plugin für Kubernetes
★ 3.864+2Sterne-Änderung der letzten 7 Tage - #27
Eine einheitliche Bibliothek für SOTA-Modelloptimierungstechniken wie Quantisierung, Distillation, Pruning, Neural Architecture Search, Speculative Decoding usw. Sie komprimiert Deep-Learning-Modelle für nachgeschaltete Bereitstellungsframeworks wie TensorRT-LLM, TensorRT, vLLM usw., um die Inferenzgeschwindigkeit zu optimieren.
★ 3.697+129Sterne-Änderung der letzten 7 Tage - #28
Eine Bibliothek zur Beschleunigung von Transformer-Modellen auf NVIDIA-GPUs, einschließlich der Verwendung von 8-Bit- und 4-Bit-Gleitkommapräzision (FP8 und FP4) auf Hopper-, Ada- und Blackwell-GPUs, um eine bessere Leistung bei geringerer Speichernutzung sowohl beim Training als auch bei der Inferenz zu erzielen.
★ 3.518+9Sterne-Änderung der letzten 7 Tage - #29
CUDA Python: Performance trifft auf Produktivität
★ 3.369+2Sterne-Änderung der letzten 7 Tage - #30
PyTorch-Implementierung von FlowNet 2.0: Weiterentwicklung der optischen Fluss-Schätzung mit Deep Networks
★ 3.292+3Sterne-Änderung der letzten 7 Tage - #31
Open-Source-Deep-Learning-Framework zum Erstellen, Trainieren und Feinabstimmen von Deep-Learning-Modellen mithilfe modernster Physics-ML-Methoden
★ 3.213+5Sterne-Änderung der letzten 7 Tage - #32
Agent-Skills für NVIDIA-Produkte — zur Installation in Claude Code, Codex und andere Coding-Agenten, um Physical AI, Robotik, Simulation, CUDA und RAG-Workflows end-to-end auszuführen.
★ 3.180+43Sterne-Änderung der letzten 7 Tage - #33
Die NeMo Retriever Library ist ein skalierbares, leistungsorientiertes Mikroservice zur Extraktion von Dokumenteninhalten und Metadaten. Die NeMo Retriever Library nutzt spezialisierte NVIDIA NIM-Mikroservices, um Text, Tabellen, Diagramme und Bilder zu finden, zu kontextualisieren und zu extrahieren, die in nachgelagerten generativen Anwendungen verwendet werden können.
★ 2.972+1Sterne-Änderung der letzten 7 Tage - #34
Minkowski Engine ist eine Auto-Diff-Bibliothek für neuronale Netze für hochdimensionale spärliche Tensoren.
★ 2.957+1Sterne-Änderung der letzten 7 Tage - #35
Der NVIDIA GPU Operator erstellt, konfiguriert und verwaltet GPUs in Kubernetes
★ 2.857+4Sterne-Änderung der letzten 7 Tage - #36
Das NVIDIA NeMo Agent Toolkit ist eine Open-Source-Bibliothek zur effizienten Vernetzung und Optimierung von KI-Agenten-Teams.
★ 2.608+3Sterne-Änderung der letzten 7 Tage - #37★ 2.500+8Sterne-Änderung der letzten 7 Tage
- #38
CUDA-Bibliothekbeispiele
★ 2.491+3Sterne-Änderung der letzten 7 Tage - #39
`std::execution`, das C++-Standardframework für asynchrone und parallele Programmierung.
★ 2.427+3Sterne-Änderung der letzten 7 Tage - #40
cuTile ist ein Programmiermodell zum Schreiben paralleler Kernel für NVIDIA-GPUs
★ 2.138+0Sterne-Änderung der letzten 7 Tage - #41
TensorRT-Erweiterung für die Stable Diffusion Web UI
★ 1.988-1Sterne-Änderung der letzten 7 Tage - #42
Von NVIDIA kuratierte Sammlung von Bildungsressourcen zur universellen GPU-Programmierung.
★ 1.953+6Sterne-Änderung der letzten 7 Tage - #43★ 1.921+4Sterne-Änderung der letzten 7 Tage
- #44
NVIDIA GPU-Metrik-Exporter für Prometheus mit DCGM
★ 1.856+8Sterne-Änderung der letzten 7 Tage - #45
Einfache Beispiele für die TensorRT-Programmierung
★ 1.670+3Sterne-Änderung der letzten 7 Tage - #46
NCCL-Tests
★ 1.643+4Sterne-Änderung der letzten 7 Tage - #47
Dieses Repository enthält den Quellcode für RULER: What’s the Real Context Size of Your Long-Context Language Models?
★ 1.610+2Sterne-Änderung der letzten 7 Tage - #48★ 1.471+2Sterne-Änderung der letzten 7 Tage
- #49
Eine effiziente C++20-GPU-Bibliothek für numerisches Rechnen mit Python-ähnlicher Syntax
★ 1.444+0Sterne-Änderung der letzten 7 Tage - #50
NVIDIA DLSS ist ein neues und verbessertes Deep-Learning-Neuronennetzwerk, das die Bildwiederholraten erhöht und schöne, scharfe Bilder für Ihre Spiele erzeugt
★ 1.438+13Sterne-Änderung der letzten 7 Tage - #51
Eine schnelle GPU-Speicherkopierbibliothek basierend auf der NVIDIA-GPUDirect-RDMA-Technologie
★ 1.412+0Sterne-Änderung der letzten 7 Tage - #52
Dokumentation der NVIDIA-Chip-/Hardwareschnittstellen
★ 1.363+3Sterne-Änderung der letzten 7 Tage - #53
Sammlung von Schritt-für-Schritt-Playbooks zur Einrichtung von KI/ML-Workloads auf NVIDIA DGX Spark-Geräten mit Blackwell-Architektur.
★ 1.319+14Sterne-Änderung der letzten 7 Tage - #54★ 1.227+1Sterne-Änderung der letzten 7 Tage
- #55★ 1.201+5Sterne-Änderung der letzten 7 Tage
- #56
PyTorch-Implementierung von Audio Flamingo: Eine Reihe fortgeschrittener Sprachmodelle zum Audioverständnis
★ 1.184+2Sterne-Änderung der letzten 7 Tage - #57
C++- und Python-Unterstützung für das CUDA Quantum-Programmiermodell für heterogene quanten-klassische Workflows
★ 1.125+3Sterne-Änderung der letzten 7 Tage - #58
NVIDIA Container-Runtime-Bibliothek
★ 1.124+2Sterne-Änderung der letzten 7 Tage - #59
Open-Source-Deep-Learning-Framework zum Erkunden, Erstellen und Bereitstellen von KI-Wetter-/Klima-Workflows.
★ 1.120+18Sterne-Änderung der letzten 7 Tage - #60
Ein einfaches, aber leistungsstarkes Tool, um traditionelle Container-/OS-Images in unprivilegierte Sandboxes zu verwandeln.
★ 1.097+2Sterne-Änderung der letzten 7 Tage - #61
Eine Python-Bibliothek, die die Nutzung der GPIOs von Jetson ermöglicht
★ 1.078+3Sterne-Änderung der letzten 7 Tage - #62
Offizieller Codebase für „DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos“ (ICML 2026)
★ 1.069+5Sterne-Änderung der letzten 7 Tage - #63
RAFT enthält grundlegende, weit verbreitete Algorithmen und Primitiven für Machine Learning und Information Retrieval. Die Algorithmen sind CUDA-beschleunigt und bilden Bausteine zur einfacheren Erstellung von Hochleistungsanwendungen.
★ 1.039+2Sterne-Änderung der letzten 7 Tage - #64★ 1.033+1Sterne-Änderung der letzten 7 Tage
- #65
CUDA Tile IR ist eine MLIR-basierte Zwischendarstellung und Compiler-Infrastruktur für die CUDA-Kernel-Optimierung mit Fokus auf kachelbasierten Berechnungsmustern und Optimierungen für NVIDIA Tensor Core Einheiten.
★ 1.021+2Sterne-Änderung der letzten 7 Tage - #66
NVIDIA cuDF für Apache Spark Plugin – Beschleunigung von Apache Spark mit GPUs
★ 998+1Sterne-Änderung der letzten 7 Tage - #67★ 964+3Sterne-Änderung der letzten 7 Tage
- #68
Das cuDNN Frontend ist NVIDIAs moderner Open-Source-Einstiegspunkt in die cuDNN-Bibliothek und eine wachsende Sammlung von Hochleistungs-Open-Source-Kerneln.
★ 929+11Sterne-Änderung der letzten 7 Tage - #69★ 925+1Sterne-Änderung der letzten 7 Tage
- #70
Beispiele, die verfügbare Optionen zur Programmierung mehrerer GPUs in einem einzelnen Knoten oder Cluster demonstrieren
★ 912+1Sterne-Änderung der letzten 7 Tage - #71★ 847+6Sterne-Änderung der letzten 7 Tage
- #72
Nützliche Kernel-Tutorials, Beispiele und SKILLs für kachelbasierte GPU-Programmierung
★ 807+1Sterne-Änderung der letzten 7 Tage - #73
NVIDIA Data Center GPU Manager (DCGM) ist ein Projekt zur Erfassung von Telemetriedaten und Messung des Zustands von NVIDIA-GPUs
★ 786+2Sterne-Änderung der letzten 7 Tage - #74
Ein Tool für Bandbreitenmessungen auf NVIDIA-GPUs.
★ 763+5Sterne-Änderung der letzten 7 Tage - #75
Differenzierbare Signalverarbeitung auf der Kugel für PyTorch
★ 700+3Sterne-Änderung der letzten 7 Tage - #76★ 691+1Sterne-Änderung der letzten 7 Tage
- #77★ 662+1Sterne-Änderung der letzten 7 Tage
- #78★ 641+0Sterne-Änderung der letzten 7 Tage
- #79
DreamGen: Eine Initiative des Nvidia GEAR Labs zur Lösung des Robotik-Datenproblems mittels Weltmodellen
★ 607+4Sterne-Änderung der letzten 7 Tage - #80
NVIDIA Math Libraries für das Python-Ökosystem
★ 598+1Sterne-Änderung der letzten 7 Tage - #81
Router that virtually distributes inference across connected devices in the home.
★ 584—Sterne-Änderung der letzten 7 Tage - #82
NVIDIA NVSHMEM ist eine parallele Programmierschnittstelle für NVIDIA-GPUs basierend auf OpenSHMEM. NVSHMEM reduziert den Kommunikations- und Koordinationsaufwand zwischen Prozessen erheblich, indem es einseitige Kommunikation direkt aus CUDA-Kernels und CUDA-Streams ermöglicht.
★ 582+3Sterne-Änderung der letzten 7 Tage - #83
Eine Single-Header-C++-Bibliothek zur Vereinfachung der CUDA Runtime Compilation (NVRTC).
★ 574+0Sterne-Änderung der letzten 7 Tage - #84
Das NVIDIA® Tools Extension SDK (NVTX) ist eine C-basierte Programmierschnittstelle (API) zur Annotation von Ereignissen, Codebereichen und Ressourcen in Ihren Anwendungen.
★ 558+3Sterne-Änderung der letzten 7 Tage - #85
Bibliothek für SOMA BVH zu humanoidem Roboter-Motion-Retargeting, erstellt mit Newton und NVIDIA Warp.
★ 551+2Sterne-Änderung der letzten 7 Tage - #86★ 539+1Sterne-Änderung der letzten 7 Tage
- #87
Leistungsstarke, leichtgewichtige C++ LLM- und VLM-Inferenzsoftware für Physical AI
★ 537+11Sterne-Änderung der letzten 7 Tage - #88★ 535+1Sterne-Änderung der letzten 7 Tage
- #89
HPC Container Maker
★ 517+0Sterne-Änderung der letzten 7 Tage - #90
Our inference and training framework to run on the Cosmos Models
★ 507—Sterne-Änderung der letzten 7 Tage