triton
Erfasste Open-Source-Repos mit dem Tag triton, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit triton am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit triton getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Effiziente Triton-Kernel für das LLM-Training
★ 6.597+7Sterne-Änderung der letzten 7 Tage - #2
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention erzielt eine 2- bis 5-fache Beschleunigung im Vergleich zu FlashAttention, ohne Einbußen bei End-to-End-Metriken über Sprach-, Bild- und Videomodelle hinweg.
★ 3.699+15Sterne-Änderung der letzten 7 Tage - #3
LeetCode für PyTorch — 65 ML/AI-Interviewprobleme aus echten Interviews bei Google, Meta, Anthropic. Jupyter-Notebooks, ein automatischer Evaluator und ein MCP-KI-Tutor.
★ 2.461+30Sterne-Änderung der letzten 7 Tage - #4
Open-Source-CUDA-, Triton- und HIP-Compiler für verschiedene GPU- und CPU-Architekturen.
★ 1.734+3Sterne-Änderung der letzten 7 Tage - #5
Automatische Forschung für GPU-Kernel. Gib ihm ein beliebiges PyTorch-Modell, geh schlafen und wache mit optimierten Triton-Kerneln auf.
★ 1.545+10Sterne-Änderung der letzten 7 Tage - #6
FlagGems ist eine in der Triton Language implementierte Operator-Bibliothek für große Sprachmodelle.
★ 1.090+5Sterne-Änderung der letzten 7 Tage - #7
🚀🚀🚀 Eine Sammlung großartiger öffentlicher Projekte zu Large Language Models (LLM), Vision Language Models (VLM), Vision Language Action (VLA), AI Generated Content (AIGC) sowie den zugehörigen Datensätzen und Anwendungen.
★ 814+0Sterne-Änderung der letzten 7 Tage - #8
Trainierbare, schnelle und speichereffiziente spärliche Aufmerksamkeit
★ 758+9Sterne-Änderung der letzten 7 Tage - #9
Rätsel zum Lernen von Triton, spielbar mit minimaler Umgebungskonfiguration!
★ 745+1Sterne-Änderung der letzten 7 Tage - #10
Linux-Kernelmodul zur Unterstützung des Turbo-Modus und der RGB-Tastatur für Acer-Predator-Notebooks
★ 622+1Sterne-Änderung der letzten 7 Tage - #11
Eine Teilmenge der neuronalen Netzwerkmodule von PyTorch, geschrieben in Python mit OpenAI Triton.
★ 604-1Sterne-Änderung der letzten 7 Tage - #12
Vom Lehrer zu den Kacheln – eine von Grund auf neu entwickelte LLM-Destillations- und Serving-Engine: mit benutzerdefinierten Triton/CUDA-Kernels, FSDP-Destillation, Paged-KV Continuous Batching, spekulativem Decoding, einem Rust-Gateway, einem JAX-Oracle und Tools zur Interpretierbarkeit.
★ 566+46Sterne-Änderung der letzten 7 Tage - #13
Praxislabor für LLM-Algorithmen mit Theorie, Lösungen und Testfällen. Ein Tutorial für Large Language Models von den Grundlagen bis zur fortgeschrittenen Praxis, inklusive Prinzipien, Analysen, Testfällen sowie CUDA/Triton-Anwendungen.
★ 534+12Sterne-Änderung der letzten 7 Tage - #14
🚀🚀🚀 Dieses Repository listet herausragende öffentliche Projekte zu CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX und High Performance Computing (HPC).
★ 512-2Sterne-Änderung der letzten 7 Tage