inference
Erfasste Open-Source-Repos mit dem Tag inference, sortiert nach Sternen.
- #91
TensorRT C++ API Tutorial
★ 811+0Sterne-Änderung der letzten 7 Tage - #92★ 802-1Sterne-Änderung der letzten 7 Tage
- #93
Kleine, abhängigkeitsfreie und schnelle Python-Bibliothek zur Bestimmung von Binärdateitypen anhand von Magic-Number-Signaturen.
★ 772+2Sterne-Änderung der letzten 7 Tage - #94
Beispiel-Notebooks für die Arbeit mit SageMaker Studio Lab. Registrieren Sie sich über den Link unten für ein Konto!
★ 772+0Sterne-Änderung der letzten 7 Tage - #95
KI-Produktivitätstool – Kostenlos und Open Source, verbessert die Benutzerproduktivität und schützt Privatsphäre sowie Datensicherheit. Beinhaltet unter anderem: integrierte lokale exklusive ChatGPT-, DeepSeek-, Phi-, Qwen- und andere Modelle, KI-gestützte Stapelverarbeitung von Bildern, Videos, Audio usw. mit nur einem Klick.
★ 769+0Sterne-Änderung der letzten 7 Tage - #96
⚡ Nativer MLX Swift LLM Inferenzserver für Apple Silicon. OpenAI-kompatible API, SSD-Streaming für 100B+ MoE-Modelle, TurboQuant KV-Cache-Kompression, macOS + iOS iPhone-App.
★ 760+6Sterne-Änderung der letzten 7 Tage - #97★ 753+4Sterne-Änderung der letzten 7 Tage
- #98★ 753+0Sterne-Änderung der letzten 7 Tage
- #99★ 748+2Sterne-Änderung der letzten 7 Tage
- #100
yolort ist ein Laufzeit-Stack für yolov5 auf spezialisierten Beschleunigern wie TensorRT, LibTorch, ONNXRuntime, TVM und NCNN.
★ 730+0Sterne-Änderung der letzten 7 Tage - #101
Privacy Meter: Eine Open-Source-Bibliothek zur Prüfung des Datenschutzes in statistischen und Machine-Learning-Algorithmen.
★ 725+0Sterne-Änderung der letzten 7 Tage - #102
Graph Data Science: Eine Abstraktionsschicht in Python zum Erstellen von Wissensgraphen, integriert in gängige Graph-Bibliotheken – basierend auf Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow usw.
★ 691+2Sterne-Änderung der letzten 7 Tage - #103
Ollama für klassische ML-Modelle. Ein AOT-Compiler, der XGBoost-, LightGBM-, scikit-learn-, CatBoost- und ONNX-Modelle in nativen C99-Inferenzcode umwandelt. Ein Befehl zum Laden, ein Befehl zum Bereitstellen. 336x schneller als Python-Inferenz.
★ 687+0Sterne-Änderung der letzten 7 Tage - #104
Reines Rust + CUDA LLM-Inferenz-Engine — kein PyTorch, OpenAI-kompatibel, bedient Qwen3 bis Kimi-K2
★ 677+14Sterne-Änderung der letzten 7 Tage - #105
Trainieren Sie einen hochmodernen yolov3-Objektdetektor von Grund auf!
★ 677+0Sterne-Änderung der letzten 7 Tage - #106★ 673+4Sterne-Änderung der letzten 7 Tage
- #107
Eine轻量级、portabile reine C99 ONNX-Inferenzengine für eingebettete Geräte mit Unterstützung für Hardwarebeschleunigung.
★ 652+0Sterne-Änderung der letzten 7 Tage - #108
Hochperformante serverlose GPU-Task-Orchestrierung – die Scheduling-Ebene hinter wavespeed.ai.
★ 632+0Sterne-Änderung der letzten 7 Tage - #109
Schritt-für-Schritt-Implementierung der llama3-Inferenz, Verständnis der Kernkonzepte, Beherrschung der Prozessableitung und Implementierung des Codes.
★ 630+0Sterne-Änderung der letzten 7 Tage - #110★ 629—Sterne-Änderung der letzten 7 Tage
- #111
Das Deep Learning Streamer (DL Streamer) Pipeline Framework ist ein Open-Source-Streaming-Medienanalyse-Framework auf Basis des GStreamer*-Multimedia-Frameworks zur Erstellung komplexer Medienanalyse-Pipelines für die Cloud oder Edge.
★ 622+0Sterne-Änderung der letzten 7 Tage - #112
Konvertierung von mmdetection-Modellen zu TensorRT, unterstützt FP16, INT8, Batch-Input, dynamische Shapes usw.
★ 596+0Sterne-Änderung der letzten 7 Tage - #113★ 561—Sterne-Änderung der letzten 7 Tage
- #114
Python-Bibliothek für YOLO-Objekterkennung kleiner Objekte und Instanzsegmentierung
★ 557+0Sterne-Änderung der letzten 7 Tage - #115
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—Sterne-Änderung der letzten 7 Tage - #116★ 539+1Sterne-Änderung der letzten 7 Tage
- #117
Führen Sie Ihre Deep-Learning-Workloads einfacher und effizienter auf Kubernetes aus.
★ 532+1Sterne-Änderung der letzten 7 Tage - #118
Triton Model Analyzer ist ein CLI-Tool zur besseren Analyse der Rechen- und Speicheranforderungen von Modellen für den Triton Inference Server.
★ 526+0Sterne-Änderung der letzten 7 Tage - #119
A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.
★ 513+7Sterne-Änderung der letzten 7 Tage - #120★ 512+0Sterne-Änderung der letzten 7 Tage