inference
Dépôts open source suivis étiquetés inference, triés par étoiles.
- #91
Tutoriel sur l'API C++ de TensorRT.
★ 811+0Évolution des étoiles sur les 7 derniers jours - #92★ 803-1Évolution des étoiles sur les 7 derniers jours
- #93★ 774—Évolution des étoiles sur les 7 derniers jours
- #94
Package Python léger, rapide et sans dépendance pour déduire les types de fichiers binaires en vérifiant la signature des nombres magiques.
★ 773+2Évolution des étoiles sur les 7 derniers jours - #95
Exemples de notebooks pour travailler avec SageMaker Studio Lab. Inscrivez-vous via le lien ci-dessous !
★ 772+1Évolution des étoiles sur les 7 derniers jours - #96
Outil de productivité IA gratuit et open source, conçu pour améliorer la productivité des utilisateurs tout en protégeant la confidentialité et la sécurité des données. Inclut, sans s'y limiter : des modèles locaux intégrés comme ChatGPT, DeepSeek, Phi, Qwen, ainsi que le traitement intelligent par lots en un clic d'images, de vidéos, d'audio, etc.
★ 768+0Évolution des étoiles sur les 7 derniers jours - #97
⚡ Serveur d'inférence LLM natif en Swift avec MLX pour Apple Silicon. API compatible OpenAI, streaming SSD pour les modèles MoE de plus de 100 milliards de paramètres, compression de cache KV TurboQuant, application mobile pour iOS et macOS.
★ 760+8Évolution des étoiles sur les 7 derniers jours - #98★ 753+0Évolution des étoiles sur les 7 derniers jours
- #99
Moteur d'inférence d'apprentissage automatique pour microcontrôleurs et appareils embarqués
★ 753+5Évolution des étoiles sur les 7 derniers jours - #100★ 748+3Évolution des étoiles sur les 7 derniers jours
- #101
yolort est une pile d'exécution pour yolov5 sur des accélérateurs spécialisés tels que tensorrt, libtorch, onnxruntime, tvm et ncnn.
★ 730+0Évolution des étoiles sur les 7 derniers jours - #102
Privacy Meter : Une bibliothèque open-source pour auditer la confidentialité des données dans les algorithmes statistiques et d'apprentissage automatique.
★ 725+1Évolution des étoiles sur les 7 derniers jours - #103
Graph Data Science : une couche d'abstraction en Python pour construire des graphes de connaissances, intégrée aux bibliothèques de graphes populaires – au-dessus de Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, etc.
★ 691+2Évolution des étoiles sur les 7 derniers jours - #104
Ollama pour les modèles de ML classiques. Compilateur AOT qui transforme les modèles XGBoost, LightGBM, scikit-learn, CatBoost et ONNX en code d'inférence C99 natif. Une commande pour charger, une commande pour diffuser. 336 fois plus rapide que l'inférence Python.
★ 687+0Évolution des étoiles sur les 7 derniers jours - #105
Entraînez un détecteur d'objets yolov3 de pointe à partir de zéro !
★ 677+0Évolution des étoiles sur les 7 derniers jours - #106
Moteur d'inférence LLM en Rust pur et CUDA — sans PyTorch, compatible avec OpenAI, servant Qwen3 vers Kimi-K2.
★ 676+18Évolution des étoiles sur les 7 derniers jours - #107
Simulateur précis, à grande échelle et extensible pour les systèmes d'inférence de LLM
★ 673+5Évolution des étoiles sur les 7 derniers jours - #108
Un moteur d'inférence onnx léger, portable en pur C99 pour appareils embarqués avec support de l'accélération matérielle.
★ 652+0Évolution des étoiles sur les 7 derniers jours - #109
Orchestration de tâches GPU serverless haute performance — la couche de planification derrière wavespeed.ai
★ 632+0Évolution des étoiles sur les 7 derniers jours - #110
Réalisez l'inférence llama3 étape par étape, saisissez les concepts fondamentaux, maîtrisez la dérivation du processus, implémentez le code.
★ 630+0Évolution des étoiles sur les 7 derniers jours - #111
Deep Learning Streamer (DL Streamer) Pipeline Framework est un framework open-source d'analytique média en streaming, basé sur le framework multimédia GStreamer*, pour créer des pipelines d'analytique média complexes pour le Cloud ou au Edge.
★ 622-1Évolution des étoiles sur les 7 derniers jours - #112
Convertir un modèle mmdetection en tensorrt, prend en charge fp16, int8, l'entrée par lot, la forme dynamique, etc.
★ 596+0Évolution des étoiles sur les 7 derniers jours - #113★ 561—Évolution des étoiles sur les 7 derniers jours
- #114
Bibliothèque Python pour la détection de petits objets et la segmentation d'instances avec YOLO
★ 557+0Évolution des étoiles sur les 7 derniers jours - #115
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 548—Évolution des étoiles sur les 7 derniers jours - #116★ 539+2Évolution des étoiles sur les 7 derniers jours
- #117
Exécutez vos charges de travail de deep learning sur Kubernetes plus facilement et efficacement.
★ 532+1Évolution des étoiles sur les 7 derniers jours - #118
Triton Model Analyzer est un outil en ligne de commande pour aider à mieux comprendre les besoins en calcul et en mémoire des modèles Triton Inference Server.
★ 526+0Évolution des étoiles sur les 7 derniers jours - #119
A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.
★ 514+8Évolution des étoiles sur les 7 derniers jours - #120★ 512+0Évolution des étoiles sur les 7 derniers jours