Aller au contenu principal
buildradar
Sign in
Sujet · inference

inference

Dépôts open source suivis étiquetés inference, triés par étoiles.

120 dépôts
  • tensorrt-cpp-api@cyrusbehr

    Tutoriel sur l'API C++ de TensorRT.

    811+0Évolution des étoiles sur les 7 derniers jours
  • cppflow@serizba

    Exécuter des modèles TensorFlow en C++ sans installation ni Bazel

    803-1Évolution des étoiles sur les 7 derniers jours
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    774Évolution des étoiles sur les 7 derniers jours
  • filetype.py@h2non

    Package Python léger, rapide et sans dépendance pour déduire les types de fichiers binaires en vérifiant la signature des nombres magiques.

    773+2Évolution des étoiles sur les 7 derniers jours
  • studio-lab-examples@aws

    Exemples de notebooks pour travailler avec SageMaker Studio Lab. Inscrivez-vous via le lien ci-dessous !

    772+1Évolution des étoiles sur les 7 derniers jours
  • APT@rnchg

    Outil de productivité IA gratuit et open source, conçu pour améliorer la productivité des utilisateurs tout en protégeant la confidentialité et la sécurité des données. Inclut, sans s'y limiter : des modèles locaux intégrés comme ChatGPT, DeepSeek, Phi, Qwen, ainsi que le traitement intelligent par lots en un clic d'images, de vidéos, d'audio, etc.

    768+0Évolution des étoiles sur les 7 derniers jours
  • SwiftLM@SharpAI

    ⚡ Serveur d'inférence LLM natif en Swift avec MLX pour Apple Silicon. API compatible OpenAI, streaming SSD pour les modèles MoE de plus de 100 milliards de paramètres, compression de cache KV TurboQuant, application mobile pour iOS et macOS.

    760+8Évolution des étoiles sur les 7 derniers jours
  • InferLLM@MegEngine

    un framework d'inférence de modèles LLM léger

    753+0Évolution des étoiles sur les 7 derniers jours
  • emlearn@emlearn

    Moteur d'inférence d'apprentissage automatique pour microcontrôleurs et appareils embarqués

    753+5Évolution des étoiles sur les 7 derniers jours
  • identYwaf@stamparm

    Outil d'identification de WAF en aveugle.

    748+3Évolution des étoiles sur les 7 derniers jours
  • yolort@zhiqwang

    yolort est une pile d'exécution pour yolov5 sur des accélérateurs spécialisés tels que tensorrt, libtorch, onnxruntime, tvm et ncnn.

    730+0Évolution des étoiles sur les 7 derniers jours
  • ml_privacy_meter@privacytrustlab

    Privacy Meter : Une bibliothèque open-source pour auditer la confidentialité des données dans les algorithmes statistiques et d'apprentissage automatique.

    725+1Évolution des étoiles sur les 7 derniers jours
  • kglab@DerwenAI

    Graph Data Science : une couche d'abstraction en Python pour construire des graphes de connaissances, intégrée aux bibliothèques de graphes populaires – au-dessus de Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, etc.

    691+2Évolution des étoiles sur les 7 derniers jours
  • timber@kossisoroyce

    Ollama pour les modèles de ML classiques. Compilateur AOT qui transforme les modèles XGBoost, LightGBM, scikit-learn, CatBoost et ONNX en code d'inférence C99 natif. Une commande pour charger, une commande pour diffuser. 336 fois plus rapide que l'inférence Python.

    687+0Évolution des étoiles sur les 7 derniers jours
  • TrainYourOwnYOLO@AntonMu

    Entraînez un détecteur d'objets yolov3 de pointe à partir de zéro !

    677+0Évolution des étoiles sur les 7 derniers jours
  • pegainfer@pegainfer-project

    Moteur d'inférence LLM en Rust pur et CUDA — sans PyTorch, compatible avec OpenAI, servant Qwen3 vers Kimi-K2.

    676+18Évolution des étoiles sur les 7 derniers jours
  • vidur@microsoft

    Simulateur précis, à grande échelle et extensible pour les systèmes d'inférence de LLM

    673+5Évolution des étoiles sur les 7 derniers jours
  • libonnx@xboot

    Un moteur d'inférence onnx léger, portable en pur C99 pour appareils embarqués avec support de l'accélération matérielle.

    652+0Évolution des étoiles sur les 7 derniers jours
  • waverless@WaveSpeedAI

    Orchestration de tâches GPU serverless haute performance — la couche de planification derrière wavespeed.ai

    632+0Évolution des étoiles sur les 7 derniers jours
  • Deepdive-llama3-from-scratch@therealoliver

    Réalisez l'inférence llama3 étape par étape, saisissez les concepts fondamentaux, maîtrisez la dérivation du processus, implémentez le code.

    630+0Évolution des étoiles sur les 7 derniers jours
  • dlstreamer@open-edge-platform

    Deep Learning Streamer (DL Streamer) Pipeline Framework est un framework open-source d'analytique média en streaming, basé sur le framework multimédia GStreamer*, pour créer des pipelines d'analytique média complexes pour le Cloud ou au Edge.

    622-1Évolution des étoiles sur les 7 derniers jours
  • Convertir un modèle mmdetection en tensorrt, prend en charge fp16, int8, l'entrée par lot, la forme dynamique, etc.

    596+0Évolution des étoiles sur les 7 derniers jours
  • inferoa@agentic-in

    Inference-native Tokenmaxxing Agent Harness for Loop Engineering

    561Évolution des étoiles sur les 7 derniers jours
  • Bibliothèque Python pour la détection de petits objets et la segmentation d'instances avec YOLO

    557+0Évolution des étoiles sur les 7 derniers jours
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548Évolution des étoiles sur les 7 derniers jours
  • aikit@kaito-project

    🏗️ Affinez, construisez et déployez facilement des LLM open source !

    539+2Évolution des étoiles sur les 7 derniers jours
  • kubedl@kubedl-io

    Exécutez vos charges de travail de deep learning sur Kubernetes plus facilement et efficacement.

    532+1Évolution des étoiles sur les 7 derniers jours
  • model_analyzer@triton-inference-server

    Triton Model Analyzer est un outil en ligne de commande pour aider à mieux comprendre les besoins en calcul et en mémoire des modèles Triton Inference Server.

    526+0Évolution des étoiles sur les 7 derniers jours
  • nanoowl@NVIDIA-AI-IOT

    A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.

    514+8Évolution des étoiles sur les 7 derniers jours
  • blindai@mithril-security

    Déploiement d'IA confidentielle avec des enclaves sécurisées

    512+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets