Aller au contenu principal
buildradar
Sign in
Sujet · inference

inference

Dépôts open source suivis étiquetés inference, triés par étoiles.

120 dépôts
  • ai-gateway@envoyproxy

    Gestionnaire d'accès unifié aux services d'IA générative construit sur Envoy Gateway

    1 990+16Évolution des étoiles sur les 7 derniers jours
  • picolm@RightNow-AI

    Exécuter un LLM d'un milliard de paramètres sur une carte à 10 $ avec 256 Mo de RAM

    1 927+4Évolution des étoiles sur les 7 derniers jours
  • agibot_x1_infer@AgibotTech

    Module d'inférence pour AgiBot X1.

    1 835+1Évolution des étoiles sur les 7 derniers jours
  • NNPACK@Maratyszcza

    Package d'accélération pour les réseaux de neurones sur processeurs multi-cœurs

    1 711+1Évolution des étoiles sur les 7 derniers jours
  • Serveur d'inférence CPU/GPU efficace, évolutif et de qualité entreprise pour les modèles 🤗 Hugging Face transformer 🚀

    1 690+0Évolution des étoiles sur les 7 derniers jours
  • uzu@trymirai

    Un moteur d'inférence haute performance pour les modèles d'IA.

    1 687+4Évolution des étoiles sur les 7 derniers jours
  • InferenceX@SemiAnalysisAI

    Plateforme de recherche de benchmark d'inférence continue open source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 et bientôt™ TPUv6e/v7/Trainium2/3

    1 613+33Évolution des étoiles sur les 7 derniers jours
  • llmgateway@theopenco

    Routez, gérez et analysez vos requêtes LLM auprès de multiples fournisseurs via une interface API unifiée.

    1 594+8Évolution des étoiles sur les 7 derniers jours
  • xllm@xLLM-AI

    Un moteur d'inférence haute performance pour les modèles LLM, VLM, DiT et REC, optimisé pour divers accélérateurs IA. Hébergé par la fondation OpenAtom.

    1 552+11Évolution des étoiles sur les 7 derniers jours
  • Un runtime rapide et convivial pour l'inférence de transformers (Bert, Albert, GPT2, Decoders, etc.) sur CPU et GPU.

    1 550+1Évolution des étoiles sur les 7 derniers jours
  • Exportateur GPU Nvidia pour Prometheus utilisant le binaire nvidia-smi ou NVML.

    1 550+4Évolution des étoiles sur les 7 derniers jours
  • budgetml@ebhy

    Déployez un service d'inférence ML à petit budget en moins de 10 lignes de code.

    1 343+0Évolution des étoiles sur les 7 derniers jours
  • rtp-llm@alibaba

    RTP-LLM : moteur d'inférence LLM haute performance d'Alibaba pour diverses applications.

    1 325+6Évolution des étoiles sur les 7 derniers jours
  • EmbedAnything@StarlightSearch

    Inférence, ingestion et indexation hautement performantes, modulaires, sécurisées en mémoire et prêtes pour la production, construites en Rust 🦀

    1 305-1Évolution des étoiles sur les 7 derniers jours
  • CausalDiscoveryToolbox@FenTechSolutions

    Package pour l'inférence causale dans les graphes et les environnements par paires. Inclut des outils pour la récupération de la structure des graphes et des dépendances.

    1 237+0Évolution des étoiles sur les 7 derniers jours
  • kubetorch@run-house

    Distribuez et exécutez des charges de travail IA sur Kubernetes comme par magie en Python, tel PyTorch pour l'infrastructure ML.

    1 224+0Évolution des étoiles sur les 7 derniers jours
  • kvpress@NVIDIA

    Compression simplifiée du cache KV pour LLM

    1 201+5Évolution des étoiles sur les 7 derniers jours
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Models est notre collection de modèles d'apprentissage automatique de pointe, optimisés pour la performance (latence, mémoire, etc.) et prêts à être déployés sur les appareils Qualcomm®.

    1 195+1Évolution des étoiles sur les 7 derniers jours
  • sglang-omni@sgl-project

    SGLang-Omni permet un service haute performance pour les modèles TTS, ASR, vocaux et omnimodaux.

    1 118+143Évolution des étoiles sur les 7 derniers jours
  • mlx-serve@ddalcu

    Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.

    1 115+245Évolution des étoiles sur les 7 derniers jours
  • tiny-vllm@jmaczan

    Construisez votre propre moteur d'inférence LLM haute performance en C++ et CUDA - une version allégée de vLLM

    1 094+15Évolution des étoiles sur les 7 derniers jours
  • Nanoflow@efeslab

    Un framework de service haute performance orienté débit pour les LLM

    975+1Évolution des étoiles sur les 7 derniers jours
  • mlxstudio@jjang-ai

    MLX Studio - Accueil de JANG_Q - Génération/édition d'images + Chat/Code tout-en-un - + OpenClaw (API Anthropic).

    965+6Évolution des étoiles sur les 7 derniers jours
  • bolt@huawei-noah

    Bolt est une bibliothèque d'apprentissage profond offrant haute performance et flexibilité hétérogène

    957+0Évolution des étoiles sur les 7 derniers jours
  • ims@OpenIntroStat

    📚 Introduction aux statistiques modernes - Un manuel universitaire open-source adoptant une approche moderne mettant en avant les relations multivariables et l'inférence basée sur la simulation.

    944+1Évolution des étoiles sur les 7 derniers jours
  • neuropod@uber

    Une interface uniforme pour exécuter des modèles de deep learning issus de multiples frameworks.

    943+0Évolution des étoiles sur les 7 derniers jours
  • model_server@openvinotoolkit

    Un serveur d'inférence scalable pour les modèles optimisés avec OpenVINO™.

    927+5Évolution des étoiles sur les 7 derniers jours
  • bark.cpp@PABannier

    Modèle Bark de Suno AI en C/C++ pour une génération rapide de synthèse vocale.

    867+1Évolution des étoiles sur les 7 derniers jours
  • pipeless@pipeless-ai

    Un framework de vision par ordinateur open-source pour créer et déployer des applications en quelques minutes.

    851-1Évolution des étoiles sur les 7 derniers jours
  • pytriton@triton-inference-server

    PyTriton est une interface de type Flask/FastAPI qui simplifie le déploiement de Triton dans des environnements Python.

    848+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets