inference
Dépôts open source suivis étiquetés inference, triés par étoiles.
- #61
Gestionnaire d'accès unifié aux services d'IA générative construit sur Envoy Gateway
★ 1 990+16Évolution des étoiles sur les 7 derniers jours - #62
Exécuter un LLM d'un milliard de paramètres sur une carte à 10 $ avec 256 Mo de RAM
★ 1 927+4Évolution des étoiles sur les 7 derniers jours - #63
Module d'inférence pour AgiBot X1.
★ 1 835+1Évolution des étoiles sur les 7 derniers jours - #64★ 1 711+1Évolution des étoiles sur les 7 derniers jours
- #65
Serveur d'inférence CPU/GPU efficace, évolutif et de qualité entreprise pour les modèles 🤗 Hugging Face transformer 🚀
★ 1 690+0Évolution des étoiles sur les 7 derniers jours - #66★ 1 687+4Évolution des étoiles sur les 7 derniers jours
- #67
Plateforme de recherche de benchmark d'inférence continue open source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 et bientôt™ TPUv6e/v7/Trainium2/3
★ 1 613+33Évolution des étoiles sur les 7 derniers jours - #68
Routez, gérez et analysez vos requêtes LLM auprès de multiples fournisseurs via une interface API unifiée.
★ 1 594+8Évolution des étoiles sur les 7 derniers jours - #69
Un moteur d'inférence haute performance pour les modèles LLM, VLM, DiT et REC, optimisé pour divers accélérateurs IA. Hébergé par la fondation OpenAtom.
★ 1 552+11Évolution des étoiles sur les 7 derniers jours - #70
Un runtime rapide et convivial pour l'inférence de transformers (Bert, Albert, GPT2, Decoders, etc.) sur CPU et GPU.
★ 1 550+1Évolution des étoiles sur les 7 derniers jours - #71
Exportateur GPU Nvidia pour Prometheus utilisant le binaire nvidia-smi ou NVML.
★ 1 550+4Évolution des étoiles sur les 7 derniers jours - #72★ 1 343+0Évolution des étoiles sur les 7 derniers jours
- #73
RTP-LLM : moteur d'inférence LLM haute performance d'Alibaba pour diverses applications.
★ 1 325+6Évolution des étoiles sur les 7 derniers jours - #74
Inférence, ingestion et indexation hautement performantes, modulaires, sécurisées en mémoire et prêtes pour la production, construites en Rust 🦀
★ 1 305-1Évolution des étoiles sur les 7 derniers jours - #75
Package pour l'inférence causale dans les graphes et les environnements par paires. Inclut des outils pour la récupération de la structure des graphes et des dépendances.
★ 1 237+0Évolution des étoiles sur les 7 derniers jours - #76
Distribuez et exécutez des charges de travail IA sur Kubernetes comme par magie en Python, tel PyTorch pour l'infrastructure ML.
★ 1 224+0Évolution des étoiles sur les 7 derniers jours - #77★ 1 201+5Évolution des étoiles sur les 7 derniers jours
- #78
Qualcomm® AI Hub Models est notre collection de modèles d'apprentissage automatique de pointe, optimisés pour la performance (latence, mémoire, etc.) et prêts à être déployés sur les appareils Qualcomm®.
★ 1 195+1Évolution des étoiles sur les 7 derniers jours - #79
SGLang-Omni permet un service haute performance pour les modèles TTS, ASR, vocaux et omnimodaux.
★ 1 118+143Évolution des étoiles sur les 7 derniers jours - #80
Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.
★ 1 115+245Évolution des étoiles sur les 7 derniers jours - #81
Construisez votre propre moteur d'inférence LLM haute performance en C++ et CUDA - une version allégée de vLLM
★ 1 094+15Évolution des étoiles sur les 7 derniers jours - #82★ 975+1Évolution des étoiles sur les 7 derniers jours
- #83
MLX Studio - Accueil de JANG_Q - Génération/édition d'images + Chat/Code tout-en-un - + OpenClaw (API Anthropic).
★ 965+6Évolution des étoiles sur les 7 derniers jours - #84
Bolt est une bibliothèque d'apprentissage profond offrant haute performance et flexibilité hétérogène
★ 957+0Évolution des étoiles sur les 7 derniers jours - #85
📚 Introduction aux statistiques modernes - Un manuel universitaire open-source adoptant une approche moderne mettant en avant les relations multivariables et l'inférence basée sur la simulation.
★ 944+1Évolution des étoiles sur les 7 derniers jours - #86
Une interface uniforme pour exécuter des modèles de deep learning issus de multiples frameworks.
★ 943+0Évolution des étoiles sur les 7 derniers jours - #87
Un serveur d'inférence scalable pour les modèles optimisés avec OpenVINO™.
★ 927+5Évolution des étoiles sur les 7 derniers jours - #88★ 867+1Évolution des étoiles sur les 7 derniers jours
- #89
Un framework de vision par ordinateur open-source pour créer et déployer des applications en quelques minutes.
★ 851-1Évolution des étoiles sur les 7 derniers jours - #90
PyTriton est une interface de type Flask/FastAPI qui simplifie le déploiement de Triton dans des environnements Python.
★ 848+0Évolution des étoiles sur les 7 derniers jours