inference
Erfasste Open-Source-Repos mit dem Tag inference, sortiert nach Sternen.
- #61
Verwaltet den einheitlichen Zugriff auf generative KI-Dienste, basierend auf Envoy Gateway
★ 1.990+16Sterne-Änderung der letzten 7 Tage - #62
Ausführen eines LLMs mit 1 Milliarde Parametern auf einem 10-Dollar-Board mit 256 MB RAM
★ 1.927+4Sterne-Änderung der letzten 7 Tage - #63
Das Inferenzmodul für AgiBot X1.
★ 1.835+1Sterne-Änderung der letzten 7 Tage - #64★ 1.711+1Sterne-Änderung der letzten 7 Tage
- #65
Effizienter, skalierbarer und unternehmenstauglicher CPU/GPU-Inferenzserver für 🤗 Hugging Face Transformer-Modelle 🚀
★ 1.690+0Sterne-Änderung der letzten 7 Tage - #66★ 1.687+4Sterne-Änderung der letzten 7 Tage
- #67
Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3
★ 1.613+33Sterne-Änderung der letzten 7 Tage - #68
Leiten, verwalten und analysieren Sie Ihre LLM-Anfragen über verschiedene Anbieter hinweg mit einer einheitlichen API-Schnittstelle.
★ 1.594+8Sterne-Änderung der letzten 7 Tage - #69
Eine hochleistungsfähige Inferenz-Engine für LLM-, VLM-, DiT- und REC-Modelle, optimiert für verschiedene KI-Beschleuniger. Gehostet von der OpenAtom Foundation.
★ 1.552+11Sterne-Änderung der letzten 7 Tage - #70
Eine schnelle und benutzerfreundliche Laufzeitumgebung für Transformer-Inferenz (Bert, Albert, GPT2, Decoders usw.) auf CPU und GPU.
★ 1.550+1Sterne-Änderung der letzten 7 Tage - #71
Nvidia GPU Exporter für Prometheus mit nvidia-smi-Binary oder NVML
★ 1.550+4Sterne-Änderung der letzten 7 Tage - #72
Bereitstellung eines ML-Inferenzdienstes mit geringem Budget in weniger als 10 Zeilen Code.
★ 1.343+0Sterne-Änderung der letzten 7 Tage - #73★ 1.325+6Sterne-Änderung der letzten 7 Tage
- #74
Leistungsstarke, modulare, speichersichere und produktionsbereite Inferenz, Ingestion und Indizierung, entwickelt in Rust 🦀
★ 1.305-1Sterne-Änderung der letzten 7 Tage - #75
Paket für kausale Inferenz in Graphen und paarweisen Einstellungen. Tools zur Wiederherstellung der Graphenstruktur und für Abhängigkeiten sind enthalten.
★ 1.237+0Sterne-Änderung der letzten 7 Tage - #76
KI-Workloads in Python magisch auf Kubernetes verteilen und ausführen, wie PyTorch für ML-Infra.
★ 1.224+0Sterne-Änderung der letzten 7 Tage - #77★ 1.201+5Sterne-Änderung der letzten 7 Tage
- #78
Qualcomm® AI Hub Models ist unsere Sammlung hochmoderner Modelle für maschinelles Lernen, die auf Leistung (Latenz, Speicher usw.) optimiert und bereit für die Bereitstellung auf Qualcomm®-Geräten sind.
★ 1.195+1Sterne-Änderung der letzten 7 Tage - #79
Nativer LLM-Inferenzserver für Apple Silicon. Kompatibel mit der OpenAI- und Anthropic-API. Kein Python. Inklusive MLX Core macOS-App mit Chat, Agentenmodus und Tool-Aufrufen.
★ 1.115+245Sterne-Änderung der letzten 7 Tage - #80
SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.
★ 1.105+130Sterne-Änderung der letzten 7 Tage - #81
Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM
★ 1.094+15Sterne-Änderung der letzten 7 Tage - #82★ 975+1Sterne-Änderung der letzten 7 Tage
- #83
MLX Studio - Heimat von JANG_Q - Bilderzeugung/bearbeitung + Chat/Code Alles in einem - + OpenClaw (Anthropic API)
★ 965+4Sterne-Änderung der letzten 7 Tage - #84
Bolt ist eine Deep-Learning-Bibliothek mit hoher Leistung und heterogener Flexibilität.
★ 957+0Sterne-Änderung der letzten 7 Tage - #85
📚 Einführung in die moderne Statistik – Ein Open-Source-Lehrbuch auf Universitätsniveau mit einem modernen Ansatz, der multivariable Beziehungen und simulationsbasierte Inferenz hervorhebt.
★ 944+0Sterne-Änderung der letzten 7 Tage - #86
Eine einheitliche Schnittstelle zum Ausführen von Deep-Learning-Modellen aus mehreren Frameworks
★ 943+0Sterne-Änderung der letzten 7 Tage - #87
Skalierbarer Inferenz-Server für mit OpenVINO™ optimierte Modelle.
★ 925+5Sterne-Änderung der letzten 7 Tage - #88
Das Bark-Modell von Suno AI in C/C++ für eine schnelle Text-to-Speech-Generierung
★ 867+1Sterne-Änderung der letzten 7 Tage - #89
Ein Open-Source-Framework für Computer Vision zur schnellen Erstellung und Bereitstellung von Anwendungen.
★ 851+0Sterne-Änderung der letzten 7 Tage - #90
PyTriton ist eine Flask/FastAPI-ähnliche Schnittstelle, die die Bereitstellung von Triton in Python-Umgebungen vereinfacht.
★ 848+0Sterne-Änderung der letzten 7 Tage