Zum Hauptinhalt springen
buildradar
Sign in
Thema · inference

inference

Erfasste Open-Source-Repos mit dem Tag inference, sortiert nach Sternen.

120 Repos
  • ai-gateway@envoyproxy

    Verwaltet den einheitlichen Zugriff auf generative KI-Dienste, basierend auf Envoy Gateway

    1.990+16Sterne-Änderung der letzten 7 Tage
  • picolm@RightNow-AI

    Ausführen eines LLMs mit 1 Milliarde Parametern auf einem 10-Dollar-Board mit 256 MB RAM

    1.927+4Sterne-Änderung der letzten 7 Tage
  • agibot_x1_infer@AgibotTech

    Das Inferenzmodul für AgiBot X1.

    1.835+1Sterne-Änderung der letzten 7 Tage
  • NNPACK@Maratyszcza

    Beschleunigungspaket für neuronale Netze auf Mehrkern-CPUs

    1.711+1Sterne-Änderung der letzten 7 Tage
  • Effizienter, skalierbarer und unternehmenstauglicher CPU/GPU-Inferenzserver für 🤗 Hugging Face Transformer-Modelle 🚀

    1.690+0Sterne-Änderung der letzten 7 Tage
  • uzu@trymirai

    Eine Hochleistungs-Inferenz-Engine für KI-Modelle

    1.687+4Sterne-Änderung der letzten 7 Tage
  • InferenceX@SemiAnalysisAI

    Open-Source-Forschungsplattform für kontinuierliche Inferenz-Benchmarks — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & bald™ TPUv6e/v7/Trainium2/3

    1.613+33Sterne-Änderung der letzten 7 Tage
  • llmgateway@theopenco

    Leiten, verwalten und analysieren Sie Ihre LLM-Anfragen über verschiedene Anbieter hinweg mit einer einheitlichen API-Schnittstelle.

    1.594+8Sterne-Änderung der letzten 7 Tage
  • xllm@xLLM-AI

    Eine hochleistungsfähige Inferenz-Engine für LLM-, VLM-, DiT- und REC-Modelle, optimiert für verschiedene KI-Beschleuniger. Gehostet von der OpenAtom Foundation.

    1.552+11Sterne-Änderung der letzten 7 Tage
  • Eine schnelle und benutzerfreundliche Laufzeitumgebung für Transformer-Inferenz (Bert, Albert, GPT2, Decoders usw.) auf CPU und GPU.

    1.550+1Sterne-Änderung der letzten 7 Tage
  • Nvidia GPU Exporter für Prometheus mit nvidia-smi-Binary oder NVML

    1.550+4Sterne-Änderung der letzten 7 Tage
  • budgetml@ebhy

    Bereitstellung eines ML-Inferenzdienstes mit geringem Budget in weniger als 10 Zeilen Code.

    1.343+0Sterne-Änderung der letzten 7 Tage
  • rtp-llm@alibaba

    RTP-LLM: Alibabas leistungsstarke LLM-Inferenz-Engine für vielfältige Anwendungen.

    1.325+6Sterne-Änderung der letzten 7 Tage
  • EmbedAnything@StarlightSearch

    Leistungsstarke, modulare, speichersichere und produktionsbereite Inferenz, Ingestion und Indizierung, entwickelt in Rust 🦀

    1.305-1Sterne-Änderung der letzten 7 Tage
  • CausalDiscoveryToolbox@FenTechSolutions

    Paket für kausale Inferenz in Graphen und paarweisen Einstellungen. Tools zur Wiederherstellung der Graphenstruktur und für Abhängigkeiten sind enthalten.

    1.237+0Sterne-Änderung der letzten 7 Tage
  • kubetorch@run-house

    KI-Workloads in Python magisch auf Kubernetes verteilen und ausführen, wie PyTorch für ML-Infra.

    1.224+0Sterne-Änderung der letzten 7 Tage
  • kvpress@NVIDIA

    LLM-KV-Cache-Kompprimierung leicht gemacht

    1.201+5Sterne-Änderung der letzten 7 Tage
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Models ist unsere Sammlung hochmoderner Modelle für maschinelles Lernen, die auf Leistung (Latenz, Speicher usw.) optimiert und bereit für die Bereitstellung auf Qualcomm®-Geräten sind.

    1.195+1Sterne-Änderung der letzten 7 Tage
  • mlx-serve@ddalcu

    Nativer LLM-Inferenzserver für Apple Silicon. Kompatibel mit der OpenAI- und Anthropic-API. Kein Python. Inklusive MLX Core macOS-App mit Chat, Agentenmodus und Tool-Aufrufen.

    1.115+245Sterne-Änderung der letzten 7 Tage
  • sglang-omni@sgl-project

    SGLang-Omni ermöglicht hochleistungsfähiges Serving für TTS-, ASR-, Sprach- und Omni-Modelle.

    1.105+130Sterne-Änderung der letzten 7 Tage
  • tiny-vllm@jmaczan

    Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM

    1.094+15Sterne-Änderung der letzten 7 Tage
  • Nanoflow@efeslab

    Ein durchsatzorientiertes Hochleistungs-Serving-Framework für LLMs

    975+1Sterne-Änderung der letzten 7 Tage
  • mlxstudio@jjang-ai

    MLX Studio - Heimat von JANG_Q - Bilderzeugung/bearbeitung + Chat/Code Alles in einem - + OpenClaw (Anthropic API)

    965+4Sterne-Änderung der letzten 7 Tage
  • bolt@huawei-noah

    Bolt ist eine Deep-Learning-Bibliothek mit hoher Leistung und heterogener Flexibilität.

    957+0Sterne-Änderung der letzten 7 Tage
  • ims@OpenIntroStat

    📚 Einführung in die moderne Statistik – Ein Open-Source-Lehrbuch auf Universitätsniveau mit einem modernen Ansatz, der multivariable Beziehungen und simulationsbasierte Inferenz hervorhebt.

    944+0Sterne-Änderung der letzten 7 Tage
  • neuropod@uber

    Eine einheitliche Schnittstelle zum Ausführen von Deep-Learning-Modellen aus mehreren Frameworks

    943+0Sterne-Änderung der letzten 7 Tage
  • model_server@openvinotoolkit

    Skalierbarer Inferenz-Server für mit OpenVINO™ optimierte Modelle.

    925+5Sterne-Änderung der letzten 7 Tage
  • bark.cpp@PABannier

    Das Bark-Modell von Suno AI in C/C++ für eine schnelle Text-to-Speech-Generierung

    867+1Sterne-Änderung der letzten 7 Tage
  • pipeless@pipeless-ai

    Ein Open-Source-Framework für Computer Vision zur schnellen Erstellung und Bereitstellung von Anwendungen.

    851+0Sterne-Änderung der letzten 7 Tage
  • pytriton@triton-inference-server

    PyTriton ist eine Flask/FastAPI-ähnliche Schnittstelle, die die Bereitstellung von Triton in Python-Umgebungen vereinfacht.

    848+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen