Zum Hauptinhalt springen
buildradar
Sign in
Thema · inference

inference

Erfasste Open-Source-Repos mit dem Tag inference, sortiert nach Sternen.

Repos
117
Sterne gesamt
769.346
Sterne im Schnitt
6.576
Anteil
0,04%

Themen, die häufig gemeinsam mit inference am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit inference getaggt wurden.

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10.387
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    513
  • vllm@vllm-project

    Ein hocheffizientes und speichereffizientes Inferenz- und Serving-Engine für LLMs

    90.415+745Sterne-Änderung der letzten 7 Tage
  • yolov5@ultralytics

    Ultralytics YOLOv5 in PyTorch für Objekterkennung, Instanzsegmentierung, Klassifizierung, Training und Export.

    57.939+20Sterne-Änderung der letzten 7 Tage
  • whisper.cpp@ggml-org

    Port des Whisper-Modells von OpenAI in C/C++

    53.286+193Sterne-Änderung der letzten 7 Tage
  • DeepSpeed@deepspeedai

    DeepSpeed ist eine Deep-Learning-Optimierungsbibliothek, die verteilte Training und Inferenz einfach, effizient und effektiv macht.

    43.019+44Sterne-Änderung der letzten 7 Tage
  • ColossalAI@hpcaitech

    Große AI-Modelle günstiger, schneller und zugänglicher machen

    41.446+8Sterne-Änderung der letzten 7 Tage
  • mediapipe@google-ai-edge

    Plattformunabhängige, anpassbare ML-Lösungen für Live- und Streaming-Media.

    36.769+83Sterne-Änderung der letzten 7 Tage
  • sglang@sgl-project

    SGLang ist ein hochleistungsfähiges Serving‑Framework für große Sprach‑ und multimodale Modelle.

    32.747+503Sterne-Änderung der letzten 7 Tage
  • faster-whisper@SYSTRAN

    Schnellere Whisper-Transkription mit CTranslate2

    25.135+108Sterne-Änderung der letzten 7 Tage
  • ncnn@Tencent

    ncnn ist ein für mobile Plattformen optimiertes, leistungsstarkes Inferenz-Framework für neuronale Netze

    23.763+34Sterne-Änderung der letzten 7 Tage
  • ml-engineering@stas00

    Machine Learning Engineering Open Book

    18.835+152Sterne-Änderung der letzten 7 Tage
  • nano-vllm@GeeeekExplorer

    Nano vLLM

    15.218+137Sterne-Änderung der letzten 7 Tage
  • ts-pattern@gvergnaud

    🎨 Die umfassende Pattern-Matching-Bibliothek für TypeScript mit intelligenter Typinferenz.

    15.141+10Sterne-Änderung der letzten 7 Tage
  • TensorRT@NVIDIA

    NVIDIA® TensorRT™ ist ein SDK für die Hochleistungs-Inferenz von Deep Learning auf NVIDIA-GPUs. Dieses Repository enthält die Open-Source-Komponenten von TensorRT.

    13.305+32Sterne-Änderung der letzten 7 Tage
  • LMCache@LMCache

    LMCache: Beschleunigen Sie Ihr LLM mit der schnellsten KV-Cache-Schicht

    11.562+256Sterne-Änderung der letzten 7 Tage
  • amazon-sagemaker-examples@aws

    Beispiel-Jupyter-Notebooks zur Demonstration des Erstellens, Trainierens und Deployens von Machine-Learning-Modellen mit Amazon SageMaker.

    10.981+2Sterne-Änderung der letzten 7 Tage
  • server@triton-inference-server

    Der Triton Inference Server bietet eine optimierte Inferenzlösung für Cloud und Edge.

    10.949+18Sterne-Änderung der letzten 7 Tage
  • openvino@openvinotoolkit

    OpenVINO™ ist ein Open-Source-Toolkit zur Optimierung und Bereitstellung von KI-Inferenz

    10.763+72Sterne-Änderung der letzten 7 Tage
  • yolov3@ultralytics

    PyTorch-Implementierung von YOLOv3, YOLOv3-SPP und YOLOv3-tiny für die Echtzeit-Objekterkennung mit Training, Validierung, Inferenz und Multiformat-Export.

    10.599+4Sterne-Änderung der letzten 7 Tage
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10.387Sterne-Änderung der letzten 7 Tage
  • runanywhere-sdks@RunanywhereAI

    Produktionsbereites Toolkit zum lokalen Ausführen von KI

    10.280-12Sterne-Änderung der letzten 7 Tage
  • inference@xorbitsai

    Ersetzen Sie GPT durch ein beliebiges LLM, indem Sie nur eine einzige Codezeile ändern. Mit Xinference können Sie Open-Source-, Sprach- und multimodale Modelle in der Cloud, on-premise oder auf Ihrem Laptop ausführen – alles über eine einheitliche, produktionsbereite Inferenz-API.

    9.528+21Sterne-Änderung der letzten 7 Tage
  • oumi@oumi-ai

    Einfaches Fine-Tuning, Evaluierung und Deployment von Qwen, Gemma oder anderen Open-Weight-LLMs!

    9.380+3Sterne-Änderung der letzten 7 Tage
  • Hello AI World: Leitfaden zur Bereitstellung von Deep-Learning-Inferenznetzwerken und Deep-Vision-Primitiven mit TensorRT und NVIDIA Jetson.

    8.974+6Sterne-Änderung der letzten 7 Tage
  • io-ts@gcanti

    Laufzeit-Typsystem für IO-Dekodierung und -Kodierung

    6.809+1Sterne-Änderung der letzten 7 Tage
  • vllm-omni@vllm-project

    Ein Framework für effiziente Modellinferenz mit Omnimodalitätsmodellen

    6.457+229Sterne-Änderung der letzten 7 Tage
  • Mooncake@kvcache-ai

    Mooncake ist die Serving-Plattform für Kimi, einen führenden LLM-Dienst von Moonshot AI.

    6.430+90Sterne-Änderung der letzten 7 Tage
  • argmax-oss-swift@argmaxinc

    On-Device-Sprach-KI für Apple Silicon

    6.345+11Sterne-Änderung der letzten 7 Tage
  • Adversarial Robustness Toolbox (ART) – Python-Bibliothek für Machine-Learning-Sicherheit – Evasion, Poisoning, Extraction, Inference – Red und Blue Teams

    6.210+20Sterne-Änderung der letzten 7 Tage
  • gpustack@gpustack

    Ein GPU-Cluster-Manager für hochleistungsfähiges KI-Modell-Serving (vLLM, SGLang) und bedarfsgesteuerte GPU-Instanzen mit SSH-Zugang.

    5.572+37Sterne-Änderung der letzten 7 Tage
  • semantic-router@vllm-project

    Ein programmierbarer Mixture-of-Models-Router für heterogene LLM-Inferenz

    5.405+190Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen