跳到主要內容
buildradar
Sign in
主題 · inference

inference

標記 inference 主題、收錄中的開源專案,依星數排序。

共 120 個專案
  • tensorrt-cpp-api@cyrusbehr

    TensorRT C++ API 教學

    811+0近 7 天星數變化
  • cppflow@serizba

    無需安裝且無需 Bazel 即可在 C++ 中執行 TensorFlow 模型

    803+0近 7 天星數變化
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    783近 7 天星數變化
  • filetype.py@h2non

    小巧、無依賴、快速的 Python 套件,透過檢查 Magic Number 簽章來推斷二進位檔案類型

    773+3近 7 天星數變化
  • studio-lab-examples@aws

    用於 SageMaker Studio Lab 的範例筆記本。點擊下方連結註冊帳號!

    772+1近 7 天星數變化
  • APT@rnchg

    AI 生產力工具 - 免費且開源,提升使用者生產力,並保護隱私與資料安全。包含但不限於:內建本機專屬 ChatGPT、DeepSeek、Phi、Qwen 等模型,一鍵批次智慧處理圖片、影片、音訊等。

    768-1近 7 天星數變化
  • SwiftLM@SharpAI

    ⚡ 適用於 Apple Silicon 的原生 MLX Swift LLM 推論伺服器。相容 OpenAI API、支援 100B+ MoE 模型的 SSD 串流、TurboQuant KV 快取壓縮,以及 macOS + iOS iPhone 應用程式。

    760+8近 7 天星數變化
  • InferLLM@MegEngine

    一個輕量級的 LLM 模型推論框架。

    753+0近 7 天星數變化
  • emlearn@emlearn

    適用於微控制器與嵌入式裝置的機器學習推論引擎

    753+5近 7 天星數變化
  • identYwaf@stamparm

    盲打 WAF 識別工具

    748+3近 7 天星數變化
  • yolort@zhiqwang

    yolort 是一個用於 yolov5 的執行時期堆疊,支援 TensorRT、libtorch、onnxruntime、tvm 和 ncnn 等專用加速器。

    730+0近 7 天星數變化
  • ml_privacy_meter@privacytrustlab

    Privacy Meter:一個用於審計統計與機器學習演算法中資料隱私的開源函式庫。

    725+1近 7 天星數變化
  • kglab@DerwenAI

    圖學資料科學(Graph Data Science):用於建構知識圖譜的 Python 抽象層,整合了熱門的圖學函式庫——基於 Pandas、NetworkX、RAPIDS、RDFlib、pySHACL、PyVis、morph-kgc、pslpython、pyarrow 等。

    691+2近 7 天星數變化
  • timber@kossisoroyce

    針對傳統 ML 模型的 Ollama。能將 XGBoost、LightGBM、scikit-learn、CatBoost 與 ONNX 模型轉為原生 C99 推論程式碼的 AOT 編譯器。只需一個指令載入、一個指令提供服務。比 Python 推論快 336 倍。

    687+0近 7 天星數變化
  • TrainYourOwnYOLO@AntonMu

    從頭訓練先進的 yolov3 物件偵測器!

    677+0近 7 天星數變化
  • pegainfer@pegainfer-project

    純 Rust + CUDA LLM 推論引擎 — 無需 PyTorch,相容 OpenAI,支援 Qwen3 至 Kimi-K2 服務

    676+17近 7 天星數變化
  • vidur@microsoft

    精確、大規模且可擴充的 LLM 推理系統模擬器

    673+5近 7 天星數變化
  • libonnx@xboot

    一個輕量、可攜式且支援硬體加速的嵌入式裝置純 C99 onnx 推論引擎。

    652+0近 7 天星數變化
  • waverless@WaveSpeedAI

    高效能無伺服器 GPU 任務編排——wavespeed.ai 背後的排程層。

    632+0近 7 天星數變化
  • Deepdive-llama3-from-scratch@therealoliver

    逐步實現 llama3 推論、掌握核心概念、掌握過程推導、實作程式碼。

    630+0近 7 天星數變化
  • dlstreamer@open-edge-platform

    Deep Learning Streamer (DL Streamer) Pipeline Framework 是一個基於 GStreamer* 多媒體框架的開源串流媒體分析框架,用於在雲端或邊緣建立複雜的媒體分析管線。

    622-1近 7 天星數變化
  • 將 mmdetection 模型轉換為 tensorrt,支援 fp16、int8、批次輸入、動態形狀等。

    596+0近 7 天星數變化
  • inferoa@agentic-in

    Inference-native Tokenmaxxing Agent Harness for Loop Engineering

    561近 7 天星數變化
  • 用於 YOLO 小目標檢測與實例分割的 Python 函式庫

    557+0近 7 天星數變化
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548近 7 天星數變化
  • aikit@kaito-project

    🏗️ 輕鬆微調、建置與部署開源 LLM!

    539+2近 7 天星數變化
  • kubedl@kubedl-io

    在 Kubernetes 上更輕鬆且高效地執行深度學習工作負載。

    532+1近 7 天星數變化
  • model_analyzer@triton-inference-server

    Triton Model Analyzer 是一個 CLI 工具,協助更深入了解 Triton Inference Server 模型的運算與記憶體需求

    526+0近 7 天星數變化
  • nanoowl@NVIDIA-AI-IOT

    A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.

    515+8近 7 天星數變化
  • blindai@mithril-security

    基於安全隔離區(Secure Enclaves)的機密 AI 部署

    512+0近 7 天星數變化
← 返回主題列表