跳到主要内容
buildradar
Sign in
主题 · inference

inference

标记 inference 主题、收录中的开源项目,按星标数排序。

项目数
117
总星标数
769,346
平均星标数
6,576
占比
0.04%

常跟 inference 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 inference 主题的项目。

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10,286
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    513
  • vllm@vllm-project

    高吞吐量且内存效率高的 LLM 推理与服务引擎

    90,415+745近 7 天星标变化
  • yolov5@ultralytics

    Ultralytics YOLOv5(基于 PyTorch)用于目标检测、实例分割、分类、训练与导出

    57,939+20近 7 天星标变化
  • whisper.cpp@ggml-org

    OpenAI Whisper 模型的 C/C++ 移植版

    53,286+193近 7 天星标变化
  • DeepSpeed@deepspeedai

    DeepSpeed 是一个深度学习优化库,使分布式训练与推理变得简单、高效且有效

    43,019+44近 7 天星标变化
  • ColossalAI@hpcaitech

    让大型 AI 模型更便宜、更快速且更易获取

    41,446+8近 7 天星标变化
  • mediapipe@google-ai-edge

    跨平台、可定制的机器学习解决方案,适用于实时与流媒体

    36,769+83近 7 天星标变化
  • sglang@sgl-project

    SGLang 是针对大型语言模型与多模态模型的高性能服务框架

    32,747+503近 7 天星标变化
  • faster-whisper@SYSTRAN

    使用 CTranslate2 的 Faster Whisper 转录

    25,135+108近 7 天星标变化
  • ncnn@Tencent

    ncnn:针对移动平台优化的高性能神经网络推理框架。

    23,763+34近 7 天星标变化
  • ml-engineering@stas00

    机器学习工程开放手册

    18,835+152近 7 天星标变化
  • nano-vllm@GeeeekExplorer

    Nano vLLM

    15,218+137近 7 天星标变化
  • ts-pattern@gvergnaud

    🎨 为 TypeScript 提供完整模式匹配功能的库,具备智能类型推断

    15,141+10近 7 天星标变化
  • TensorRT@NVIDIA

    NVIDIA® TensorRT™ 是一套在 NVIDIA GPU 上进行高效深度学习推理的 SDK。本仓库包含 TensorRT 的开源组件。

    13,305+32近 7 天星标变化
  • LMCache@LMCache

    LMCache:以最快的 KV 缓存层为 LLM 提供加速

    11,562+256近 7 天星标变化
  • amazon-sagemaker-examples@aws

    示范如何使用 Amazon SageMaker 构建、训练与部署机器学习模型的 Jupyter Notebook 示例 📓 🧠

    10,981+2近 7 天星标变化
  • server@triton-inference-server

    Triton 推理服务器提供优化的云端与边缘推理解决方案。

    10,949+18近 7 天星标变化
  • openvino@openvinotoolkit

    OpenVINO™:用于优化与部署 AI 推理的开源工具套件

    10,763+72近 7 天星标变化
  • yolov3@ultralytics

    PyTorch 版 YOLOv3、YOLOv3-SPP 与 YOLOv3-tiny 的实时目标检测实现,支持训练、验证、推理与多格式导出

    10,599+4近 7 天星标变化
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10,286近 7 天星标变化
  • runanywhere-sdks@RunanywhereAI

    可在本机运行 AI 的生产就绪工具包

    10,280-12近 7 天星标变化
  • inference@xorbitsai

    只需更改一行代码,即可将 GPT 替换为任意 LLM。Xinference 让你在云端、本地或笔记本上运行开源、语音和多模态模型,统一的生产级推理 API

    9,528+21近 7 天星标变化
  • oumi@oumi-ai

    轻松微调、评估与部署 Qwen、Gemma 或任何开放权重的 LLM!

    9,380+3近 7 天星标变化
  • Hello AI World:部署深度学习推理网络与深度视觉原语的指南,使用 TensorRT 与 NVIDIA Jetson

    8,974+6近 7 天星标变化
  • io-ts@gcanti

    用于 IO 解码/编码的运行时类型系统。

    6,809+1近 7 天星标变化
  • vllm-omni@vllm-project

    高效模型推理框架,支持全模态模型

    6,457+229近 7 天星标变化
  • Mooncake@kvcache-ai

    Mooncake 是 Moonshot AI 提供的领先 LLM 服务 Kimi 的服务平台

    6,430+90近 7 天星标变化
  • argmax-oss-swift@argmaxinc

    Apple Silicon 上的本机语音 AI

    6,345+11近 7 天星标变化
  • Adversarial Robustness Toolbox (ART) - 用于机器学习安全的 Python 库,支持规避、投毒、模型提取与推理,适合红蓝队使用

    6,210+20近 7 天星标变化
  • gpustack@gpustack

    一个 GPU 集群管理器,用于高效能 AI 模型服务(vLLM、SGLang)以及按需可 SSH 访问的 GPU 实例。

    5,572+37近 7 天星标变化
  • semantic-router@vllm-project

    一个可编程的混合模型路由器,用于异质 LLM 推理。

    5,405+190近 7 天星标变化
← 返回主题列表