メインコンテンツへスキップ
buildradar
Sign in
トピック · inference

inference

inference がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
117
総スター数
769,346
平均スター数
6,576
シェア
0.04%

inference と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、inference がタグ付けされたリポジトリ。

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10,552
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    513
  • vllm@vllm-project

    LLM向けの、高スループットかつメモリ効率の高い推論・サービングエンジン

    90,415+745直近 7 日のスター増減
  • yolov5@ultralytics

    オブジェクト検出、インスタンスセグメンテーション、分類、トレーニング、エクスポートのためのPyTorchにおけるUltralytics YOLOv5。

    57,939+20直近 7 日のスター増減
  • whisper.cpp@ggml-org

    OpenAIのWhisperモデルのC/C++ポート

    53,286+193直近 7 日のスター増減
  • DeepSpeed@deepspeedai

    DeepSpeedは、分散学習と推論を容易に、効率的かつ効果的に行うための深層学習最適化ライブラリです。

    43,019+44直近 7 日のスター増減
  • ColossalAI@hpcaitech

    大規模AIモデルをより安価に、より高速に、よりアクセスしやすくする

    41,446+8直近 7 日のスター増減
  • mediapipe@google-ai-edge

    ライブおよびストリーミングメディア向けのクロスプラットフォーム対応のカスタマイズ可能なMLソリューション。

    36,769+83直近 7 日のスター増減
  • sglang@sgl-project

    SGLangは、大規模言語モデルおよびマルチモーダルモデル向けの高性能サービングフレームワークです。

    32,747+503直近 7 日のスター増減
  • faster-whisper@SYSTRAN

    CTranslate2による高速なWhisper文字起こし

    25,135+108直近 7 日のスター増減
  • ncnn@Tencent

    ncnnは、モバイルプラットフォーム向けに最適化された高性能なニューラルネットワーク推論フレームワークです

    23,763+34直近 7 日のスター増減
  • ml-engineering@stas00

    機械学習エンジニアリング オープンブック

    18,835+152直近 7 日のスター増減
  • nano-vllm@GeeeekExplorer

    Nano vLLM

    15,218+137直近 7 日のスター増減
  • ts-pattern@gvergnaud

    🎨 スマートな型推論を備えた、TypeScriptのための網羅的なパターンマッチングライブラリ

    15,141+10直近 7 日のスター増減
  • TensorRT@NVIDIA

    NVIDIA® TensorRT™は、NVIDIA GPU上での高性能な深層学習推論のためのSDKです。このリポジトリにはTensorRTのオープンソースコンポーネントが含まれています。

    13,305+32直近 7 日のスター増減
  • LMCache@LMCache

    LMCache: 最速のKVキャッシュレイヤーでLLMを強化

    11,562+256直近 7 日のスター増減
  • amazon-sagemaker-examples@aws

    例 📓 Amazon SageMaker を使用して機械学習モデルを構築、トレーニング、デプロイする方法を示す Jupyter ノートブック。

    10,981+2直近 7 日のスター増減
  • server@triton-inference-server

    Triton Inference Serverは、最適化されたクラウドおよびエッジ推論ソリューションを提供します。

    10,949+18直近 7 日のスター増減
  • openvino@openvinotoolkit

    OpenVINO™は、AI推論の最適化とデプロイのためのオープンソースツールキットです。

    10,763+72直近 7 日のスター増減
  • yolov3@ultralytics

    PyTorchによるYOLOv3、YOLOv3-SPP、およびYOLOv3-tinyの実装。トレーニング、検証、推論、マルチフォーマットエクスポートを備えたリアルタイム物体検出用。

    10,599+4直近 7 日のスター増減
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10,552直近 7 日のスター増減
  • runanywhere-sdks@RunanywhereAI

    ローカルでAIを実行するための本番環境対応ツールキット

    10,280-12直近 7 日のスター増減
  • inference@xorbitsai

    単一のコード行を変更するだけで、GPTを任意のLLMに置き換え可能。Xinferenceを使用すると、オープンソース、音声、マルチモーダルモデルをクラウド、オンプレミス、またはラップトップ上で実行できます。すべて統一された本番環境対応の推論APIを介して。

    9,528+21直近 7 日のスター増減
  • oumi@oumi-ai

    Qwen、Gemma、または任意のオープンウェイトLLMを簡単にファインチューニング、評価、デプロイ可能!

    9,380+3直近 7 日のスター増減
  • TensorRTとNVIDIA Jetsonを使用した深層学習推論ネットワークおよび深視覚プリミティブのデプロイガイド

    8,974+6直近 7 日のスター増減
  • io-ts@gcanti

    IOデコード/エンコードのためのランタイム型システム

    6,809+1直近 7 日のスター増減
  • vllm-omni@vllm-project

    マルチモーダルモデルを用いた効率的なモデル推論のためのフレームワーク。

    6,457+229直近 7 日のスター増減
  • Mooncake@kvcache-ai

    Mooncakeは、Moonshot AIが提供する主要なLLMサービスKimiの提供プラットフォームです。

    6,430+90直近 7 日のスター増減
  • argmax-oss-swift@argmaxinc

    Apple Silicon向けオンデバイス音声AI

    6,345+11直近 7 日のスター増減
  • Adversarial Robustness Toolbox (ART) - 機械学習セキュリティのためのPythonライブラリ - 敵対的攻撃(Evasion, Poisoning, Extraction, Inference) - レッドチームとブルーチーム

    6,210+20直近 7 日のスター増減
  • gpustack@gpustack

    高性能なAIモデルサービング(vLLM, SGLang)およびオンデマンドのSSHアクセス可能なGPUインスタンスのためのGPUクラスターマネージャー。

    5,572+37直近 7 日のスター増減
  • semantic-router@vllm-project

    異種LLM推論のためのプログラマブルなMixture-of-Modelsルーター

    5,405+190直近 7 日のスター増減
← トピック一覧に戻る