メインコンテンツへスキップ
buildradar
Sign in
トピック · model-serving

model-serving

model-serving がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
29
総スター数
164,226
平均スター数
5,663
シェア
0.01%

model-serving と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、model-serving がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • vllm@vllm-project

    LLM向けの、高スループットかつメモリ効率の高い推論・サービングエンジン

    90,415+745直近 7 日のスター増減
  • BentoML@bentoml

    AIアプリやモデルを配信する最も簡単な方法 - モデル推論API、ジョブキュー、LLMアプリ、マルチモデルパイプラインなどを構築!

    8,813+18直近 7 日のスター増減
  • vllm-omni@vllm-project

    マルチモーダルモデルを用いた効率的なモデル推論のためのフレームワーク。

    6,457+229直近 7 日のスター増減
  • kserve@kserve

    Kubernetes上でのスケーラブルなマルチフレームワーク展開に対応した標準化された分散型生成AIおよび予測AI推論プラットフォーム

    5,840+25直近 7 日のスター増減
  • Olares@beclab

    常時稼働エージェントのためのオープンソースのパーソナルクラウドOS。

    5,243+10直近 7 日のスター増減
  • このリポジトリでは、深層学習ベースのモデルを本番環境にデプロイする際の役立つノートやリファレンスを共有します。

    4,376+1直近 7 日のスター増減
  • 🚀 機械学習のための素晴らしいシステム ⚡️ AIシステム論文と業界の実践。 ⚡️ 機械学習、LLM (Large Language Model)、GenAI (Generative AI) 用のシステム。 🍻 OSDI、NSDI、SIGCOMM、SoCC、MLSysなど。 🗃️ Llama3、Mistralなど。 🧑‍💻 ビデオチュートリアル。

    4,318+27直近 7 日のスター増減
  • LightLLM@ModelTC

    LightLLMは、軽量な設計、容易なスケーラビリティ、高速なパフォーマンスが特徴のPythonベースのLLM(大規模言語モデル)推論およびサービングフレームワークです。

    4,251+21直近 7 日のスター増減
  • FedML@FedML-AI

    FEDML - 大規模分散学習、モデルサービング、フェデレーテッドラーニングのための統一的でスケーラブルなMLライブラリ。クロスクラウドスケジューラであるFEDML Launchにより、あらゆるAIジョブをあらゆるGPUクラウドまたはオンプレミスクラスターで実行可能になります。このライブラリを基盤として、TensorOpera AI (https://TensorOpera.ai) はスケーラブルな生成AIプラットフォームを提供します。

    4,061-1直近 7 日のスター増減
  • lorax@predibase

    数千のファインチューニングされたLLMに対応するマルチLoRA推論サーバー。

    3,826-2直近 7 日のスター増減
  • chitu@thu-pacman

    効率性、柔軟性、可用性に焦点を当てた、大規模言語モデル向けの高性能推論フレームワーク。

    2,998+5直近 7 日のスター増減
  • vllm-ascend@vllm-project

    Ascend 上の vLLM 向けコミュニティ維持ハードウェアプラグイン

    2,730+53直近 7 日のスター増減
  • openlake@openlake-project

    OpenLake は、効率的な LLM 推論と GPU トレーニングを実現する高性能ストレージエンジンです

    2,346+9直近 7 日のスター増減
  • envd@tensorchord

    🏕️ 人間とエージェントのための再現可能な開発環境

    2,227+3直近 7 日のスター増減
  • aici@microsoft

    AICI: プロンプトとしての(Wasm)プログラム

    2,076+0直近 7 日のスター増減
  • mlrun@mlrun

    MLRunは、ライフサイクル全体を通じて継続的なMLアプリケーションを迅速に構築・管理するためのオープンソースのMLOpsプラットフォームです。開発およびCI/CD環境に統合され、本番データ、MLパイプライン、オンラインアプリケーションの配信を自動化します。

    1,694+0直近 7 日のスター増減
  • kitops@kitops-ml

    AI/ML モデル、データセット、コード、設定を OCI Artifact にパッケージングおよびバージョン管理するための CNCF 製オープンソース DevOps ツール

    1,409+5直近 7 日のスター増減
  • rtp-llm@alibaba

    RTP-LLM: 多様な用途に向けた Alibaba の高性能 LLM 推論エンジン

    1,320+6直近 7 日のスター増減
  • hopsworks@logicalclocks

    Hopsworks - Feature Store を備えたデータ密集型 AI プラットフォーム

    1,303+1直近 7 日のスター増減
  • truss@basetenlabs

    AI/ML モデルを本番環境で運用する最も簡単な方法

    1,196+1直近 7 日のスター増減
  • sglang-omni@sgl-project

    SGLang-Omni は、TTS、ASR、音声、およびオムニモデルの高性能なサービングを実現します。

    978+70直近 7 日のスター増減
  • Nanoflow@efeslab

    スループット指向の LLM 向け高性能サービング フレームワーク

    974+0直近 7 日のスター増減
  • model_server@openvinotoolkit

    OpenVINO™ で最適化されたモデル向けの拡張可能な推論サーバー

    921+3直近 7 日のスター増減
  • ZhiLight@zhihu

    Llamaとその派生モデル向けの高最適化されたLLM推論加速エンジン。

    908+0直近 7 日のスター増減
  • mosec@mosecorg

    動的バッチ処理と CPU/GPU パイプラインを提供し、計算マシンの性能を最大限に引き出す高性能な ML モデルサービングフレームワーク

    902+0直近 7 日のスター増減
  • ServerlessLLM@ServerlessLLM

    すべての人に向けたサーバーレス LLM サービング

    711+6直近 7 日のスター増減
  • timber@kossisoroyce

    古典的な ML モデル向けの Ollama。XGBoost、LightGBM、scikit-learn、CatBoost、ONNX モデルをネイティブの C99 推論コードに変換する AOT コンパイラ。1 つのコマンドでロードし、1 つのコマンドでサーブする。Python 推論より 336 倍高速。

    687-1直近 7 日のスター増減
  • pegainfer@pegainfer-project

    純粋なRust + CUDAによるLLM推論エンジン — PyTorchなし、OpenAI互換、Qwen3からKimi-K2まで提供

    660+4直近 7 日のスター増減
  • fastapi-ml-skeleton@eightBEC

    機械学習モデルを本番環境で提供するためのFastAPIスケルトンアプリ

    603-1直近 7 日のスター増減
← トピック一覧に戻る