メインコンテンツへスキップ
buildradar
Sign in
トピック · llm-serving

llm-serving

llm-serving がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
25
総スター数
244,794
平均スター数
9,792
シェア
0.01%

llm-serving と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、llm-serving がタグ付けされたリポジトリ。

  • kaggle-tpu-lab@ARahim3

    Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.

    146
  • vllm@vllm-project

    LLM向けの、高スループットかつメモリ効率の高い推論・サービングエンジン

    90,817+402直近 7 日のスター増減
  • ray@ray-project

    RayはAIコンピューティングエンジンです。Rayは、コアとなる分散ランタイムと、MLワークロードを高速化するためのAIライブラリ群で構成されています。

    43,688+41直近 7 日のスター増減
  • llm-action@liguodongiot

    本プロジェクトは、大規模モデル関連の技術原理および実戦経験(大規模モデルのエンジニアリング、大規模モデルのアプリケーション実装)を共有することを目的としています。

    24,995+21直近 7 日のスター増減
  • TensorRT-LLM@NVIDIA

    TensorRT LLMは、ユーザーがLarge Language Models (LLMs) を定義するための使いやすいPython APIを提供し、NVIDIA GPU上で推論を効率的に実行するための最先端の最適化をサポートします。TensorRT LLMには、推論実行を高性能にオーケストレーションするためのPythonおよびC++ランタイムを作成するコンポーネントも含まれています。

    14,536+38直近 7 日のスター増減
  • OpenLLM@bentoml

    DeepSeekやLlamaなどのオープンソースLLMを、クラウド上でOpenAI互換のAPIエンドポイントとして実行できます。

    12,524+1直近 7 日のスター増減
  • skypilot@skypilot-org

    最先端チームのためのAIコンピューティングプラットフォーム。SkyPilotは断片化されたAIコンピューティングを単一のAIスーパーコンピューターに変換し、最先端のAIチームがカスタムインテリジェンスをより速く構築できるようにします。

    10,550+16直近 7 日のスター増減
  • BentoML@bentoml

    AIアプリやモデルを配信する最も簡単な方法 - モデル推論API、ジョブキュー、LLMアプリ、マルチモデルパイプラインなどを構築!

    8,817+4直近 7 日のスター増減
  • gpustack@gpustack

    高性能なAIモデルサービング(vLLM, SGLang)およびオンデマンドのSSHアクセス可能なGPUインスタンスのためのGPUクラスターマネージャー。

    5,593+21直近 7 日のスター増減
  • superduper@superduper-io

    Superduper: カスタムAIアプリケーションおよびエージェントを構築するためのエンドツーエンドフレームワーク。

    5,318+1直近 7 日のスター増減
  • lorax@predibase

    数千のファインチューニングされたLLMに対応するマルチLoRA推論サーバー。

    3,827+1直近 7 日のスター増減
  • FastDeploy@PaddlePaddle

    PaddlePaddleベースのLLMおよびVLM向け高性能推論・デプロイメントツールキット

    3,714+3直近 7 日のスター増減
  • chitu@thu-pacman

    効率性、柔軟性、可用性に焦点を当てた、大規模言語モデル向けの高性能推論フレームワーク。

    2,997-1直近 7 日のスター増減
  • vllm-ascend@vllm-project

    Ascend 上の vLLM 向けコミュニティ維持ハードウェアプラグイン

    2,749+19直近 7 日のスター増減
  • MoBA@MoonshotAI

    MoBA: 長コンテキストLLMのためのMixture of Block Attention

    2,174+1直近 7 日のスター増減
  • aici@microsoft

    AICI: プロンプトとしての(Wasm)プログラム

    2,076+0直近 7 日のスター増減
  • InferenceX@SemiAnalysisAI

    オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応

    1,613+33直近 7 日のスター増減
  • parallax@GradientHQ

    Parallaxは、どこでも独自のAIクラスターを構築できる分散モデルサービングフレームワークです

    1,372+4直近 7 日のスター増減
  • rtp-llm@alibaba

    RTP-LLM: 多様な用途に向けた Alibaba の高性能 LLM 推論エンジン

    1,325+6直近 7 日のスター増減
  • kvcached@ovg-project

    動的な GPU 共有などのための仮想化 Elastic KV キャッシュ

    1,275+130直近 7 日のスター増減
  • Nanoflow@efeslab

    スループット指向の LLM 向け高性能サービング フレームワーク

    975+1直近 7 日のスター増減
  • ZhiLight@zhihu

    Llamaとその派生モデル向けの高最適化されたLLM推論加速エンジン。

    908+0直近 7 日のスター増減
  • mosec@mosecorg

    動的バッチ処理と CPU/GPU パイプラインを提供し、計算マシンの性能を最大限に引き出す高性能な ML モデルサービングフレームワーク

    902+0直近 7 日のスター増減
  • helix@helixml

    ♾️ スペックコーディングを備えたプライベートエージェントフリート。各エージェントは専用の GPU アクセラレーション付きデスクトップを取得します。完全なプライベート AI スタック上で Claude、Codex、Gemini およびオープンモデルを実行 ♾️

    805+2直近 7 日のスター増減
  • pegainfer@pegainfer-project

    純粋なRust + CUDAによるLLM推論エンジン — PyTorchなし、OpenAI互換、Qwen3からKimi-K2まで提供

    677+18直近 7 日のスター増減
  • LLM-FineTuning-Large-Language-Models@rohan-paul

    LLM(大規模言語モデル)のファインチューニング

    579+1直近 7 日のスター増減
← トピック一覧に戻る