llm-serving
llm-serving がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
llm-serving と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、llm-serving がタグ付けされたリポジトリ。
- #1
Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.
★ 146
- #1★ 90,817+402直近 7 日のスター増減
- #2★ 43,688+41直近 7 日のスター増減
- #3
本プロジェクトは、大規模モデル関連の技術原理および実戦経験(大規模モデルのエンジニアリング、大規模モデルのアプリケーション実装)を共有することを目的としています。
★ 24,995+21直近 7 日のスター増減 - #4
TensorRT LLMは、ユーザーがLarge Language Models (LLMs) を定義するための使いやすいPython APIを提供し、NVIDIA GPU上で推論を効率的に実行するための最先端の最適化をサポートします。TensorRT LLMには、推論実行を高性能にオーケストレーションするためのPythonおよびC++ランタイムを作成するコンポーネントも含まれています。
★ 14,536+38直近 7 日のスター増減 - #5★ 12,524+1直近 7 日のスター増減
- #6
最先端チームのためのAIコンピューティングプラットフォーム。SkyPilotは断片化されたAIコンピューティングを単一のAIスーパーコンピューターに変換し、最先端のAIチームがカスタムインテリジェンスをより速く構築できるようにします。
★ 10,550+16直近 7 日のスター増減 - #7★ 8,817+4直近 7 日のスター増減
- #8★ 5,593+21直近 7 日のスター増減
- #9
Superduper: カスタムAIアプリケーションおよびエージェントを構築するためのエンドツーエンドフレームワーク。
★ 5,318+1直近 7 日のスター増減 - #10★ 3,827+1直近 7 日のスター増減
- #11
PaddlePaddleベースのLLMおよびVLM向け高性能推論・デプロイメントツールキット
★ 3,714+3直近 7 日のスター増減 - #12★ 2,997-1直近 7 日のスター増減
- #13
Ascend 上の vLLM 向けコミュニティ維持ハードウェアプラグイン
★ 2,749+19直近 7 日のスター増減 - #14★ 2,174+1直近 7 日のスター増減
- #15★ 2,076+0直近 7 日のスター増減
- #16
オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応
★ 1,613+33直近 7 日のスター増減 - #17★ 1,372+4直近 7 日のスター増減
- #18★ 1,325+6直近 7 日のスター増減
- #19★ 1,275+130直近 7 日のスター増減
- #20★ 975+1直近 7 日のスター増減
- #21★ 908+0直近 7 日のスター増減
- #22★ 902+0直近 7 日のスター増減
- #23
♾️ スペックコーディングを備えたプライベートエージェントフリート。各エージェントは専用の GPU アクセラレーション付きデスクトップを取得します。完全なプライベート AI スタック上で Claude、Codex、Gemini およびオープンモデルを実行 ♾️
★ 805+2直近 7 日のスター増減 - #24★ 677+18直近 7 日のスター増減
- #25
LLM(大規模言語モデル)のファインチューニング
★ 579+1直近 7 日のスター増減