inference
inference がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #61
Envoy Gateway上に構築された生成AIサービスへの統合アクセスを管理
★ 1,990+16直近 7 日のスター増減 - #62★ 1,927+4直近 7 日のスター増減
- #63
AgiBot X1 の推論モジュール
★ 1,835+1直近 7 日のスター増減 - #64★ 1,711+1直近 7 日のスター増減
- #65
🤗 Hugging Face の transformer モデル向けの高効率、スケーラブル、エンタープライズグレードな CPU/GPU 推論サーバー
★ 1,690+0直近 7 日のスター増減 - #66★ 1,687+4直近 7 日のスター増減
- #67
オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応
★ 1,613+33直近 7 日のスター増減 - #68
統一された API インターフェースを使用して、複数プロバイダーの LLM リクエストをルーティング、管理、分析する
★ 1,594+8直近 7 日のスター増減 - #69★ 1,552+11直近 7 日のスター増減
- #70
CPU および GPU 上で動作する、Transformer 推論(Bert、Albert、GPT2、Decoder など)向けの高速で使いやすいランタイム。
★ 1,550+1直近 7 日のスター増減 - #71
nvidia-smi バイナリまたは NVML を使用する Prometheus 用 Nvidia GPU エクスポーター
★ 1,550+4直近 7 日のスター増減 - #72★ 1,343+0直近 7 日のスター増減
- #73★ 1,325+6直近 7 日のスター増減
- #74
Rust で構築された、高性能、モジュール式、メモリ安全かつ本番環境対応の推論、取り込み、インデックス作成ツール 🦀
★ 1,305-1直近 7 日のスター増減 - #75
グラフおよびペアワイズ設定における因果推論パッケージ。グラフ構造の復元や依存関係のためのツールを含む
★ 1,237+0直近 7 日のスター増減 - #76★ 1,224+0直近 7 日のスター増減
- #77★ 1,201+5直近 7 日のスター増減
- #78
Qualcomm® AI Hub Modelsは、パフォーマンス(レイテンシやメモリなど)が最適化され、Qualcomm®デバイスへのデプロイの準備が整った最先端の機械学習モデルのコレクションです。
★ 1,195+1直近 7 日のスター増減 - #79
SGLang-Omni は、TTS、ASR、音声、およびオムニモデルの高性能なサービングを実現します。
★ 1,118+143直近 7 日のスター増減 - #80
Apple Silicon向けのネイティブLLM推論サーバー。OpenAIおよびAnthropic API互換。Python不要。チャット、エージェントモード、ツール呼び出し機能を備えたMLX Core macOSアプリを同梱。
★ 1,115+245直近 7 日のスター増減 - #81★ 1,094+15直近 7 日のスター増減
- #82★ 975+1直近 7 日のスター増減
- #83★ 964+6直近 7 日のスター増減
- #84★ 957+0直近 7 日のスター増減
- #85★ 944+1直近 7 日のスター増減
- #86★ 943+0直近 7 日のスター増減
- #87
OpenVINO™ で最適化されたモデル向けの拡張可能な推論サーバー
★ 927+5直近 7 日のスター増減 - #88★ 867+1直近 7 日のスター増減
- #89★ 851-1直近 7 日のスター増減
- #90
PyTritonは、Python環境でのTritonのデプロイをシンプルにするFlask/FastAPIライクなインターフェースです。
★ 848+0直近 7 日のスター増減