メインコンテンツへスキップ
buildradar
Sign in
トピック · inference

inference

inference がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

120 件のリポジトリ
  • ai-gateway@envoyproxy

    Envoy Gateway上に構築された生成AIサービスへの統合アクセスを管理

    1,990+16直近 7 日のスター増減
  • picolm@RightNow-AI

    256MB RAM を搭載した 10 ドルのボード上で 10 億パラメータの LLM を実行する

    1,927+4直近 7 日のスター増減
  • agibot_x1_infer@AgibotTech

    AgiBot X1 の推論モジュール

    1,835+1直近 7 日のスター増減
  • NNPACK@Maratyszcza

    マルチコア CPU 上のニューラルネットワーク向けアクセラレーションパッケージ

    1,711+1直近 7 日のスター増減
  • 🤗 Hugging Face の transformer モデル向けの高効率、スケーラブル、エンタープライズグレードな CPU/GPU 推論サーバー

    1,690+0直近 7 日のスター増減
  • uzu@trymirai

    AI モデル向けの高性能推論エンジン

    1,687+4直近 7 日のスター増減
  • InferenceX@SemiAnalysisAI

    オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応

    1,613+33直近 7 日のスター増減
  • llmgateway@theopenco

    統一された API インターフェースを使用して、複数プロバイダーの LLM リクエストをルーティング、管理、分析する

    1,594+8直近 7 日のスター増減
  • xllm@xLLM-AI

    多様な AI アクセラレータ向けに最適化された、LLM、VLM、DiT、REC モデル用の高性能推論エンジン。OpenAtom Foundation でホストされています。

    1,552+11直近 7 日のスター増減
  • CPU および GPU 上で動作する、Transformer 推論(Bert、Albert、GPT2、Decoder など)向けの高速で使いやすいランタイム。

    1,550+1直近 7 日のスター増減
  • nvidia-smi バイナリまたは NVML を使用する Prometheus 用 Nvidia GPU エクスポーター

    1,550+4直近 7 日のスター増減
  • budgetml@ebhy

    10行未満のコードで、予算を抑えて ML 推論サービスをデプロイする

    1,343+0直近 7 日のスター増減
  • rtp-llm@alibaba

    RTP-LLM: 多様な用途に向けた Alibaba の高性能 LLM 推論エンジン

    1,325+6直近 7 日のスター増減
  • EmbedAnything@StarlightSearch

    Rust で構築された、高性能、モジュール式、メモリ安全かつ本番環境対応の推論、取り込み、インデックス作成ツール 🦀

    1,305-1直近 7 日のスター増減
  • CausalDiscoveryToolbox@FenTechSolutions

    グラフおよびペアワイズ設定における因果推論パッケージ。グラフ構造の復元や依存関係のためのツールを含む

    1,237+0直近 7 日のスター増減
  • kubetorch@run-house

    機械学習インフラ向け PyTorch のように、Kubernetes 上で AI ワークロードを魔法のように分散および実行します。

    1,224+0直近 7 日のスター増減
  • kvpress@NVIDIA

    LLM KV キャッシュ圧縮を簡単に

    1,201+5直近 7 日のスター増減
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Modelsは、パフォーマンス(レイテンシやメモリなど)が最適化され、Qualcomm®デバイスへのデプロイの準備が整った最先端の機械学習モデルのコレクションです。

    1,195+1直近 7 日のスター増減
  • sglang-omni@sgl-project

    SGLang-Omni は、TTS、ASR、音声、およびオムニモデルの高性能なサービングを実現します。

    1,118+143直近 7 日のスター増減
  • mlx-serve@ddalcu

    Apple Silicon向けのネイティブLLM推論サーバー。OpenAIおよびAnthropic API互換。Python不要。チャット、エージェントモード、ツール呼び出し機能を備えたMLX Core macOSアプリを同梱。

    1,115+245直近 7 日のスター増減
  • tiny-vllm@jmaczan

    C++とCUDAで高性能なLLM推論エンジンを構築する - vLLMの軽量版

    1,094+15直近 7 日のスター増減
  • Nanoflow@efeslab

    スループット指向の LLM 向け高性能サービング フレームワーク

    975+1直近 7 日のスター増減
  • mlxstudio@jjang-ai

    MLX Studio - JANG_Qのホーム - 画像生成/編集 + チャット/コード一体型 - + OpenClaw (Anthropic API)

    964+6直近 7 日のスター増減
  • bolt@huawei-noah

    Bolt は高いパフォーマンスと異種混合の柔軟性を備えたディープラーニングライブラリです。

    957+0直近 7 日のスター増減
  • ims@OpenIntroStat

    📚 現代統計学入門 - 多変量関係とシミュレーションベースの推論を重視した、現代的なアプローチによる大学レベルのオープンソース教科書

    944+1直近 7 日のスター増減
  • neuropod@uber

    複数のフレームワークからディープラーニングモデルを実行するための統一インターフェース

    943+0直近 7 日のスター増減
  • model_server@openvinotoolkit

    OpenVINO™ で最適化されたモデル向けの拡張可能な推論サーバー

    927+5直近 7 日のスター増減
  • bark.cpp@PABannier

    高速なテキスト読み上げ生成を実現する、C/C++版の Suno AI Bark モデル

    867+1直近 7 日のスター増減
  • pipeless@pipeless-ai

    数分でアプリを構築・デプロイできるオープンソースのコンピュータビジョンフレームワーク

    851-1直近 7 日のスター増減
  • pytriton@triton-inference-server

    PyTritonは、Python環境でのTritonのデプロイをシンプルにするFlask/FastAPIライクなインターフェースです。

    848+0直近 7 日のスター増減
← トピック一覧に戻る