メインコンテンツへスキップ
buildradar
Sign in
トピック · inference-engine

inference-engine

inference-engine がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
24
総スター数
49,667
平均スター数
2,069
シェア
0.00%

inference-engine と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、inference-engine がタグ付けされたリポジトリ。

  • kimi-k3-in-c@FareedKhan-dev

    2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。

    7,164
  • mlx-dspark@ARahim3

    Apple Silicon で最大 4 倍高速なロスレス LLM デコード。DeepSeek の DSpark および z-lab の DFlash スペキュラティブデコードのネイティブ MLX ポート — Gemma-4、Qwen3.8、Muse-Glimmer、Nemotron、Ornith-1.0、三値 Bonsai-27B。

    640
  • ✍🏻 ソースコード深掘り、システム設計&エンジニアリングブログ | Halfrost-Field 氷霜之地:ソースコード解析、システム設計とエンジニアリング実践ノート

    13,226+6直近 7 日のスター増減
  • kimi-k3-in-c@FareedKhan-dev

    2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。

    7,164+442直近 7 日のスター増減
  • FedML@FedML-AI

    FEDML - 大規模分散学習、モデルサービング、フェデレーテッドラーニングのための統一的でスケーラブルなMLライブラリ。クロスクラウドスケジューラであるFEDML Launchにより、あらゆるAIジョブをあらゆるGPUクラウドまたはオンプレミスクラスターで実行可能になります。このライブラリを基盤として、TensorOpera AI (https://TensorOpera.ai) はスケーラブルな生成AIプラットフォームを提供します。

    4,062+1直近 7 日のスター増減
  • KuiperInfer@zjhellofss

    新卒採用、秋採用、春採用、インターンシップに最適なプロジェクト!ゼロから高性能なディープラーニング推論ライブラリの実装を学び、llama2、Unet、Yolov5、Resnetなどの大規模モデルの推論をサポートします。

    3,499+2直近 7 日のスター増減
  • grule-rule-engine@hyperjumptech

    Golang によるルールエンジンの実装

    2,524+2直近 7 日のスター増減
  • onediff@siliconflow

    OneDiff: diffusion models 向けのすぐに使える高速化ライブラリ。

    1,964+0直近 7 日のスター増減
  • MTPLX@youssofal

    MLX 上で 3 倍高速化 | Qwen 3.8 27B | 外部ドラフターなしで Apple Silicon 上のネイティブ MTP Speculative Decoding に対応

    1,944+173直近 7 日のスター増減
  • sonar@dphnAI

    大規模LLM推論エンジン

    1,847+3直近 7 日のスター増減
  • xllm@xLLM-AI

    多様な AI アクセラレータ向けに最適化された、LLM、VLM、DiT、REC モデル用の高性能推論エンジン。OpenAtom Foundation でホストされています。

    1,552+11直近 7 日のスター増減
  • kvcached@ovg-project

    動的な GPU 共有などのための仮想化 Elastic KV キャッシュ

    1,275+130直近 7 日のスター増減
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Modelsは、パフォーマンス(レイテンシやメモリなど)が最適化され、Qualcomm®デバイスへのデプロイの準備が整った最先端の機械学習モデルのコレクションです。

    1,195+1直近 7 日のスター増減
  • Paddle.js@PaddlePaddle

    Paddle.jsは、ブラウザ上で動作するオープンソースのディープラーニングフレームワークであるBaidu PaddlePaddleのためのWebプロジェクトです。Paddle.jsは、事前トレーニング済みのモデルをロードするか、Paddle.jsが提供するモデル変換ツールを使用してpaddle-hubからモデルを変換することができます。WebGL、WebGPU、WebAssemblyをサポートするすべてのブラウザで動作します。また、Baidu SmartprogramやWX miniprogramでも動作します。

    1,104+1直近 7 日のスター増減
  • nobodywho@nobodywho-ooo

    NobodyWho は、あらゆるデバイス上で LLM をローカルかつ効率的に実行できる推論エンジンです。

    1,094+13直近 7 日のスター増減
  • mlxstudio@jjang-ai

    MLX Studio - JANG_Qのホーム - 画像生成/編集 + チャット/コード一体型 - + OpenClaw (Anthropic API)

    965+4直近 7 日のスター増減
  • ZhiLight@zhihu

    Llamaとその派生モデル向けの高最適化されたLLM推論加速エンジン。

    908+0直近 7 日のスター増減
  • Savant@insight-platform

    多機能な Python コンピュータービジョンおよびビデオ分析フレームワーク

    853+4直近 7 日のスター増減
  • pegainfer@pegainfer-project

    純粋なRust + CUDAによるLLM推論エンジン — PyTorchなし、OpenAI互換、Qwen3からKimi-K2まで提供

    677+14直近 7 日のスター増減
  • mlx-dspark@ARahim3

    Apple Silicon で最大 4 倍高速なロスレス LLM デコード。DeepSeek の DSpark および z-lab の DFlash スペキュラティブデコードのネイティブ MLX ポート — Gemma-4、Qwen3.8、Muse-Glimmer、Nemotron、Ornith-1.0、三値 Bonsai-27B。

    640+22直近 7 日のスター増減
  • yalm@andrewkchan

    もう一つの言語モデル:C++/CUDA による LLM 推論(入出力以外のライブラリなし)

    596-1直近 7 日のスター増減
  • astroid@pylint-dev

    pylint などのプロジェクト向けの Python ソースコードの共通ベース表現

    582+0直近 7 日のスター増減
  • KuiperLLama@zjhellofss

    キャンパス採用やインターンシップに最適なプロジェクト。ゼロから手を動かして、LLaMA2/3およびQwen2.5をサポートする大規模言語モデル(LLM)推論フレームワークを実装します。

    573+1直近 7 日のスター増減
  • tessera@zengxiao-he

    教師モデルからタイルまで — フルスクラッチのLLM蒸留・サービングエンジン:カスタムTriton/CUDAカーネル、FSDP蒸留、ページ化KV連続バッチ処理、推測デコーディング、Rustゲートウェイ、JAXオラクル、および解釈可能性ツール。

    566+30直近 7 日のスター増減
  • krasis@brontoguana

    Krasis は、VRAM が限られたコンシューマー向けハードウェア上で大型モデルを効率的に実行することに特化したハイブリッド LLM ランタイムです

    518+2直近 7 日のスター増減
  • OpenArc@SearchSavior

    Intel デバイス向け推論エンジン。OpenAI エンドポイント経由で LLM、VLM、Whisper、Kokoro-TTS、埋め込み、再ランク付けモデルを提供します。

    516+4直近 7 日のスター増減
← トピック一覧に戻る