inference-engine
inference-engine がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
inference-engine と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、inference-engine がタグ付けされたリポジトリ。
- #1
2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。
★ 7,164 - #2
Apple Silicon で最大 4 倍高速なロスレス LLM デコード。DeepSeek の DSpark および z-lab の DFlash スペキュラティブデコードのネイティブ MLX ポート — Gemma-4、Qwen3.8、Muse-Glimmer、Nemotron、Ornith-1.0、三値 Bonsai-27B。
★ 640
- #1
✍🏻 ソースコード深掘り、システム設計&エンジニアリングブログ | Halfrost-Field 氷霜之地:ソースコード解析、システム設計とエンジニアリング実践ノート
★ 13,226+6直近 7 日のスター増減 - #2
2.78兆パラメータのKimi K3を単一CPU上で8.24 GBのRAMで推論実行。ポータブルC99: BLAS、フレームワーク、GPUなし。
★ 7,164+442直近 7 日のスター増減 - #3
FEDML - 大規模分散学習、モデルサービング、フェデレーテッドラーニングのための統一的でスケーラブルなMLライブラリ。クロスクラウドスケジューラであるFEDML Launchにより、あらゆるAIジョブをあらゆるGPUクラウドまたはオンプレミスクラスターで実行可能になります。このライブラリを基盤として、TensorOpera AI (https://TensorOpera.ai) はスケーラブルな生成AIプラットフォームを提供します。
★ 4,062+1直近 7 日のスター増減 - #4
新卒採用、秋採用、春採用、インターンシップに最適なプロジェクト!ゼロから高性能なディープラーニング推論ライブラリの実装を学び、llama2、Unet、Yolov5、Resnetなどの大規模モデルの推論をサポートします。
★ 3,499+2直近 7 日のスター増減 - #5
Golang によるルールエンジンの実装
★ 2,524+2直近 7 日のスター増減 - #6★ 1,964+0直近 7 日のスター増減
- #7
MLX 上で 3 倍高速化 | Qwen 3.8 27B | 外部ドラフターなしで Apple Silicon 上のネイティブ MTP Speculative Decoding に対応
★ 1,944+173直近 7 日のスター増減 - #8★ 1,847+3直近 7 日のスター増減
- #9★ 1,552+11直近 7 日のスター増減
- #10★ 1,275+130直近 7 日のスター増減
- #11
Qualcomm® AI Hub Modelsは、パフォーマンス(レイテンシやメモリなど)が最適化され、Qualcomm®デバイスへのデプロイの準備が整った最先端の機械学習モデルのコレクションです。
★ 1,195+1直近 7 日のスター増減 - #12
Paddle.jsは、ブラウザ上で動作するオープンソースのディープラーニングフレームワークであるBaidu PaddlePaddleのためのWebプロジェクトです。Paddle.jsは、事前トレーニング済みのモデルをロードするか、Paddle.jsが提供するモデル変換ツールを使用してpaddle-hubからモデルを変換することができます。WebGL、WebGPU、WebAssemblyをサポートするすべてのブラウザで動作します。また、Baidu SmartprogramやWX miniprogramでも動作します。
★ 1,104+1直近 7 日のスター増減 - #13★ 1,094+13直近 7 日のスター増減
- #14★ 965+4直近 7 日のスター増減
- #15★ 908+0直近 7 日のスター増減
- #16★ 853+4直近 7 日のスター増減
- #17★ 677+14直近 7 日のスター増減
- #18
Apple Silicon で最大 4 倍高速なロスレス LLM デコード。DeepSeek の DSpark および z-lab の DFlash スペキュラティブデコードのネイティブ MLX ポート — Gemma-4、Qwen3.8、Muse-Glimmer、Nemotron、Ornith-1.0、三値 Bonsai-27B。
★ 640+22直近 7 日のスター増減 - #19★ 596-1直近 7 日のスター増減
- #20★ 582+0直近 7 日のスター増減
- #21
キャンパス採用やインターンシップに最適なプロジェクト。ゼロから手を動かして、LLaMA2/3およびQwen2.5をサポートする大規模言語モデル(LLM)推論フレームワークを実装します。
★ 573+1直近 7 日のスター増減 - #22
教師モデルからタイルまで — フルスクラッチのLLM蒸留・サービングエンジン:カスタムTriton/CUDAカーネル、FSDP蒸留、ページ化KV連続バッチ処理、推測デコーディング、Rustゲートウェイ、JAXオラクル、および解釈可能性ツール。
★ 566+30直近 7 日のスター増減 - #23★ 518+2直近 7 日のスター増減
- #24
Intel デバイス向け推論エンジン。OpenAI エンドポイント経由で LLM、VLM、Whisper、Kokoro-TTS、埋め込み、再ランク付けモデルを提供します。
★ 516+4直近 7 日のスター増減