メインコンテンツへスキップ
buildradar
Sign in
トピック · llm-inference

llm-inference

llm-inference がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

84 件のリポジトリ
  • llama3.java@mukel

    純粋なJavaによるLlama 3以降の推論

    816+0直近 7 日のスター増減
  • lws@kubernetes-sigs

    LeaderWorkerSet: ポッドのグループをレプリケーションの単位としてデプロイするためのAPI

    810+5直近 7 日のスター増減
  • LLM-PowerHouse: カスタムトレーニングと推論のための厳選されたチュートリアル、ベストプラクティス、すぐに使えるコードを通じて、LLMの可能性を最大限に引き出す

    731+0直近 7 日のスター増減
  • llmflows@stoyan-stoyanov

    LLMFlows - シンプル、明示的、かつ透明性の高い LLM アプリ

    707+0直近 7 日のスター増減
  • long-context-attention@feifeibear

    USP: 長文脈 Transformer モデルのトレーニングと推論のための統一型(ハイブリッド / 2D)シーケンス並列アテンション

    692+2直近 7 日のスター増減
  • pegainfer@pegainfer-project

    純粋なRust + CUDAによるLLM推論エンジン — PyTorchなし、OpenAI互換、Qwen3からKimi-K2まで提供

    678+9直近 7 日のスター増減
  • atlas@Avarok-Cybersecurity

    純粋なRust製の推論エンジン

    677+2直近 7 日のスター増減
  • mlx-dspark@ARahim3

    Apple Silicon で最大 4 倍高速なロスレス LLM デコード。DeepSeek の DSpark および z-lab の DFlash スペキュラティブデコードのネイティブ MLX ポート — Gemma-4、Qwen3.8、Muse-Glimmer、Nemotron、Ornith-1.0、三値 Bonsai-27B。

    645+15直近 7 日のスター増減
  • zero-to-sglang@datawhalechina

    Official SGLang × Datawhale course on LLM inference (中英双语): understand inference, build a mini-sglang from scratch, then read the real SGLang source and land your first PR. 《从零手搓SGLang》:读懂推理,手搓 mini-sglang,吃透 SGLang 源码。

    627直近 7 日のスター増減
  • hipfire@warpfront

    Rust 製の RDNA ネイティブ LLM 推論エンジン

    613+20直近 7 日のスター増減
  • rkllama@NotPunchnox

    Rockchip NPU 向け Ollama 代替: 最適化された NPU サポート (rkllm) により Rockchip デバイス上で AI およびディープラーニングモデルを実行するための効率的なソリューション

    602+6直近 7 日のスター増減
  • yalm@andrewkchan

    もう一つの言語モデル:C++/CUDA による LLM 推論(入出力以外のライブラリなし)

    596+0直近 7 日のスター増減
  • qvac@tetherto

    オープンソースのローカル AI SDK。クラウドや API キーなしでデバイス上で AI を実行可能。GGUF、RAG、画像・音楽・動画生成、音声認識、P2P 推論などをサポート。クロスプラットフォーム対応 (Linux、macOS、Windows、Android、iOS)。

    594+15直近 7 日のスター増減
  • MiniSearch@felladrin

    ブラウザから直接実行できる AI アシスタントを搭載した、ミニマリスト向けのウェブ検索プラットフォーム。デモ: https://felladrin-minisearch.hf.space

    585-1直近 7 日のスター増減
  • uzi@devflowinc

    git worktreeを使用して多数のコーディングエージェントを並列実行するためのCLI。

    582+0直近 7 日のスター増減
  • LLM-Hub@timmyy123

    ローカル AI アシスタント

    580+5直近 7 日のスター増減
  • LLM-FineTuning-Large-Language-Models@rohan-paul

    LLM(大規模言語モデル)のファインチューニング

    579+1直近 7 日のスター増減
  • KuiperLLama@zjhellofss

    キャンパス採用やインターンシップに最適なプロジェクト。ゼロから手を動かして、LLaMA2/3およびQwen2.5をサポートする大規模言語モデル(LLM)推論フレームワークを実装します。

    573+0直近 7 日のスター増減
  • qwen600@yassa9

    静的でsucklessな単一バッチのCUDA専用qwen3-0.6Bミニ推論エンジン

    560+0直近 7 日のスター増減
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    522+13直近 7 日のスター増減
  • sarathi-serve@microsoft

    LLM 向けの低遅延かつ高スループットなサービングエンジン

    521+1直近 7 日のスター増減
  • krasis@brontoguana

    Krasis は、VRAM が限られたコンシューマー向けハードウェア上で大型モデルを効率的に実行することに特化したハイブリッド LLM ランタイムです

    519+3直近 7 日のスター増減
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507+3直近 7 日のスター増減
  • vllm-cli@Chen-zexi

    vLLM を使用して LLM を提供するためのコマンドラインインターフェイスツール。

    505-1直近 7 日のスター増減
← トピック一覧に戻る