メインコンテンツへスキップ
buildradar
Sign in
トピック · llm-inference

llm-inference

llm-inference がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

84 件のリポジトリ
  • 分散型 LLM 推論。ホームデバイスを強力なクラスターに接続して LLM 推論を高速化します。デバイスが多いほど推論が高速になります。

    3,050+0直近 7 日のスター増減
  • Medusa@FasterDecoding

    Medusa: 複数のデコードヘッドでLLMの生成を加速するシンプルなフレームワーク

    2,771+0直近 7 日のスター増減
  • EAGLE@SafeAILab

    EAGLE-1 (ICML'24)、EAGLE-2 (EMNLP'24)、EAGLE-3 (NeurIPS'25) の公式実装

    2,521+0直近 7 日のスター増減
  • nanocoder@Nano-Collective

    企業ではなくコミュニティによって構築された、ターミナル向けのオープンなコーディングエージェント。独自のモデルを持ち込み、コードを自分のマシンの上に保持し、誰にも縛られません。

    2,439+0直近 7 日のスター増減
  • neuron-ai@neuron-core

    本番環境対応の AI 駆動型アプリケーションを構築するための PHP エコシステムの Agentic フレームワーク。コンポーネント(LLM、ツール、ベクトル DB、メモリ)を、データや UI と対話するエージェントに接続します。

    2,086+0直近 7 日のスター増減
  • aici@microsoft

    AICI: プロンプトとしての(Wasm)プログラム

    2,076+0直近 7 日のスター増減
  • llama2-webui@liltom-eth

    Linux、Windows、Macの環境を問わず、GPUまたはCPU上でgradio UIを使用してLlama 2をローカルで実行。Generative Agents/Appsのローカルllama2バックエンドとして`llama2-wrapper`を使用できます。

    1,936+0直近 7 日のスター増減
  • beta9@beam-cloud

    超高速なサーバーレス GPU 推論、サンドボックス、バックグラウンドジョブ

    1,764+0直近 7 日のスター増減
  • react-native-executorch@software-mansion

    ExecuTorch を活用し、React Native でデバイス上の AI モデルを実行する宣言的な方法。

    1,707+0直近 7 日のスター増減
  • InferenceX@SemiAnalysisAI

    オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応

    1,613+0直近 7 日のスター増減
  • xllm@xLLM-AI

    多様な AI アクセラレータ向けに最適化された、LLM、VLM、DiT、REC モデル用の高性能推論エンジン。OpenAtom Foundation でホストされています。

    1,552+0直近 7 日のスター増減
  • aigrantsindia@aigrantsindia

    クレジット、助成金、リソースを通じてインドのAIを育成する非営利団体

    1,461+0直近 7 日のスター増減
  • BrowserAI@sauravpanda

    llama、deepseek-distill、kokoro などのローカル LLM をブラウザ内で実行

    1,449+0直近 7 日のスター増減
  • AI を活用してウェブ検索を行えるソフトウェアのリスト: https://hf.co/spaces/felladrin/awesome-ai-web-search

    1,426+0直近 7 日のスター増減
  • Atomic-Chat@AtomicBot-ai

    エージェント向けのローカル AI アプリおよび推論エンジン。オープンウェイトの LLM をコンピュータ上でローカルに実行可能 — プライベート、100% オフライン。Discord への参加はこちら: https://discord.com/invite/8wGSsvmg4V

    1,413+0直近 7 日のスター増減
  • scaling-book@jax-ml

    TPU 上での LLM スケーリングに関するブログ形式の短い解説書「How To Scale Your Model」のホーム

    1,396+0直近 7 日のスター増減
  • 複数のドメインにわたる最高峰のペネトレーションテストツールと生産性ユーティリティの厳選されたコレクション。参加して探索、貢献し、ハッキングツールキットを強化しよう!

    1,383+0直近 7 日のスター増減
  • LeanCopilot@lean-dojo

    Leanでの定理証明のコパイロットとしてのLLM

    1,318+0直近 7 日のスター増減
  • kvcached@ovg-project

    動的な GPU 共有などのための仮想化 Elastic KV キャッシュ

    1,275+0直近 7 日のスター増減
  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1,229+164直近 7 日のスター増減
  • prompt-poet@character-ai

    ローコードアプローチにより、開発者と非エンジニアの両方にとってプロンプトの設計を効率化・簡素化します。

    1,154+0直近 7 日のスター増減
  • tiny-vllm@jmaczan

    C++とCUDAで高性能なLLM推論エンジンを構築する - vLLMの軽量版

    1,100+10直近 7 日のスター増減
  • OpenAlpha_Evolve@shyamsaktawat

    OpenAlpha_Evolve は、DeepMind の AlphaEvolve のような自律型コーディングエージェントに関する画期的な研究にインスパイアされた、オープンソースの Python フレームワークです。

    1,050-1直近 7 日のスター増減
  • AI-Compass@tingaicompass

    「AI-Compass」は、AI 技術の海原を航海するための指針をコミュニティに提供します。初心者から上級開発者まで、AI のあらゆる分野への道を見つけることができます。開発者が AI のコアコンセプト、主要技術、最新トレンドを体系的に理解し、実践を通じて理論から実装までの全プロセスを習得することを目的としています。

    937+7直近 7 日のスター増減
  • 最小プランの価格順に並べられた素晴らしいホスティングのリスト

    926+2直近 7 日のスター増減
  • コンピューター上でリアルタイムにチャットを行うための、複数のモデルの純粋な C++ 実装 (CPU & GPU 対応)

    925+3直近 7 日のスター増減
  • ZhiLight@zhihu

    Llamaとその派生モデル向けの高最適化されたLLM推論加速エンジン。

    908+0直近 7 日のスター増減
  • llm_note@harleyszhang

    LLM に関するノート。モデル推論、Transformer モデルの構造、LLM フレームワークのコード解析ノートを含む。

    890+1直近 7 日のスター増減
  • LLM 推論サービングと最適化のための、1日30分・10週間のロードマップ。vLLM、SGLang、量子化、予測デコード、ベンチマーク。

    887+21直近 7 日のスター増減
  • LLM.swift@eastriverlee

    LLM.swiftは、macOS、iOS、watchOS、tvOS、visionOS向けに、ローカルで大規模言語モデルと簡単に対話できる、シンプルで読みやすいライブラリです。

    874+1直近 7 日のスター増減
← トピック一覧に戻る